Saltar al contenido principal
buildradar
Sign in
Tema · datasets

datasets

Repositorios de código abierto monitorizados etiquetados con datasets, ordenados por estrellas.

81 repositorios
  • commons@datasets

    DataHub commons. Conjuntos de datos interesantes e importantes.

    939+0Variación de estrellas de los últimos 7 días
  • Seguimiento de conjuntos de datos médicos, con enfoque en imágenes médicas

    926+2Variación de estrellas de los últimos 7 días
  • dataset-viewer@huggingface

    Backend que impulsa el visor de datasets en las páginas de datasets de Hugging Face a través de una API pública.

    900+1Variación de estrellas de los últimos 7 días
  • croissant@mlcommons

    Croissant es un formato de alto nivel para conjuntos de datos de aprendizaje automático que integra cuatro capas enriquecidas.

    895+5Variación de estrellas de los últimos 7 días
  • Una colección de proyectos públicos sobre modelos de lenguaje extensos (LLM), modelos de lenguaje visual (VLM), acción de lenguaje visual (VLA), contenido generado por IA (AIGC), y sus conjuntos de datos y aplicaciones relacionados.

    815+1Variación de estrellas de los últimos 7 días
  • Enlaces útiles sobre diversos contenidos relacionados con IA, visión artificial y robótica

    783+0Variación de estrellas de los últimos 7 días
  • OpenML@openml

    Aprendizaje automático abierto

    754+1Variación de estrellas de los últimos 7 días
  • Una colección de conjuntos de datos de prompts e instrucciones para entrenar modelos ChatLLM como ChatGPT.

    744+1Variación de estrellas de los últimos 7 días
  • ml4se@saltudelft

    Una lista curada de artículos, tesis, conjuntos de datos y herramientas relacionados con la aplicación del aprendizaje automático para la ingeniería de software

    733+0Variación de estrellas de los últimos 7 días
  • nimble@facebookincubator

    Formato de archivo nuevo y extensible para el almacenamiento de conjuntos de datos columnares grandes.

    732+2Variación de estrellas de los últimos 7 días
  • zr-obp@st-tech

    Open Bandit Pipeline: una biblioteca de Python para algoritmos bandit y evaluación off-policy.

    708+1Variación de estrellas de los últimos 7 días
  • datumaro@open-edge-platform

    Marco de gestión de conjuntos de datos, una biblioteca de Python y herramienta CLI para construir, analizar y gestionar datasets de visión artificial

    687+0Variación de estrellas de los últimos 7 días
  • assets@ultralytics

    Logotipos, medios, imágenes de muestra, pesos de modelos preentrenados, artefactos de conjuntos de datos y activos de lanzamiento compartidos de Ultralytics.

    665+5Variación de estrellas de los últimos 7 días
  • indonlu@IndoNLP

    El primer benchmark de procesamiento de lenguaje natural a gran escala para el idioma indonesio. Proporcionamos múltiples tareas posteriores, modelos IndoBERT preentrenados y código de inicio (AACL-IJCNLP 2020)

    655+1Variación de estrellas de los últimos 7 días
  • Una colección de conjuntos de datos para segmentación y detección de prominencia. Las solicitudes de extracción (PR) son bienvenidas.

    640+0Variación de estrellas de los últimos 7 días
  • ExerciseDB API es una base de datos de ejercicios físicos que permite a los usuarios acceder a datos de alta calidad de más de 11,000 ejercicios. Esta API ofrece información detallada sobre cada ejercicio, incluyendo grupos musculares objetivo, equipo necesario, videos, GIFs, imágenes de guía visual e instrucciones paso a paso.

    621+19Variación de estrellas de los últimos 7 días
  • Este repositorio proporciona una lista exhaustiva de conjuntos de datos de satélites ópticos y de radar seleccionados para tareas de detección, clasificación, segmentación semántica y segmentación de instancias de barcos. Estos conjuntos de datos son ideales para aplicaciones en visión artificial, aprendizaje automático, teledetección y análisis marítimo.

    606+0Variación de estrellas de los últimos 7 días
  • Recursos de conjuntos de datos de histopatología.

    571+1Variación de estrellas de los últimos 7 días
  • cleora@BaseModelAI

    Cleora AI es un modelo de código abierto de propósito general para el aprendizaje eficiente y escalable de incrustaciones de entidades estables e inductivas para datos relacionales heterogéneos. Creado por el equipo de Synerise.com.

    541+1Variación de estrellas de los últimos 7 días
  • Recursos destacados sobre generalización de dominios, incluyendo artículos, código, etc.

    539+1Variación de estrellas de los últimos 7 días
  • Artículos y conjuntos de datos sobre ajuste y seguimiento de instrucciones. ✨✨✨

    511-1Variación de estrellas de los últimos 7 días
← Volver a temas