datasets
Repositorios de código abierto monitorizados etiquetados con datasets, ordenados por estrellas.
- #61★ 939+0Variación de estrellas de los últimos 7 días
- #62
Seguimiento de conjuntos de datos médicos, con enfoque en imágenes médicas
★ 926+2Variación de estrellas de los últimos 7 días - #63
Backend que impulsa el visor de datasets en las páginas de datasets de Hugging Face a través de una API pública.
★ 900+1Variación de estrellas de los últimos 7 días - #64
Croissant es un formato de alto nivel para conjuntos de datos de aprendizaje automático que integra cuatro capas enriquecidas.
★ 895+5Variación de estrellas de los últimos 7 días - #65
Una colección de proyectos públicos sobre modelos de lenguaje extensos (LLM), modelos de lenguaje visual (VLM), acción de lenguaje visual (VLA), contenido generado por IA (AIGC), y sus conjuntos de datos y aplicaciones relacionados.
★ 815+1Variación de estrellas de los últimos 7 días - #66
Enlaces útiles sobre diversos contenidos relacionados con IA, visión artificial y robótica
★ 783+0Variación de estrellas de los últimos 7 días - #67★ 754+1Variación de estrellas de los últimos 7 días
- #68
Una colección de conjuntos de datos de prompts e instrucciones para entrenar modelos ChatLLM como ChatGPT.
★ 744+1Variación de estrellas de los últimos 7 días - #69
Una lista curada de artículos, tesis, conjuntos de datos y herramientas relacionados con la aplicación del aprendizaje automático para la ingeniería de software
★ 733+0Variación de estrellas de los últimos 7 días - #70
Formato de archivo nuevo y extensible para el almacenamiento de conjuntos de datos columnares grandes.
★ 732+2Variación de estrellas de los últimos 7 días - #71
Open Bandit Pipeline: una biblioteca de Python para algoritmos bandit y evaluación off-policy.
★ 708+1Variación de estrellas de los últimos 7 días - #72
Marco de gestión de conjuntos de datos, una biblioteca de Python y herramienta CLI para construir, analizar y gestionar datasets de visión artificial
★ 687+0Variación de estrellas de los últimos 7 días - #73
Logotipos, medios, imágenes de muestra, pesos de modelos preentrenados, artefactos de conjuntos de datos y activos de lanzamiento compartidos de Ultralytics.
★ 665+5Variación de estrellas de los últimos 7 días - #74
El primer benchmark de procesamiento de lenguaje natural a gran escala para el idioma indonesio. Proporcionamos múltiples tareas posteriores, modelos IndoBERT preentrenados y código de inicio (AACL-IJCNLP 2020)
★ 655+1Variación de estrellas de los últimos 7 días - #75
Una colección de conjuntos de datos para segmentación y detección de prominencia. Las solicitudes de extracción (PR) son bienvenidas.
★ 640+0Variación de estrellas de los últimos 7 días - #76
ExerciseDB API es una base de datos de ejercicios físicos que permite a los usuarios acceder a datos de alta calidad de más de 11,000 ejercicios. Esta API ofrece información detallada sobre cada ejercicio, incluyendo grupos musculares objetivo, equipo necesario, videos, GIFs, imágenes de guía visual e instrucciones paso a paso.
★ 621+19Variación de estrellas de los últimos 7 días - #77
Este repositorio proporciona una lista exhaustiva de conjuntos de datos de satélites ópticos y de radar seleccionados para tareas de detección, clasificación, segmentación semántica y segmentación de instancias de barcos. Estos conjuntos de datos son ideales para aplicaciones en visión artificial, aprendizaje automático, teledetección y análisis marítimo.
★ 606+0Variación de estrellas de los últimos 7 días - #78
Recursos de conjuntos de datos de histopatología.
★ 571+1Variación de estrellas de los últimos 7 días - #79
Cleora AI es un modelo de código abierto de propósito general para el aprendizaje eficiente y escalable de incrustaciones de entidades estables e inductivas para datos relacionales heterogéneos. Creado por el equipo de Synerise.com.
★ 541+1Variación de estrellas de los últimos 7 días - #80
Recursos destacados sobre generalización de dominios, incluyendo artículos, código, etc.
★ 539+1Variación de estrellas de los últimos 7 días - #81
Artículos y conjuntos de datos sobre ajuste y seguimiento de instrucciones. ✨✨✨
★ 511-1Variación de estrellas de los últimos 7 días