dataset
Repositorios de código abierto monitorizados etiquetados con dataset, ordenados por estrellas.
- #91
Libera el poder de los LLM: ¡Explora estos conjuntos de datos para entrenar tu propio ChatGPT!
★ 768+0Variación de estrellas de los últimos 7 días - #92
Un sistema de procesamiento de datos de alto rendimiento en Clojure.
★ 760+1Variación de estrellas de los últimos 7 días - #93★ 756+1Variación de estrellas de los últimos 7 días
- #94
Conjunto de datos para pareados. Base de datos de 700.000 pareados.
★ 747+1Variación de estrellas de los últimos 7 días - #95
Aprendizaje de características para detección e identificación conjunta en la búsqueda de personas.
★ 746+0Variación de estrellas de los últimos 7 días - #96
Convertidor de JSON a DataSet y de DataSet a JSON para Delphi y Lazarus (FPC).
★ 744-1Variación de estrellas de los últimos 7 días - #97
Extensiones de conjuntos de datos, streaming y sistemas de archivos mantenidas por TensorFlow SIG-IO
★ 739+0Variación de estrellas de los últimos 7 días - #98
Thorsten-Voice: Una voz TTS en alemán de alta calidad, gratuita y sin conexión, diseñada para utilizarse en cualquier proyecto sin complicaciones de licencia.
★ 729+1Variación de estrellas de los últimos 7 días - #99
Implementación sencilla del modelo CLIP de OpenAI en PyTorch.
★ 726+0Variación de estrellas de los últimos 7 días - #100
[CVPR 2024] MovieChat: De tokens densos a memoria dispersa para la comprensión de videos largos
★ 706+0Variación de estrellas de los últimos 7 días - #101
Conjunto de código de detección y localización de objetos pequeños basado en puntos de UCAS-VG
★ 694+0Variación de estrellas de los últimos 7 días - #102
Evaluación comparativa de la veracidad en textos largos para modelos de lenguaje extensos. Código original para nuestro artículo "Long-form factuality in large language models".
★ 693+2Variación de estrellas de los últimos 7 días - #103
Marco de gestión de conjuntos de datos, una biblioteca de Python y herramienta CLI para construir, analizar y gestionar datasets de visión artificial
★ 687+0Variación de estrellas de los últimos 7 días - #104
[ECCV'20] Structured3D: un conjunto de datos fotorrealista a gran escala para modelado 3D estructurado.
★ 682+0Variación de estrellas de los últimos 7 días - #105
HISTDATA: conjunto de datos compuesto por todos los pares de divisas FX, petróleo crudo e índices bursátiles. API sencilla para recuperar datos históricos de precios FX (hasta 1 minuto y datos tick).
★ 681+0Variación de estrellas de los últimos 7 días - #106
Un conjunto de datos de audio gratuito de dígitos hablados. Una versión de audio de MNIST.
★ 678+0Variación de estrellas de los últimos 7 días - #107
ACM Multimedia2020 University-1652: Un benchmark multivista y multisource para geolocalización basada en drones que anota 1652 edificios en 72 universidades de todo el mundo.
★ 677+1Variación de estrellas de los últimos 7 días - #108
Crea fácilmente grandes conjuntos de datos de video a partir de URLs de video.
★ 664+1Variación de estrellas de los últimos 7 días - #109★ 658+0Variación de estrellas de los últimos 7 días
- #110
Benchmark de código abierto para agentes de IA en navegadores para tareas diarias.
★ 657+40Variación de estrellas de los últimos 7 días - #111
Awesome-LLM-Eval: una lista curada de herramientas, conjuntos de datos/benchmarks, demos, tablas de clasificación, artículos, documentación y modelos, enfocada principalmente en la evaluación de LLMs.
★ 656-2Variación de estrellas de los últimos 7 días - #112
Un repositorio de conjuntos de datos interesantes recopilados para la investigación en ciencia de redes y aprendizaje automático.
★ 655+0Variación de estrellas de los últimos 7 días - #113
Ciclo de vida completo de un proyecto de ciencia de datos
★ 653+0Variación de estrellas de los últimos 7 días - #114
Un conjunto de datos de conducción para el desarrollo y validación de estimadores de pose fusionados y algoritmos de mapeo
★ 652+0Variación de estrellas de los últimos 7 días - #115
ConvoKit es un conjunto de herramientas para extraer características conversacionales y analizar fenómenos sociales en conversaciones. Incluye varios conjuntos de datos conversacionales grandes junto con scripts que ejemplifican el uso del kit de herramientas en estos conjuntos de datos.
★ 648+1Variación de estrellas de los últimos 7 días - #116
API e instrucciones de NAS-Bench-201
★ 645+1Variación de estrellas de los últimos 7 días - #117
Repositorio del conjunto de datos Ego4d. Descarga el conjunto de datos, visualiza, extrae características y consulta ejemplos de uso.
★ 642+0Variación de estrellas de los últimos 7 días - #118
El conjunto de datos Exclusively Dark (ExDARK), que hasta donde sabemos, es la colección más grande de imágenes con poca luz tomadas en entornos de muy baja iluminación hasta el crepúsculo (10 condiciones diferentes) a la fecha, con anotaciones a nivel de clase de imagen y de objeto.
★ 640-1Variación de estrellas de los últimos 7 días - #119
Una colección de conjuntos de datos para segmentación y detección de prominencia. Las solicitudes de extracción (PR) son bienvenidas.
★ 640+1Variación de estrellas de los últimos 7 días - #120★ 632+2Variación de estrellas de los últimos 7 días