Saltar al contenido principal
buildradar
Sign in
Tema · dataset

dataset

Repositorios de código abierto monitorizados etiquetados con dataset, ordenados por estrellas.

148 repositorios
  • Libera el poder de los LLM: ¡Explora estos conjuntos de datos para entrenar tu propio ChatGPT!

    768+0Variación de estrellas de los últimos 7 días
  • tech.ml.dataset@techascent

    Un sistema de procesamiento de datos de alto rendimiento en Clojure.

    760+1Variación de estrellas de los últimos 7 días
  • TACO@pedropro

    🌮 Kit de herramientas para el conjunto de datos Trash Annotations in Context.

    756+1Variación de estrellas de los últimos 7 días
  • couplet-dataset@wb14123

    Conjunto de datos para pareados. Base de datos de 700.000 pareados.

    747+1Variación de estrellas de los últimos 7 días
  • person_search@ShuangLI59

    Aprendizaje de características para detección e identificación conjunta en la búsqueda de personas.

    746+0Variación de estrellas de los últimos 7 días
  • dataset-serialize@viniciussanchez

    Convertidor de JSON a DataSet y de DataSet a JSON para Delphi y Lazarus (FPC).

    744-1Variación de estrellas de los últimos 7 días
  • io@tensorflow

    Extensiones de conjuntos de datos, streaming y sistemas de archivos mantenidas por TensorFlow SIG-IO

    739+0Variación de estrellas de los últimos 7 días
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: Una voz TTS en alemán de alta calidad, gratuita y sin conexión, diseñada para utilizarse en cualquier proyecto sin complicaciones de licencia.

    729+1Variación de estrellas de los últimos 7 días
  • OpenAI-CLIP@moein-shariatnia

    Implementación sencilla del modelo CLIP de OpenAI en PyTorch.

    726+0Variación de estrellas de los últimos 7 días
  • MovieChat@wenhaochai

    [CVPR 2024] MovieChat: De tokens densos a memoria dispersa para la comprensión de videos largos

    706+0Variación de estrellas de los últimos 7 días
  • PointTinyBenchmark@ucas-vg

    Conjunto de código de detección y localización de objetos pequeños basado en puntos de UCAS-VG

    694+0Variación de estrellas de los últimos 7 días
  • long-form-factuality@google-deepmind

    Evaluación comparativa de la veracidad en textos largos para modelos de lenguaje extensos. Código original para nuestro artículo "Long-form factuality in large language models".

    693+2Variación de estrellas de los últimos 7 días
  • datumaro@open-edge-platform

    Marco de gestión de conjuntos de datos, una biblioteca de Python y herramienta CLI para construir, analizar y gestionar datasets de visión artificial

    687+0Variación de estrellas de los últimos 7 días
  • Structured3D@bertjiazheng

    [ECCV'20] Structured3D: un conjunto de datos fotorrealista a gran escala para modelado 3D estructurado.

    682+0Variación de estrellas de los últimos 7 días
  • FX-1-Minute-Data@philipperemy

    HISTDATA: conjunto de datos compuesto por todos los pares de divisas FX, petróleo crudo e índices bursátiles. API sencilla para recuperar datos históricos de precios FX (hasta 1 minuto y datos tick).

    681+0Variación de estrellas de los últimos 7 días
  • Un conjunto de datos de audio gratuito de dígitos hablados. Una versión de audio de MNIST.

    678+0Variación de estrellas de los últimos 7 días
  • ACM Multimedia2020 University-1652: Un benchmark multivista y multisource para geolocalización basada en drones que anota 1652 edificios en 72 universidades de todo el mundo.

    677+1Variación de estrellas de los últimos 7 días
  • video2dataset@iejMac

    Crea fácilmente grandes conjuntos de datos de video a partir de URLs de video.

    664+1Variación de estrellas de los últimos 7 días
  • datalad@datalad

    Mantén el control de código, datos y contenedores con git y git-annex

    658+0Variación de estrellas de los últimos 7 días
  • ClawBench@TIGER-AI-Lab

    Benchmark de código abierto para agentes de IA en navegadores para tareas diarias.

    657+40Variación de estrellas de los últimos 7 días
  • Awesome-LLM-Eval: una lista curada de herramientas, conjuntos de datos/benchmarks, demos, tablas de clasificación, artículos, documentación y modelos, enfocada principalmente en la evaluación de LLMs.

    656-2Variación de estrellas de los últimos 7 días
  • datasets@benedekrozemberczki

    Un repositorio de conjuntos de datos interesantes recopilados para la investigación en ciencia de redes y aprendizaje automático.

    655+0Variación de estrellas de los últimos 7 días
  • Ciclo de vida completo de un proyecto de ciencia de datos

    653+0Variación de estrellas de los últimos 7 días
  • comma2k19@commaai

    Un conjunto de datos de conducción para el desarrollo y validación de estimadores de pose fusionados y algoritmos de mapeo

    652+0Variación de estrellas de los últimos 7 días
  • ConvoKit@CornellNLP

    ConvoKit es un conjunto de herramientas para extraer características conversacionales y analizar fenómenos sociales en conversaciones. Incluye varios conjuntos de datos conversacionales grandes junto con scripts que ejemplifican el uso del kit de herramientas en estos conjuntos de datos.

    648+1Variación de estrellas de los últimos 7 días
  • NAS-Bench-201@D-X-Y

    API e instrucciones de NAS-Bench-201

    645+1Variación de estrellas de los últimos 7 días
  • Ego4d@facebookresearch

    Repositorio del conjunto de datos Ego4d. Descarga el conjunto de datos, visualiza, extrae características y consulta ejemplos de uso.

    642+0Variación de estrellas de los últimos 7 días
  • El conjunto de datos Exclusively Dark (ExDARK), que hasta donde sabemos, es la colección más grande de imágenes con poca luz tomadas en entornos de muy baja iluminación hasta el crepúsculo (10 condiciones diferentes) a la fecha, con anotaciones a nivel de clase de imagen y de objeto.

    640-1Variación de estrellas de los últimos 7 días
  • Una colección de conjuntos de datos para segmentación y detección de prominencia. Las solicitudes de extracción (PR) son bienvenidas.

    640+1Variación de estrellas de los últimos 7 días
  • TrustLLM@HowieHwong

    [ICML 2024] TrustLLM: Confiabilidad en modelos de lenguaje de gran tamaño.

    632+2Variación de estrellas de los últimos 7 días
← Volver a temas