Pular para o conteúdo principal
buildradar
Sign in
Tópico · dataset

dataset

Repositórios de código aberto acompanhados marcados com dataset, ordenados por estrelas.

148 repositórios
  • Desbloqueie o poder do LLM: Explore estes datasets para treinar seu próprio ChatGPT!

    768+0Variação de estrelas nos últimos 7 dias
  • tech.ml.dataset@techascent

    Um sistema de processamento de dados de alto desempenho em Clojure

    760+0Variação de estrelas nos últimos 7 dias
  • TACO@pedropro

    🌮 Kit de ferramentas do conjunto de dados de anotações de lixo em contexto

    756+1Variação de estrelas nos últimos 7 dias
  • couplet-dataset@wb14123

    Dataset de dísticos. Base de dados de 700 mil dísticos.

    747+1Variação de estrelas nos últimos 7 dias
  • person_search@ShuangLI59

    Aprendizado conjunto de detecção e identificação de características para busca de pessoas.

    746+0Variação de estrelas nos últimos 7 dias
  • dataset-serialize@viniciussanchez

    Conversor de JSON para DataSet e de DataSet para JSON para Delphi e Lazarus (FPC)

    744+1Variação de estrelas nos últimos 7 dias
  • io@tensorflow

    Extensões de dataset, streaming e sistema de arquivos mantidas pelo TensorFlow SIG-IO

    739+0Variação de estrelas nos últimos 7 dias
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: Uma voz TTS em alemão de alta qualidade, gratuita e offline, disponível para qualquer projeto sem complicações de licença.

    729+1Variação de estrelas nos últimos 7 dias
  • OpenAI-CLIP@moein-shariatnia

    Implementação simples do modelo OpenAI CLIP em PyTorch.

    726+0Variação de estrelas nos últimos 7 dias
  • MovieChat@wenhaochai

    [CVPR 2024] MovieChat: From Dense Token to Sparse Memory for Long Video Understanding

    706+0Variação de estrelas nos últimos 7 dias
  • PointTinyBenchmark@ucas-vg

    Conjunto de código de detecção e localização de objetos pequenos e baseados em pontos da UCAS-VG

    694+1Variação de estrelas nos últimos 7 dias
  • long-form-factuality@google-deepmind

    Benchmarking de factualidade de formato longo em grandes modelos de linguagem. Código original para nosso artigo "Long-form factuality in large language models".

    693+2Variação de estrelas nos últimos 7 dias
  • datumaro@open-edge-platform

    Framework de gerenciamento de datasets, uma biblioteca Python e ferramenta de CLI para construir, analisar e gerenciar datasets de Computer Vision

    689+2Variação de estrelas nos últimos 7 dias
  • Structured3D@bertjiazheng

    [ECCV'20] Structured3D: Um grande conjunto de dados foto-realista para modelagem 3D estruturada

    682+2Variação de estrelas nos últimos 7 dias
  • FX-1-Minute-Data@philipperemy

    HISTDATA - Conjunto de dados composto por todos os pares de negociação de FX, petróleo bruto e índices de ações. API simples para recuperar dados históricos de preços de FX (até 1 minuto e dados de tick).

    681+0Variação de estrelas nos últimos 7 dias
  • Um conjunto de dados de áudio gratuito de dígitos falados. Uma versão em áudio do MNIST.

    678+0Variação de estrelas nos últimos 7 dias
  • ACM Multimedia2020 University-1652: Um benchmark multi-visão e multi-fonte para geolocalização baseada em drones :helicopter: que rotula 1652 edifícios em 72 universidades ao redor do mundo.

    677+5Variação de estrelas nos últimos 7 dias
  • ClawBench@TIGER-AI-Lab

    Benchmark de código aberto para agentes de IA de navegador em tarefas diárias.

    675+72Variação de estrelas nos últimos 7 dias
  • video2dataset@iejMac

    Crie facilmente grandes conjuntos de dados de vídeo a partir de URLs de vídeo

    664+1Variação de estrelas nos últimos 7 dias
  • datalad@datalad

    Mantenha código, dados e containers sob controle com git e git-annex

    660+3Variação de estrelas nos últimos 7 dias
  • Awesome-LLM-Eval: uma lista com curadoria de ferramentas, conjuntos de dados/benchmarks, demonstrações, placares, artigos, documentos e modelos, focada principalmente na avaliação de LLMs.

    656-2Variação de estrelas nos últimos 7 dias
  • datasets@benedekrozemberczki

    Um repositório de conjuntos de dados bem legais que coletei para pesquisas em ciência de redes e aprendizado de máquina.

    655+0Variação de estrelas nos últimos 7 dias
  • Ciclo de vida completo de um projeto de ciência de dados

    653+0Variação de estrelas nos últimos 7 dias
  • comma2k19@commaai

    Um conjunto de dados de direção para o desenvolvimento e validação de estimadores de pose fundidos e algoritmos de mapeamento

    653+3Variação de estrelas nos últimos 7 dias
  • ConvoKit@CornellNLP

    ConvoKit é um kit de ferramentas para extrair recursos conversacionais e analisar fenômenos sociais em conversas. Ele inclui vários grandes conjuntos de dados conversacionais junto com scripts que exemplificam o uso do kit de ferramentas nesses conjuntos de dados.

    648+1Variação de estrelas nos últimos 7 dias
  • NAS-Bench-201@D-X-Y

    API e instruções do NAS-Bench-201

    646+1Variação de estrelas nos últimos 7 dias
  • Ego4d@facebookresearch

    Repositório do dataset Ego4d. Baixe o dataset, visualize, extraia recursos e veja exemplos de uso.

    644+5Variação de estrelas nos últimos 7 dias
  • Dataset Exclusively Dark (ExDARK), que, até onde sabemos, é a maior coleção de imagens em condições de pouca luz tiradas em ambientes muito escuros até o crepúsculo (ou seja, 10 condições diferentes) até o momento, com anotações em nível de classe de imagem e de objeto.

    640-1Variação de estrelas nos últimos 7 dias
  • Uma coleção de datasets para segmentação / detecção de saliência. Pull requests são bem-vindos.

    640+0Variação de estrelas nos últimos 7 dias
  • TrustLLM@HowieHwong

    [ICML 2024] TrustLLM: Confiabilidade em Modelos de Linguagem Grandes

    632+2Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos