dataset
Repositórios de código aberto acompanhados marcados com dataset, ordenados por estrelas.
- #91
Desbloqueie o poder do LLM: Explore estes datasets para treinar seu próprio ChatGPT!
★ 768+0Variação de estrelas nos últimos 7 dias - #92
Um sistema de processamento de dados de alto desempenho em Clojure
★ 760+0Variação de estrelas nos últimos 7 dias - #93★ 756+1Variação de estrelas nos últimos 7 dias
- #94
Dataset de dísticos. Base de dados de 700 mil dísticos.
★ 747+1Variação de estrelas nos últimos 7 dias - #95
Aprendizado conjunto de detecção e identificação de características para busca de pessoas.
★ 746+0Variação de estrelas nos últimos 7 dias - #96
Conversor de JSON para DataSet e de DataSet para JSON para Delphi e Lazarus (FPC)
★ 744+1Variação de estrelas nos últimos 7 dias - #97★ 739+0Variação de estrelas nos últimos 7 dias
- #98
Thorsten-Voice: Uma voz TTS em alemão de alta qualidade, gratuita e offline, disponível para qualquer projeto sem complicações de licença.
★ 729+1Variação de estrelas nos últimos 7 dias - #99
Implementação simples do modelo OpenAI CLIP em PyTorch.
★ 726+0Variação de estrelas nos últimos 7 dias - #100
[CVPR 2024] MovieChat: From Dense Token to Sparse Memory for Long Video Understanding
★ 706+0Variação de estrelas nos últimos 7 dias - #101
Conjunto de código de detecção e localização de objetos pequenos e baseados em pontos da UCAS-VG
★ 694+1Variação de estrelas nos últimos 7 dias - #102
Benchmarking de factualidade de formato longo em grandes modelos de linguagem. Código original para nosso artigo "Long-form factuality in large language models".
★ 693+2Variação de estrelas nos últimos 7 dias - #103
Framework de gerenciamento de datasets, uma biblioteca Python e ferramenta de CLI para construir, analisar e gerenciar datasets de Computer Vision
★ 689+2Variação de estrelas nos últimos 7 dias - #104
[ECCV'20] Structured3D: Um grande conjunto de dados foto-realista para modelagem 3D estruturada
★ 682+2Variação de estrelas nos últimos 7 dias - #105
HISTDATA - Conjunto de dados composto por todos os pares de negociação de FX, petróleo bruto e índices de ações. API simples para recuperar dados históricos de preços de FX (até 1 minuto e dados de tick).
★ 681+0Variação de estrelas nos últimos 7 dias - #106
Um conjunto de dados de áudio gratuito de dígitos falados. Uma versão em áudio do MNIST.
★ 678+0Variação de estrelas nos últimos 7 dias - #107
ACM Multimedia2020 University-1652: Um benchmark multi-visão e multi-fonte para geolocalização baseada em drones :helicopter: que rotula 1652 edifícios em 72 universidades ao redor do mundo.
★ 677+5Variação de estrelas nos últimos 7 dias - #108
Benchmark de código aberto para agentes de IA de navegador em tarefas diárias.
★ 675+72Variação de estrelas nos últimos 7 dias - #109
Crie facilmente grandes conjuntos de dados de vídeo a partir de URLs de vídeo
★ 664+1Variação de estrelas nos últimos 7 dias - #110★ 660+3Variação de estrelas nos últimos 7 dias
- #111
Awesome-LLM-Eval: uma lista com curadoria de ferramentas, conjuntos de dados/benchmarks, demonstrações, placares, artigos, documentos e modelos, focada principalmente na avaliação de LLMs.
★ 656-2Variação de estrelas nos últimos 7 dias - #112
Um repositório de conjuntos de dados bem legais que coletei para pesquisas em ciência de redes e aprendizado de máquina.
★ 655+0Variação de estrelas nos últimos 7 dias - #113
Ciclo de vida completo de um projeto de ciência de dados
★ 653+0Variação de estrelas nos últimos 7 dias - #114
Um conjunto de dados de direção para o desenvolvimento e validação de estimadores de pose fundidos e algoritmos de mapeamento
★ 653+3Variação de estrelas nos últimos 7 dias - #115
ConvoKit é um kit de ferramentas para extrair recursos conversacionais e analisar fenômenos sociais em conversas. Ele inclui vários grandes conjuntos de dados conversacionais junto com scripts que exemplificam o uso do kit de ferramentas nesses conjuntos de dados.
★ 648+1Variação de estrelas nos últimos 7 dias - #116
API e instruções do NAS-Bench-201
★ 646+1Variação de estrelas nos últimos 7 dias - #117
Repositório do dataset Ego4d. Baixe o dataset, visualize, extraia recursos e veja exemplos de uso.
★ 644+5Variação de estrelas nos últimos 7 dias - #118
Dataset Exclusively Dark (ExDARK), que, até onde sabemos, é a maior coleção de imagens em condições de pouca luz tiradas em ambientes muito escuros até o crepúsculo (ou seja, 10 condições diferentes) até o momento, com anotações em nível de classe de imagem e de objeto.
★ 640-1Variação de estrelas nos últimos 7 dias - #119
Uma coleção de datasets para segmentação / detecção de saliência. Pull requests são bem-vindos.
★ 640+0Variação de estrelas nos últimos 7 dias - #120★ 632+2Variação de estrelas nos últimos 7 dias