Pular para o conteúdo principal
buildradar
Sign in

esbatmop/MNBVC

@esbatmop

MNBVC (Massive Never-ending BT Vast Chinese corpus). Um conjunto de dados chinês em larga escala, comparável aos 40T de dados usados para treinar o ChatGPT, abrangendo desde cultura mainstream até nichos e gírias.

Estrelas
4.272
Bifurcações
297
Linguagem
Licença
MIT
Último push
há 1 semana
chinesechinese-nlpnlpnlp-machine-learningchinese-simplifiedchinese-languagecorpus-data

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.