bert
Repositórios de código aberto acompanhados marcados com bert, ordenados por estrelas.
- #61
Corpus de pré-treinamento em larga escala para chinês de 100G 中文预训练语料
★ 1.020+1Variação de estrelas nos últimos 7 dias - #62
Tutorial completo do algoritmo de NLP para LLM, endereço de leitura online: https://datawhalechina.github.io/base-llm/
★ 1.017+13Variação de estrelas nos últimos 7 dias - #63★ 1.010+1Variação de estrelas nos últimos 7 dias
- #64
Construindo um sistema de diálogo em chinês baseado na versão mais recente do Rasa
★ 982+0Variação de estrelas nos últimos 7 dias - #65
TextGen: Implementação de modelos de geração de texto, incluindo LLaMA, BLOOM, GPT2, BART, T5, SongNet e outros. Inclui treinamento e previsão prontos para uso para modelos como LLaMA, ChatGLM, BLOOM, GPT2, Seq2Seq, BART, T5, UDA, entre outros.
★ 981-1Variação de estrelas nos últimos 7 dias - #66
Implementação oficial dos artigos "GECToR – Grammatical Error Correction: Tag, Not Rewrite" (BEA-20) e "Text Simplification by Tagging" (BEA-21)
★ 972+0Variação de estrelas nos últimos 7 dias - #67
Modelos Transformer de BERT a GPT-4, ambientes de Hugging Face a OpenAI. Exemplos de fine-tuning, treinamento e prompt engineering. Uma seção bônus com ChatGPT, GPT-3.5-turbo, GPT-4 e DALL-E, incluindo inicialização de GPT-4, speech-to-text, text-to-speech, geração de texto para imagem com DALL-E, Google Cloud AI, HuggingGPT e muito mais
★ 966+0Variação de estrelas nos últimos 7 dias - #68
Uma biblioteca PyTorch de modelos Transformer selecionados e seus componentes combináveis
★ 890+0Variação de estrelas nos últimos 7 dias - #69
Modelos BERT pré-treinados em português
★ 880+0Variação de estrelas nos últimos 7 dias - #70
Repositório do GitHub com tutoriais para ajuste fino de transformers para diversas tarefas de PLN
★ 862+0Variação de estrelas nos últimos 7 dias - #71
PhoBERT: Modelos de linguagem pré-treinados para vietnamita (EMNLP-2020 Findings)
★ 806-1Variação de estrelas nos últimos 7 dias - #72
Classificação de texto multilabel, classificação multilabel, classificação de texto, multi-label, classifier, text classification, BERT, seq2seq, attention, multi-label-classification
★ 805+0Variação de estrelas nos últimos 7 dias - #73★ 801+1Variação de estrelas nos últimos 7 dias
- #74★ 795+0Variação de estrelas nos últimos 7 dias
- #75
O PatrickStar permite modelos pré-treinados maiores, mais rápidos e ecológicos para NLP e democratiza a IA para todos.
★ 772+0Variação de estrelas nos últimos 7 dias - #76
Implementação em PyTorch do JointBERT: "BERT for Joint Intent Classification and Slot Filling"
★ 747+0Variação de estrelas nos últimos 7 dias - #77
O repositório principal para pesquisa e desenvolvimento de QA (Question Answering) multilíngue de última geração.
★ 739-1Variação de estrelas nos últimos 7 dias - #78LLM-PowerHouse-A-Curated-Guide-for-Large-Language-Models-with-Custom-Training-and-Inferencing↗@ghimiresunil
LLM-PowerHouse: Libere o potencial de LLMs por meio de tutoriais selecionados, melhores práticas e código pronto para uso para treinamento e inferência personalizados.
★ 731+0Variação de estrelas nos últimos 7 dias - #79
Implementação simples do modelo OpenAI CLIP em PyTorch.
★ 726+0Variação de estrelas nos últimos 7 dias - #80
Revisitando Modelos Pré-treinados para Processamento de Linguagem Natural em Chinês (MacBERT)
★ 721+2Variação de estrelas nos últimos 7 dias - #81
Awesome-LLM-Eval: uma lista com curadoria de ferramentas, conjuntos de dados/benchmarks, demonstrações, placares, artigos, documentos e modelos, focada principalmente na avaliação de LLMs.
★ 656-2Variação de estrelas nos últimos 7 dias - #82
O primeiro e maior benchmark de processamento de linguagem natural para a língua indonésia. Fornecemos múltiplas tarefas de downstream, modelos IndoBERT pré-treinados e código inicial! (AACL-IJCNLP 2020)
★ 655+1Variação de estrelas nos últimos 7 dias - #83
BERTweet: Um modelo de linguagem pré-treinado para Tweets em inglês (EMNLP-2020)
★ 609+0Variação de estrelas nos últimos 7 dias - #84
Uma implementação do modelo BERT e suas tarefas downstream relacionadas com base no framework PyTorch. @跟我学机器学习
★ 604+0Variação de estrelas nos últimos 7 dias - #85★ 604+0Variação de estrelas nos últimos 7 dias
- #86
Verificação de ancoragem em nível de trecho para saídas de IA baseadas em RAG, código e ferramentas.
★ 603+1Variação de estrelas nos últimos 7 dias - #87★ 592-1Variação de estrelas nos últimos 7 dias
- #88
Este é um repositório de NLP de Deep Learning que organiza desde o pré-processamento de texto usando TensorFlow até tarefas downstream de modelos modernos como Topic Models, BERT, GPT e LLM.
★ 581+0Variação de estrelas nos últimos 7 dias - #89
Tradução para chinês de Natural Language Processing with Transformers, o tutorial mais autorizado sobre Transformers
★ 580+0Variação de estrelas nos últimos 7 dias - #90
Modelos Turkish BERT/DistilBERT, ELECTRA, ConvBERT e T5
★ 579+0Variação de estrelas nos últimos 7 dias