bert
Dépôts open source suivis étiquetés bert, triés par étoiles.
- #61
Corpus de pré-entraînement à grande échelle de 100 Go pour le chinois.
★ 1 020+1Évolution des étoiles sur les 7 derniers jours - #62
Tutoriel complet sur les algorithmes, du NLP aux LLM. Lecture en ligne : https://datawhalechina.github.io/base-llm/
★ 1 017+13Évolution des étoiles sur les 7 derniers jours - #63★ 1 010+1Évolution des étoiles sur les 7 derniers jours
- #64
Construction d'un système de dialogue en chinois basé sur la dernière version de Rasa
★ 982+0Évolution des étoiles sur les 7 derniers jours - #65
TextGen : Implémentation de modèles de génération de texte, incluant LLaMA, BLOOM, GPT2, BART, T5, SongNet et plus encore.
★ 981-1Évolution des étoiles sur les 7 derniers jours - #66
Implémentation officielle des articles "GECToR – Grammatical Error Correction: Tag, Not Rewrite" (BEA-20) et "Text Simplification by Tagging" (BEA-21)
★ 972+0Évolution des étoiles sur les 7 derniers jours - #67
Modèles de type Transformer, de BERT à GPT-4, et environnements, de Hugging Face à OpenAI. Exemples de fine-tuning, d'entraînement et de prompt engineering. Une section bonus incluant ChatGPT, GPT-3.5-turbo, GPT-4 et DALL-E, avec des guides pour démarrer avec GPT-4, la conversion parole-texte, texte-parole, la génération d'images avec DALL-E, Google Cloud AI, HuggingGPT, et plus encore.
★ 966+0Évolution des étoiles sur les 7 derniers jours - #68
Une bibliothèque PyTorch de modèles Transformer sélectionnés et de leurs composants composables.
★ 890+0Évolution des étoiles sur les 7 derniers jours - #69
Modèles BERT pré-entraînés en portugais
★ 880+0Évolution des étoiles sur les 7 derniers jours - #70
Dépôt GitHub contenant des tutoriels pour le fine-tuning de modèles transformers sur diverses tâches de NLP.
★ 862+0Évolution des étoiles sur les 7 derniers jours - #71
PhoBERT : modèles de langage pré-entraînés pour le vietnamien (EMNLP-2020 Findings)
★ 806-1Évolution des étoiles sur les 7 derniers jours - #72
Classification de texte multi-étiquettes, classifieur, BERT, seq2seq, attention, multi-label-classification
★ 805+0Évolution des étoiles sur les 7 derniers jours - #73★ 801+1Évolution des étoiles sur les 7 derniers jours
- #74★ 795+0Évolution des étoiles sur les 7 derniers jours
- #75
PatrickStar permet de créer des modèles pré-entraînés pour le NLP plus grands, plus rapides et plus écologiques, tout en démocratisant l'IA pour tous.
★ 772+0Évolution des étoiles sur les 7 derniers jours - #76
Implémentation PyTorch de JointBERT : BERT pour la classification d'intention conjointe et le remplissage d'emplacements.
★ 747+0Évolution des étoiles sur les 7 derniers jours - #77
Le dépôt de référence pour la recherche et le développement de pointe en matière de réponse aux questions multilingues.
★ 739-1Évolution des étoiles sur les 7 derniers jours - #78LLM-PowerHouse-A-Curated-Guide-for-Large-Language-Models-with-Custom-Training-and-Inferencing↗@ghimiresunil
LLM-PowerHouse : Libérez le potentiel des LLM grâce à des tutoriels sélectionnés, des meilleures pratiques et du code prêt à l'emploi pour l'entraînement et l'inférence personnalisés.
★ 731+0Évolution des étoiles sur les 7 derniers jours - #79
Implémentation simple du modèle OpenAI CLIP en PyTorch.
★ 726+0Évolution des étoiles sur les 7 derniers jours - #80
Réexamen des modèles pré-entraînés pour le traitement automatique du langage naturel en chinois (MacBERT)
★ 721+2Évolution des étoiles sur les 7 derniers jours - #81
Awesome-LLM-Eval : une liste organisée d'outils, de jeux de données/benchmarks, de démos, de classements, d'articles, de documentation et de modèles, principalement dédiée à l'évaluation des LLM.
★ 656-2Évolution des étoiles sur les 7 derniers jours - #82
Le premier benchmark de traitement du langage naturel à grande échelle pour la langue Indonesian. Nous proposons plusieurs tâches en aval, des modèles IndoBERT pré-entraînés, et du code de démarrage! (AACL-IJCNLP 2020)
★ 655+1Évolution des étoiles sur les 7 derniers jours - #83
BERTweet : un modèle de langage pré-entraîné pour les tweets en anglais (EMNLP-2020)
★ 609+0Évolution des étoiles sur les 7 derniers jours - #84
Une implémentation du modèle BERT et de ses tâches en aval associées basée sur le framework PyTorch. @跟我学机器学习
★ 604+0Évolution des étoiles sur les 7 derniers jours - #85★ 604+0Évolution des étoiles sur les 7 derniers jours
- #86
Vérification de l'ancrage au niveau des segments pour les sorties d'IA ancrées dans le code, les RAG et les outils.
★ 603+1Évolution des étoiles sur les 7 derniers jours - #87★ 592-1Évolution des étoiles sur les 7 derniers jours
- #88
Dépôt NLP de Deep Learning résumant les tâches en aval, du prétraitement du texte aux modèles les plus récents comme Topic Models, BERT, GPT et LLM en utilisant TensorFlow.
★ 581+0Évolution des étoiles sur les 7 derniers jours - #89
Traduction chinoise de Natural Language Processing with Transformers, le tutoriel le plus faisant autorité sur Transformers
★ 580+0Évolution des étoiles sur les 7 derniers jours - #90
Modèles turcs BERT/DistilBERT, ELECTRA, ConvBERT et T5
★ 579+0Évolution des étoiles sur les 7 derniers jours