bert
Repositorios de código abierto monitorizados etiquetados con bert, ordenados por estrellas.
- #61
Corpus de preentrenamiento a gran escala para chino de 100G
★ 1020+2Variación de estrellas de los últimos 7 días - #62
Tutorial completo de algoritmos desde NLP hasta LLM, lectura en línea: https://datawhalechina.github.io/base-llm/
★ 1017+15Variación de estrellas de los últimos 7 días - #63★ 1010+2Variación de estrellas de los últimos 7 días
- #64
Construcción de un sistema de diálogo en chino basado en la versión más reciente de rasa
★ 982+0Variación de estrellas de los últimos 7 días - #65
TextGen: Implementación de modelos de generación de texto, que incluye LLaMA, BLOOM, GPT2, BART, T5, SongNet y más.
★ 981-1Variación de estrellas de los últimos 7 días - #66
Implementación oficial de los artículos "GECToR – Grammatical Error Correction: Tag, Not Rewrite" (BEA-20) y "Text Simplification by Tagging" (BEA-21).
★ 972+0Variación de estrellas de los últimos 7 días - #67
Modelos Transformer desde BERT hasta GPT-4, entornos desde Hugging Face hasta OpenAI. Ejemplos de ajuste fino, entrenamiento e ingeniería de prompts. Incluye secciones sobre ChatGPT, GPT-3.5-turbo, GPT-4, DALL-E, conversión de voz a texto, texto a voz, generación de imágenes con DALL-E, Google Cloud AI, HuggingGPT y más
★ 966+0Variación de estrellas de los últimos 7 días - #68
Una biblioteca de PyTorch con modelos Transformer seleccionados y sus componentes componibles
★ 890+0Variación de estrellas de los últimos 7 días - #69
Modelos BERT preentrenados en portugués.
★ 880+0Variación de estrellas de los últimos 7 días - #70
Repositorio de GitHub con tutoriales para ajustar modelos transformers en diversas tareas de NLP.
★ 862+0Variación de estrellas de los últimos 7 días - #71
PhoBERT: Modelos de lenguaje preentrenados para vietnamita (EMNLP-2020 Findings).
★ 806-1Variación de estrellas de los últimos 7 días - #72
Clasificación de texto multietiqueta, clasificación multietiqueta, clasificación de texto, multi-label, classifier, text classification, BERT, seq2seq, attention, multi-label-classification
★ 805+0Variación de estrellas de los últimos 7 días - #73★ 801+0Variación de estrellas de los últimos 7 días
- #74★ 795-1Variación de estrellas de los últimos 7 días
- #75
PatrickStar permite modelos preentrenados para PNL más grandes, rápidos y eficientes, democratizando la IA para todos.
★ 772+0Variación de estrellas de los últimos 7 días - #76
Implementación en Pytorch de JointBERT: "BERT para clasificación conjunta de intenciones y llenado de ranuras"
★ 747-1Variación de estrellas de los últimos 7 días - #77
El repositorio principal para la investigación y el desarrollo de sistemas de respuesta a preguntas multilingües de última generación.
★ 739-1Variación de estrellas de los últimos 7 días - #78LLM-PowerHouse-A-Curated-Guide-for-Large-Language-Models-with-Custom-Training-and-Inferencing↗@ghimiresunil
LLM-PowerHouse: Libere el potencial de los LLM a través de tutoriales seleccionados, mejores prácticas y código listo para usar para entrenamiento e inferencia personalizados.
★ 731+0Variación de estrellas de los últimos 7 días - #79
Implementación sencilla del modelo CLIP de OpenAI en PyTorch.
★ 726+0Variación de estrellas de los últimos 7 días - #80
Revisión de modelos preentrenados para el procesamiento de lenguaje natural en chino (MacBERT).
★ 721+2Variación de estrellas de los últimos 7 días - #81
Awesome-LLM-Eval: una lista curada de herramientas, conjuntos de datos/benchmarks, demos, tablas de clasificación, artículos, documentación y modelos, enfocada principalmente en la evaluación de LLMs.
★ 656-2Variación de estrellas de los últimos 7 días - #82
El primer benchmark de procesamiento de lenguaje natural a gran escala para el idioma indonesio. Proporcionamos múltiples tareas posteriores, modelos IndoBERT preentrenados y código de inicio (AACL-IJCNLP 2020)
★ 655+1Variación de estrellas de los últimos 7 días - #83
BERTweet: Un modelo de lenguaje preentrenado para tweets en inglés (EMNLP-2020)
★ 609+0Variación de estrellas de los últimos 7 días - #84
Verificación de fundamentación a nivel de fragmento para RAG, código y salidas de IA fundamentadas en herramientas.
★ 605+2Variación de estrellas de los últimos 7 días - #85★ 604+0Variación de estrellas de los últimos 7 días
- #86
Implementación del modelo BERT y sus tareas relacionadas basada en el framework PyTorch. @跟我学机器学习
★ 604+0Variación de estrellas de los últimos 7 días - #87★ 592-1Variación de estrellas de los últimos 7 días
- #88
Repositorio de Deep Learning NLP que utiliza TensorFlow para cubrir desde el preprocesamiento de texto hasta tareas posteriores con modelos modernos como Topic Models, BERT, GPT y LLM.
★ 581+0Variación de estrellas de los últimos 7 días - #89
Traducción al chino de Natural Language Processing with Transformers, el tutorial más autorizado sobre Transformers
★ 580+0Variación de estrellas de los últimos 7 días - #90
Modelos BERT/DistilBERT, ELECTRA, ConvBERT y T5 para turco
★ 579+0Variación de estrellas de los últimos 7 días