language-model
Repositorios de código abierto monitorizados etiquetados con language-model, ordenados por estrellas.
- #61
Biblioteca de aprendizaje automático y procesamiento de lenguaje natural independiente escrita en Go.
★ 1850+0Variación de estrellas de los últimos 7 días - #62
Vocabulario extendido simplificado/tradicional, codificación de tonos, la cadena de herramientas de anotación de tonos más completa, cadena de herramientas Wanxiang Gengxin y modelo gramatical de Rime: LMDG - Language, Model, Dictionary, Grammar. ¡Así es, este es el "Imperio Romano" de Wanxiang Pinyin!
★ 1849+8Variación de estrellas de los últimos 7 días - #63
Implementación oficial de RAPTOR: Recursive Abstractive Processing for Tree-Organized Retrieval
★ 1752+1Variación de estrellas de los últimos 7 días - #64
Pequeño modelo de diálogo en chino de 0.2B (ChatLM-Chinese-0.2B), con código fuente abierto para todos los procesos, incluidas fuentes de conjuntos de datos, limpieza de datos, entrenamiento de tokenizadores, preentrenamiento de modelos, ajuste de instrucciones SFT y optimización RLHF. Es compatible con el ajuste fino SFT para tareas posteriores y proporciona ejemplos de ajuste para la extracción de información de tripletes.
★ 1731+2Variación de estrellas de los últimos 7 días - #65
Crea diagramas de arquitectura a partir de código automáticamente utilizando modelos de lenguaje grandes (LLMs).
★ 1695-1Variación de estrellas de los últimos 7 días - #66
Macaw-LLM: modelado de lenguaje multimodal con integración de imagen, video, audio y texto.
★ 1591+0Variación de estrellas de los últimos 7 días - #67★ 1579+0Variación de estrellas de los últimos 7 días
- #68
[EMNLP 2025 Oral] MemoryOS está diseñado para proporcionar un sistema operativo de memoria para agentes de IA personalizados.
★ 1567+1Variación de estrellas de los últimos 7 días - #69
Modelo pequeño, gran lógica: la optimización impulsada por la diversidad provoca la capacidad de razonamiento de modelos grandes en VibeThinker-1.5B
★ 1567+5Variación de estrellas de los últimos 7 días - #70
Un plan de estudios para aprender sobre modelos fundamentales, desde cero hasta la vanguardia.
★ 1464+1Variación de estrellas de los últimos 7 días - #71
Modelo ELECTRA preentrenado para chino
★ 1434+0Variación de estrellas de los últimos 7 días - #72
Resumen de LLM en japonés - Descripción general de los LLM japoneses.
★ 1428+1Variación de estrellas de los últimos 7 días - #73★ 1420+3Variación de estrellas de los últimos 7 días
- #74
Utiliza transformers preentrenados como BERT, XLNet y GPT-2 en spaCy
★ 1410+0Variación de estrellas de los últimos 7 días - #75
Calcula tokens/s y los requisitos de memoria GPU para cualquier LLM. Soporta cuantización llama.cpp/ggml/bnb/QLoRA.
★ 1406+0Variación de estrellas de los últimos 7 días - #76
Un framework de código abierto para modelos de lenguaje extenso con base de conocimientos.
★ 1385-1Variación de estrellas de los últimos 7 días - #77
Optimización del entrenamiento de un modelo de lenguaje (tipo BERT) con recursos computacionales limitados.
★ 1366+0Variación de estrellas de los últimos 7 días - #78★ 1309+0Variación de estrellas de los últimos 7 días
- #79
Transformers4Rec es una biblioteca flexible y eficiente para sistemas de recomendación secuenciales y basados en sesiones, compatible con PyTorch.
★ 1281+0Variación de estrellas de los últimos 7 días - #80
Lista de agentes de lenguaje basada en el artículo "Cognitive Architectures for Language Agents"
★ 1256+3Variación de estrellas de los últimos 7 días - #81★ 1212-1Variación de estrellas de los últimos 7 días
- #82
💁 Impresionante colección de modelos Transformers para procesamiento de lenguaje natural que contiene artículos, videos, blogs, repositorio oficial junto con cuadernos de Colab. 🛫☑️
★ 1179+0Variación de estrellas de los últimos 7 días - #83
Una colección de conjuntos de datos de código abierto para entrenar LLM que siguen instrucciones (ChatGPT, LLaMA, Alpaca).
★ 1153-1Variación de estrellas de los últimos 7 días - #84
Lista curada de recursos de PNL centrada en redes Transformer, mecanismos de atención, GPT, BERT, ChatGPT, LLMs y aprendizaje por transferencia
★ 1152+2Variación de estrellas de los últimos 7 días - #85
[NeurIPS 2023] LLM-Pruner: Sobre la poda estructural de modelos de lenguaje de gran tamaño. Soporta Llama-3/3.1, Llama-2, LLaMA, BLOOM, Vicuna, Baichuan, TinyLlama, entre otros.
★ 1139+2Variación de estrellas de los últimos 7 días - #86
ToRA es una serie de agentes LLM de razonamiento integrados con herramientas, diseñados para resolver problemas matemáticos complejos mediante la interacción con herramientas [ICLR'24].
★ 1124+0Variación de estrellas de los últimos 7 días - #87
Z80-μLM es un modelo de lenguaje cuantizado a 2 bits lo suficientemente pequeño como para ejecutarse en un procesador Z80 de 8 bits. Entrena modelos conversacionales en Python, expórtalos como binarios .COM de CP/M y chatea con tu computadora antigua.
★ 1119+2Variación de estrellas de los últimos 7 días - #88
Implementaciones del SDK de cliente para LangSmith
★ 1048+8Variación de estrellas de los últimos 7 días - #89★ 1040+1Variación de estrellas de los últimos 7 días
- #90
Plugin de traducción de subtítulos en tiempo real que integra la API de OpenAI (u otros modelos compatibles) en PotPlayer para traducir subtítulos mientras ves videos.
★ 1030+1Variación de estrellas de los últimos 7 días