nlp
Repositorios de código abierto monitorizados etiquetados con nlp, ordenados por estrellas.
- #391
NLP de cero a experto en solo 10 Kernels.
★ 598+0Variación de estrellas de los últimos 7 días - #392
Reimplementación en PyTorch de "Generating Sentences from a Continuous Space" de Bowman et al 2015 https://arxiv.org/abs/1511.06349
★ 593+0Variación de estrellas de los últimos 7 días - #393
Un kit de herramientas de Python para analizar subtítulos (en lenguaje natural) y convertirlos en grafos de escena (como representaciones simbólicas).
★ 593+0Variación de estrellas de los últimos 7 días - #394★ 592+0Variación de estrellas de los últimos 7 días
- #395
[NeurIPS 2022] WebShop: Hacia una interacción web real y escalable con agentes de lenguaje fundamentados
★ 590+1Variación de estrellas de los últimos 7 días - #396
Una colección de conjuntos de datos que emparejan preguntas con consultas SQL
★ 588+0Variación de estrellas de los últimos 7 días - #397
EMNLP 2026 Main Conference Paper: MASCOT: Towards Multi-Agent Socio-Collaborative Companion Systems (https://arxiv.org/abs/2601.14230)
★ 582+20Variación de estrellas de los últimos 7 días - #398
Repositorio de Deep Learning NLP que utiliza TensorFlow para cubrir desde el preprocesamiento de texto hasta tareas posteriores con modelos modernos como Topic Models, BERT, GPT y LLM.
★ 581+0Variación de estrellas de los últimos 7 días - #399
Una lista de recursos de PNL centrados en la tarea de extracción de eventos
★ 580+1Variación de estrellas de los últimos 7 días - #400
Open Chinese Convert es un proyecto de código abierto para la conversión entre chino tradicional y simplificado (soporta conversiones entre chino de Taiwán, Hong Kong y japonés).
★ 578+2Variación de estrellas de los últimos 7 días - #401
Un conjunto de herramientas de procesamiento de lenguaje natural para árabe desarrollado por el CAMeL Lab de la Universidad de Nueva York en Abu Dabi.
★ 578+1Variación de estrellas de los últimos 7 días - #402
Lista de artículos sobre traducción simultánea/streaming, incluyendo traducción automática de texto a texto y de voz a texto.
★ 578+0Variación de estrellas de los últimos 7 días - #403
Una colección de herramientas, conjuntos de datos y recursos sobre computación en bengalí.
★ 576+1Variación de estrellas de los últimos 7 días - #404
Organiza tus experimentos en pasos discretos que se pueden almacenar en caché y reutilizar durante todo el ciclo de vida de tu proyecto de investigación.
★ 572+0Variación de estrellas de los últimos 7 días - #405
El tutorial práctico de NLTK para PNL en Python.
★ 571+0Variación de estrellas de los últimos 7 días - #406
Implementación en Julia de modelos Transformer
★ 570+0Variación de estrellas de los últimos 7 días - #407
Una colección abierta de metodologías para ayudar en el entrenamiento exitoso de modelos de lenguaje grandes.
★ 569+2Variación de estrellas de los últimos 7 días - #408
Implementación de RLHF (aprendizaje por refuerzo con retroalimentación humana) de ChatGPT en cualquier modelo generativo de los transformers de huggingface (blommz-176B/bloom/gpt/bart/T5/MetaICL).
★ 564+0Variación de estrellas de los últimos 7 días - #409
Una lista curada de proyectos destacados y recursos de desarrollo/diseño para apoyar las necesidades computacionales del idioma árabe.
★ 562+0Variación de estrellas de los últimos 7 días - #410★ 559+0Variación de estrellas de los últimos 7 días
- #411
Solución y código del tercer lugar en la final del primer desafío de NL2SQL en chino de Zhuiyi Technology
★ 557-1Variación de estrellas de los últimos 7 días - #412
[Hallazgos de EMNLP'25] Un sistema Graph RAG fácil de usar que utiliza conocimiento jerárquico.
★ 556+1Variación de estrellas de los últimos 7 días - #413
Repositorio con todo lo necesario para el análisis de sentimientos y áreas relacionadas.
★ 551-1Variación de estrellas de los últimos 7 días - #414
Happy Transformer facilita el ajuste fino y la inferencia con modelos NLP Transformer.
★ 546+0Variación de estrellas de los últimos 7 días - #415
El único kit de herramientas de código abierto capaz de descargar informes financieros de SEC EDGAR y extraer datos textuales de secciones específicas en archivos JSON estructurados y limpios. Presentado en WWW 2025 en Sídney, Australia.
★ 545+1Variación de estrellas de los últimos 7 días - #416
Recopilación de artículos destacados sobre Language-Model-as-a-Service (LMaaS)
★ 544-1Variación de estrellas de los últimos 7 días - #417
Clips AI es una biblioteca de Python de código abierto que convierte automáticamente videos largos en clips cortos.
★ 539+1Variación de estrellas de los últimos 7 días - #418
Un wrapper de Cython para MeCab que permite una tokenización y análisis morfológico del japonés rápido y al estilo Python.
★ 537+1Variación de estrellas de los últimos 7 días - #419
FashionCLIP es un modelo tipo CLIP ajustado para el dominio de la moda.
★ 537+2Variación de estrellas de los últimos 7 días - #420
Lista de sinónimos, lista de antónimos, lista de palabras negativas.
★ 537+0Variación de estrellas de los últimos 7 días