nlp
Repositorios de código abierto monitorizados etiquetados con nlp, ordenados por estrellas.
- #151
¡Notas detalladas del nuevo libro del autor de HanLP, "Introducción al procesamiento del lenguaje natural"! Una obra excelente y honesta, sin fórmulas aburridas, que explica modelos de algoritmos de forma clara y accesible. Partiendo de conceptos básicos, introduce paso a paso los principios algorítmicos y la implementación en ingeniería de temas populares como la segmentación de palabras en chino, el etiquetado gramatical, el reconocimiento de entidades nombradas, la extracción de información, la agrupación y clasificación de textos, y el análisis sintáctico.
★ 2270+0Variación de estrellas de los últimos 7 días - #152
Reconocimiento de entidades nombradas en chino con IDCNN/biLSTM+CRF y extracción de relaciones con biGRU+2ATT (Reconocimiento de entidades y extracción de relaciones en chino)
★ 2264+0Variación de estrellas de los últimos 7 días - #153★ 2259+0Variación de estrellas de los últimos 7 días
- #154★ 2257+0Variación de estrellas de los últimos 7 días
- #155
[Lista de artículos] Artículos que integran grafos de conocimiento (KG) y modelos de lenguaje grandes (LLM)
★ 2228+0Variación de estrellas de los últimos 7 días - #156
Implementación en Python de algoritmos TextRank ("textgraphs") para la extracción de frases
★ 2219+0Variación de estrellas de los últimos 7 días - #157★ 2196+0Variación de estrellas de los últimos 7 días
- #158★ 2189+0Variación de estrellas de los últimos 7 días
- #159★ 2186+0Variación de estrellas de los últimos 7 días
- #160
Explica, analiza y visualiza modelos de lenguaje de PLN. Ecco crea visualizaciones interactivas directamente en notebooks de Jupyter que explican el comportamiento de los modelos de lenguaje basados en Transformer (como GPT2, BERT, RoBERTA, T5 y T0).
★ 2103+0Variación de estrellas de los últimos 7 días - #161
Un kit de herramientas local (on-premises), sin necesidad de OCR, para extracción de datos no estructurados, conversión a Markdown y pruebas de rendimiento. (https://idp-leaderboard.org/)
★ 2086+0Variación de estrellas de los últimos 7 días - #162
Una lista de lectura sobre seguridad, protección y privacidad de modelos grandes (incluyendo Awesome LLM Security, Safety, etc.).
★ 2070+0Variación de estrellas de los últimos 7 días - #163
Colección de codificadores-decodificadores de Alibaba del laboratorio MinD (Machine IntelligeNce of Damo)
★ 2041+0Variación de estrellas de los últimos 7 días - #164
Una referencia exhaustiva para todos los temas relacionados con el Procesamiento del Lenguaje Natural
★ 2038+0Variación de estrellas de los últimos 7 días - #165
Un evaluador automático para modelos de lenguaje que siguen instrucciones. Validado por humanos, de alta calidad, económico y rápido.
★ 2012+0Variación de estrellas de los últimos 7 días - #166
ContextGem: Extracción sencilla de LLM a partir de documentos
★ 1996+0Variación de estrellas de los últimos 7 días - #167
Una colección impulsada por la comunidad de frameworks, proyectos y recursos de RAG (Generación Aumentada por Recuperación). Contribuye y explora el ecosistema RAG en constante evolución.
★ 1991+0Variación de estrellas de los últimos 7 días - #168★ 1987+0Variación de estrellas de los últimos 7 días
- #169
Proyecto de modelos de lenguaje Chinese Llama-3 desarrollado a partir de Meta Llama 3.
★ 1980+0Variación de estrellas de los últimos 7 días - #170
🌸 Aprende gramática japonesa con TypeScript
★ 1945+0Variación de estrellas de los últimos 7 días - #171
💫 Modelos para la biblioteca de procesamiento de lenguaje natural (NLP) spaCy
★ 1901+0Variación de estrellas de los últimos 7 días - #172
Tutorial de inicio rápido para la biblioteca Transformers
★ 1892+0Variación de estrellas de los últimos 7 días - #173
Una lista curada de materiales de aprendizaje, bases de datos, herramientas y otros recursos relacionados con Knowledge Graph
★ 1885+0Variación de estrellas de los últimos 7 días - #174
[ICML 2024] LLMCompiler: Un compilador LLM para llamadas a funciones en paralelo
★ 1879+0Variación de estrellas de los últimos 7 días - #175
Paquete de aumento de datos en chino con un solo clic; aumento de datos para NLP, BERT y EDA: pip install nlpcda
★ 1879+0Variación de estrellas de los últimos 7 días - #176
Biblioteca de aprendizaje automático y procesamiento de lenguaje natural independiente escrita en Go.
★ 1850+0Variación de estrellas de los últimos 7 días - #177★ 1828+0Variación de estrellas de los últimos 7 días
- #178
Clasificación de textos largos, frases cortas, multietiqueta y similitud entre frases en chino (Keras NLP), clases base para capas de embedding (caracteres, palabras, frases) y capas de red (grafo), FastText, TextCNN, CharCNN, TextRNN, RCNN, DCNN, DPCNN, VDCNN, CRNN, Bert, Xlnet, Albert, Attention, DeepMoji, HAN, CapsuleNet, Transformer-encode, Seq2seq, SWEM, LEAM, TextGCN.
★ 1808+0Variación de estrellas de los últimos 7 días - #179
Underthesea - Asistente de IA.
★ 1803+0Variación de estrellas de los últimos 7 días - #180
Microsoft.Recognizers.Text proporciona reconocimiento y resolución de números, unidades, fecha/hora, etc. en múltiples idiomas (ZH, EN, FR, ES, PT, DE, IT, TR, HI, NL. Soporte parcial para JA, KO, AR, SV). Paquetes disponibles en: https://www.nuget.org/profiles/Recognizers.Text, https://www.npmjs.com/~recognizers.text
★ 1794+0Variación de estrellas de los últimos 7 días