nlp
Repositorios de código abierto monitorizados etiquetados con nlp, ordenados por estrellas.
- #181
La biblioteca de detección de lenguaje natural más precisa para Python, adecuada para textos cortos y textos en varios idiomas.
★ 1788+0Variación de estrellas de los últimos 7 días - #182★ 1778+0Variación de estrellas de los últimos 7 días
- #183★ 1774+0Variación de estrellas de los últimos 7 días
- #184
Extracción de datos no estructurados rápida y eficiente. Escrito en Rust con bindings para múltiples lenguajes.
★ 1772+0Variación de estrellas de los últimos 7 días - #185
Investigación y aplicación de tecnologías como el procesamiento del lenguaje natural, grafos de conocimiento, sistemas de diálogo y grandes modelos.
★ 1766+0Variación de estrellas de los últimos 7 días - #186★ 1763+0Variación de estrellas de los últimos 7 días
- #187
Modernización de BERT mediante cambios en la arquitectura y escalado.
★ 1716+0Variación de estrellas de los últimos 7 días - #188
Inteligencia Artificial, Machine Learning y Deep Learning asombrosos tal como los aprendemos. Notas de estudio y una lista curada de recursos asombrosos sobre estos temas.
★ 1713+0Variación de estrellas de los últimos 7 días - #189
Miles de interpretaciones de artículos de conferencias top en IA, LLM, NLP y CV; comprende las ideas principales en 5 minutos por artículo.
★ 1709+0Variación de estrellas de los últimos 7 días - #190
Graph4nlp es la biblioteca para el uso sencillo de redes neuronales gráficas (GNN) para PNL. ¡Visita nuestro sitio web DLG4NLP (https://dlg4nlp.github.io/index.html) para obtener diversos recursos de aprendizaje!
★ 1690+0Variación de estrellas de los últimos 7 días - #191★ 1680+0Variación de estrellas de los últimos 7 días
- #192★ 1672+0Variación de estrellas de los últimos 7 días
- #193
Tika-Python es un enlace de Python para los servicios REST de Apache Tika™, que permite invocar a Tika de forma nativa en la comunidad de Python.
★ 1667+0Variación de estrellas de los últimos 7 días - #194
Modelo preentrenado XLNet en chino (中文XLNet预训练模型)
★ 1646+0Variación de estrellas de los últimos 7 días - #195
Biblioteca de Python para analizar cadenas de direcciones no estructuradas de Estados Unidos y dividirlas en sus componentes
★ 1637+0Variación de estrellas de los últimos 7 días - #196
Un framework sin código basado en PyTorch para estudios de aprendizaje profundo reproducibles. Parte del ecosistema PyTorch. Incluye hasta la fecha 26 métodos de destilación de conocimiento presentados en TPAMI, CVPR, ICLR, ECCV, NeurIPS, ICCV, AAAI, etc. Se proporcionan modelos entrenados, registros de entrenamiento y configuraciones para garantizar la reproducibilidad y el benchmarking.
★ 1630+0Variación de estrellas de los últimos 7 días - #197
WikiChat es una implementación mejorada de RAG. Evita las alucinaciones de los modelos de lenguaje grandes mediante la recuperación de datos de un corpus.
★ 1615+0Variación de estrellas de los últimos 7 días - #198★ 1602+0Variación de estrellas de los últimos 7 días
- #199
ExtractThinker es una librería de inteligencia de documentos para LLMs que ofrece interacción al estilo ORM para flujos de trabajo de documentos flexibles y potentes.
★ 1596+0Variación de estrellas de los últimos 7 días - #200
Repositorio de código para "WebArena: A Realistic Web Environment for Building Autonomous Agents"
★ 1592+0Variación de estrellas de los últimos 7 días - #201
similarity: Kit de herramientas de cálculo de similitud de textos para Java, útil para tareas como cálculo de similitud y análisis de sentimientos, listo para usar.
★ 1584+0Variación de estrellas de los últimos 7 días - #202
Manual actualizado continuamente para que los lectores sigan fácilmente las últimas técnicas de Text-to-SQL en la literatura y brinden orientación práctica a investigadores y profesionales
★ 1580+0Variación de estrellas de los últimos 7 días - #203
¿Qué hay en tus datos? Extrae esquemas, estadísticas y entidades de conjuntos de datos.
★ 1579+0Variación de estrellas de los últimos 7 días - #204
Artículos de lectura obligatoria sobre ataques y defensas adversarias textuales.
★ 1575+0Variación de estrellas de los últimos 7 días - #205
Una colección de corpus para el reconocimiento de entidades nombradas (NER) y tareas de reconocimiento de entidades. Estos conjuntos de datos anotados cubren una variedad de idiomas, dominios y tipos de entidades.
★ 1574+0Variación de estrellas de los últimos 7 días - #206
Colección de bibliotecas y herramientas de código abierto para la Automatización Robótica de Procesos (RPA), diseñadas para usarse con Robot Framework y Python.
★ 1555+0Variación de estrellas de los últimos 7 días - #207
Modelo de aprendizaje profundo de última generación para analizar sentimientos, emociones, sarcasmo, etc.
★ 1553+0Variación de estrellas de los últimos 7 días - #208
Un entorno de ejecución rápido y fácil de usar para la inferencia de transformers (Bert, Albert, GPT2, Decoders, etc.) en CPU y GPU.
★ 1550+0Variación de estrellas de los últimos 7 días - #209★ 1538+0Variación de estrellas de los últimos 7 días
- #210
Este proyecto es un paquete básico que encapsula las herramientas más utilizadas en proyectos de NLP.
★ 1507+0Variación de estrellas de los últimos 7 días