nlp
Repositorios de código abierto monitorizados etiquetados con nlp, ordenados por estrellas.
- #331
Utiliza los modelos de investigación más recientes de Stanza (StanfordNLP) directamente en spaCy
★ 746+0Variación de estrellas de los últimos 7 días - #332★ 745+0Variación de estrellas de los últimos 7 días
- #333
El corpus más completo de poesía moderna en chino, con más de 3000 poetas, 80 000 poemas y 15 millones de caracteres
★ 742+3Variación de estrellas de los últimos 7 días - #334
El repositorio principal para la investigación y el desarrollo de sistemas de respuesta a preguntas multilingües de última generación.
★ 738-1Variación de estrellas de los últimos 7 días - #335
Un analizador en Python para el subconjunto XML de acceso abierto de PubMed y el conjunto de datos XML de MEDLINE.
★ 738+0Variación de estrellas de los últimos 7 días - #336
Una lista de recursos, métodos y herramientas seleccionados dedicados al análisis de textos legales.
★ 735+1Variación de estrellas de los últimos 7 días - #337
Extiende LLMs existentes mucho más allá de su longitud de entrenamiento original con un uso de memoria constante y sin necesidad de reentrenamiento
★ 734-1Variación de estrellas de los últimos 7 días - #338
PromptKG Family: una galería de trabajos de investigación, kits de herramientas y listas de artículos relacionados con Prompt Learning y KG.
★ 734+1Variación de estrellas de los últimos 7 días - #339★ 729+0Variación de estrellas de los últimos 7 días
- #340★ 726+0Variación de estrellas de los últimos 7 días
- #341
Implementación sencilla del modelo CLIP de OpenAI en PyTorch.
★ 726+0Variación de estrellas de los últimos 7 días - #342
Revisión de modelos preentrenados para el procesamiento de lenguaje natural en chino (MacBERT).
★ 721+1Variación de estrellas de los últimos 7 días - #343
Sistema de método de entrada japonés para Linux y macOS, con motor de conversión neuronal Kana-Kanji.
★ 720+4Variación de estrellas de los últimos 7 días - #344
Motor de búsqueda fundamentado (con referencia a fuentes) basado en LLM / ChatGPT / OpenAI API. Admite búsqueda web, búsqueda de contenido de archivos, etc.
★ 711+0Variación de estrellas de los últimos 7 días - #345
VectorFlow es un pipeline de embedding vectorial de alto volumen que ingiere datos sin procesar, los transforma en vectores y los escribe en la base de datos vectorial de tu elección.
★ 703+0Variación de estrellas de los últimos 7 días - #346
Chatbot basado en comprensión del lenguaje natural y aprendizaje automático, con soporte para concurrencia multiusuario y diálogos personalizados de múltiples turnos.
★ 702+0Variación de estrellas de los últimos 7 días - #347
Una hoja de ruta de Full Stack ML (Machine Learning) que abarca el aprendizaje de las habilidades y tecnologías necesarias para dominar todos los aspectos del aprendizaje automático, incluyendo la recopilación y preprocesamiento de datos, desarrollo de modelos, despliegue y mantenimiento.
★ 701+0Variación de estrellas de los últimos 7 días - #348
● Un pipeline y modelo de spaCy para PNL en textos legales no estructurados.
★ 696+0Variación de estrellas de los últimos 7 días - #349★ 691+0Variación de estrellas de los últimos 7 días
- #350
Crea aplicaciones en Dart/Flutter potenciadas por LLM.
★ 686+0Variación de estrellas de los últimos 7 días - #351
Rankify: Un kit de herramientas integral en Python para recuperación, re-ranking y generación aumentada por recuperación (RAG). Nuestro kit integra 40 conjuntos de datos de referencia pre-recuperados y admite más de 7 técnicas de recuperación, más de 24 modelos de re-ranking de última generación y múltiples métodos RAG.
★ 682+1Variación de estrellas de los últimos 7 días - #352
Stanford Open Information Extraction simplificado
★ 682+0Variación de estrellas de los últimos 7 días - #353★ 675+1Variación de estrellas de los últimos 7 días
- #354
Ekphrasis es una herramienta de procesamiento de texto orientada a redes sociales como Twitter o Facebook. Realiza tokenización, normalización de palabras, segmentación (para dividir hashtags) y corrección ortográfica, utilizando estadísticas de palabras de dos grandes corpus (Wikipedia en inglés y 330 millones de tuits en inglés).
★ 673+0Variación de estrellas de los últimos 7 días - #355
Modelos de SpaCy con soporte para chino
★ 673+0Variación de estrellas de los últimos 7 días - #356
Una biblioteca de Python rápida, ligera y fácil de usar para dividir texto en fragmentos semánticamente significativos.
★ 665+1Variación de estrellas de los últimos 7 días - #357
Encuentra fechas dentro de texto usando Python y obtén objetos datetime
★ 665+0Variación de estrellas de los últimos 7 días - #358★ 664+1Variación de estrellas de los últimos 7 días
- #359
Un kit de herramientas multilingüe de Python para análisis de sentimientos y tareas de PNL social
★ 660+0Variación de estrellas de los últimos 7 días - #360
Formatea rápidamente tus notas con ChatGPT en Obsidian.
★ 658-2Variación de estrellas de los últimos 7 días