Saltar al contenido principal
buildradar
Iniciar sesión
Tema · nlp

nlp

Repositorios de código abierto monitorizados etiquetados con nlp, ordenados por estrellas.

440 repositorios
  • lingua-py@pemistahl

    La biblioteca de detección de lenguaje natural más precisa para Python, adecuada para textos cortos y textos en varios idiomas.

    1788+0Variación de estrellas de los últimos 7 días
  • paperai@neuml

    📄 🤖 IA para artículos médicos y científicos

    1778+0Variación de estrellas de los últimos 7 días
  • budoux@google
    1774+0Variación de estrellas de los últimos 7 días
  • extractous@yobix-ai

    Extracción de datos no estructurados rápida y eficiente. Escrito en Rust con bindings para múltiples lenguajes.

    1772+0Variación de estrellas de los últimos 7 días
  • Investigación y aplicación de tecnologías como el procesamiento del lenguaje natural, grafos de conocimiento, sistemas de diálogo y grandes modelos.

    1766+0Variación de estrellas de los últimos 7 días
  • Research@PaddlePaddle

    Trabajos de investigación novedosos en aprendizaje profundo con PaddlePaddle.

    1763+0Variación de estrellas de los últimos 7 días
  • ModernBERT@AnswerDotAI

    Modernización de BERT mediante cambios en la arquitectura y escalado.

    1716+0Variación de estrellas de los últimos 7 días
  • awesome-ai-ml-dl@neomatrix369

    Inteligencia Artificial, Machine Learning y Deep Learning asombrosos tal como los aprendemos. Notas de estudio y una lista curada de recursos asombrosos sobre estos temas.

    1713+0Variación de estrellas de los últimos 7 días
  • Paper-Notes@zhaoyang97

    Miles de interpretaciones de artículos de conferencias top en IA, LLM, NLP y CV; comprende las ideas principales en 5 minutos por artículo.

    1709+0Variación de estrellas de los últimos 7 días
  • graph4nlp@graph4ai

    Graph4nlp es la biblioteca para el uso sencillo de redes neuronales gráficas (GNN) para PNL. ¡Visita nuestro sitio web DLG4NLP (https://dlg4nlp.github.io/index.html) para obtener diversos recursos de aprendizaje!

    1690+0Variación de estrellas de los últimos 7 días
  • sense2vec@explosion

    Vectores de palabras con claves contextuales.

    1680+0Variación de estrellas de los últimos 7 días
  • Jackrong-llm-finetuning-guide@R6410418
    1672+0Variación de estrellas de los últimos 7 días
  • tika-python@chrismattmann

    Tika-Python es un enlace de Python para los servicios REST de Apache Tika™, que permite invocar a Tika de forma nativa en la comunidad de Python.

    1667+0Variación de estrellas de los últimos 7 días
  • Chinese-XLNet@ymcui

    Modelo preentrenado XLNet en chino (中文XLNet预训练模型)

    1646+0Variación de estrellas de los últimos 7 días
  • usaddress@datamade

    Biblioteca de Python para analizar cadenas de direcciones no estructuradas de Estados Unidos y dividirlas en sus componentes

    1637+0Variación de estrellas de los últimos 7 días
  • torchdistill@yoshitomo-matsubara

    Un framework sin código basado en PyTorch para estudios de aprendizaje profundo reproducibles. Parte del ecosistema PyTorch. Incluye hasta la fecha 26 métodos de destilación de conocimiento presentados en TPAMI, CVPR, ICLR, ECCV, NeurIPS, ICCV, AAAI, etc. Se proporcionan modelos entrenados, registros de entrenamiento y configuraciones para garantizar la reproducibilidad y el benchmarking.

    1630+0Variación de estrellas de los últimos 7 días
  • WikiChat@stanford-oval

    WikiChat es una implementación mejorada de RAG. Evita las alucinaciones de los modelos de lenguaje grandes mediante la recuperación de datos de un corpus.

    1615+0Variación de estrellas de los últimos 7 días
  • opennlp@apache

    Apache OpenNLP

    1602+0Variación de estrellas de los últimos 7 días
  • ExtractThinker@enoch3712

    ExtractThinker es una librería de inteligencia de documentos para LLMs que ofrece interacción al estilo ORM para flujos de trabajo de documentos flexibles y potentes.

    1596+0Variación de estrellas de los últimos 7 días
  • webarena@web-arena-x

    Repositorio de código para "WebArena: A Realistic Web Environment for Building Autonomous Agents"

    1592+0Variación de estrellas de los últimos 7 días
  • similarity@shibing624

    similarity: Kit de herramientas de cálculo de similitud de textos para Java, útil para tareas como cálculo de similitud y análisis de sentimientos, listo para usar.

    1584+0Variación de estrellas de los últimos 7 días
  • NL2SQL_Handbook@HKUSTDial

    Manual actualizado continuamente para que los lectores sigan fácilmente las últimas técnicas de Text-to-SQL en la literatura y brinden orientación práctica a investigadores y profesionales

    1580+0Variación de estrellas de los últimos 7 días
  • DataProfiler@capitalone

    ¿Qué hay en tus datos? Extrae esquemas, estadísticas y entidades de conjuntos de datos.

    1579+0Variación de estrellas de los últimos 7 días
  • TAADpapers@thunlp

    Artículos de lectura obligatoria sobre ataques y defensas adversarias textuales.

    1575+0Variación de estrellas de los últimos 7 días
  • Una colección de corpus para el reconocimiento de entidades nombradas (NER) y tareas de reconocimiento de entidades. Estos conjuntos de datos anotados cubren una variedad de idiomas, dominios y tipos de entidades.

    1574+0Variación de estrellas de los últimos 7 días
  • rpaframework@robocorp

    Colección de bibliotecas y herramientas de código abierto para la Automatización Robótica de Procesos (RPA), diseñadas para usarse con Robot Framework y Python.

    1555+0Variación de estrellas de los últimos 7 días
  • DeepMoji@bfelbo

    Modelo de aprendizaje profundo de última generación para analizar sentimientos, emociones, sarcasmo, etc.

    1553+0Variación de estrellas de los últimos 7 días
  • Un entorno de ejecución rápido y fácil de usar para la inferencia de transformers (Bert, Albert, GPT2, Decoders, etc.) en CPU y GPU.

    1550+0Variación de estrellas de los últimos 7 días
  • dolma@allenai

    Datos y herramientas para generar e inspeccionar datos de preentrenamiento de OLMo.

    1538+0Variación de estrellas de los últimos 7 días
  • nlp-lang@NLPchina

    Este proyecto es un paquete básico que encapsula las herramientas más utilizadas en proyectos de NLP.

    1507+0Variación de estrellas de los últimos 7 días
← Volver a temas