nlp
Repositorios de código abierto monitorizados etiquetados con nlp, ordenados por estrellas.
- #211
Framework rápido y personalizable para la creación automática de modelos de ML (AutoML)
★ 1472+0Variación de estrellas de los últimos 7 días - #212
La opción de código abierto para científicos de datos para escalar, evaluar y mantener datos de lenguaje natural. Trata los datos de entrenamiento como un artefacto de software.
★ 1469+0Variación de estrellas de los últimos 7 días - #213
🪐 Flujos de trabajo de NLP de extremo a extremo, desde el prototipo hasta la producción.
★ 1436+0Variación de estrellas de los últimos 7 días - #214
Modelo ELECTRA preentrenado para chino
★ 1434+0Variación de estrellas de los últimos 7 días - #215
Obsei es una herramienta de automatización de bajo código impulsada por IA. Puede utilizarse en diversos flujos de negocio como escucha social, alertas basadas en IA, análisis de imagen de marca, estudios comparativos y más.
★ 1425+0Variación de estrellas de los últimos 7 días - #216
Una biblioteca de búsqueda de texto completo persistente y resistente a fallos de red para el navegador y Node.js
★ 1422+0Variación de estrellas de los últimos 7 días - #217★ 1421+0Variación de estrellas de los últimos 7 días
- #218★ 1420+0Variación de estrellas de los últimos 7 días
- #219★ 1418+0Variación de estrellas de los últimos 7 días
- #220
Un corpus de diálogo multilingüe
★ 1417+0Variación de estrellas de los últimos 7 días - #221
Utiliza transformers preentrenados como BERT, XLNet y GPT-2 en spaCy
★ 1410+0Variación de estrellas de los últimos 7 días - #222★ 1394+0Variación de estrellas de los últimos 7 días
- #223★ 1391+0Variación de estrellas de los últimos 7 días
- #224
Código de evaluación para varias métricas automatizadas no supervisadas para la generación de lenguaje natural.
★ 1391+0Variación de estrellas de los últimos 7 días - #225
Segmentación de texto en chino "Jieba": el mejor componente de segmentación y división de palabras en chino para PHP.
★ 1378+0Variación de estrellas de los últimos 7 días - #226
Portafolio de proyectos de ciencia de datos realizados con fines académicos, de autoaprendizaje y personales
★ 1366+0Variación de estrellas de los últimos 7 días - #227
La biblioteca de detección de lenguaje natural más precisa para Go, adecuada para textos cortos y textos en varios idiomas
★ 1362+0Variación de estrellas de los últimos 7 días - #228
Herramientas de PNL para turco.
★ 1355+0Variación de estrellas de los últimos 7 días - #229
Resuelve tareas básicas de PNL en ruso; API para proyectos de Natasha de bajo nivel.
★ 1348+0Variación de estrellas de los últimos 7 días - #230
Artículos relevantes en el campo del procesamiento de lenguaje natural (con notas de lectura), modelos de reproducción y procesamiento de datos (código disponible en versiones TensorFlow y PyTorch)
★ 1333+0Variación de estrellas de los últimos 7 días - #231
Una implementación elegante de transformers en PyTorch
★ 1327+0Variación de estrellas de los últimos 7 días - #232
Modelos entrenados y código para predecir comentarios tóxicos en los 3 desafíos Jigsaw Toxic Comment. Construido usando ⚡ Pytorch Lightning y 🤗 Transformers. Para acceder a nuestra API, por favor envíe un correo a contact@unitary.ai.
★ 1296+0Variación de estrellas de los últimos 7 días - #233
Transformers4Rec es una biblioteca flexible y eficiente para sistemas de recomendación secuenciales y basados en sesiones, compatible con PyTorch.
★ 1281+0Variación de estrellas de los últimos 7 días - #234
🎓 Curso sistemático de construcción de modelos de lenguaje extensos | 🛠️ Cubre ingeniería de datos de preentrenamiento, Tokenizer, Transformer, MoE, programación de GPU (CUDA/Triton), entrenamiento distribuido, leyes de escala, optimización de inferencia y alineación (SFT/RLHF/GRPO) | 🚀 6 tareas progresivas + impulsadas por código para establecer un sistema de conocimiento full-stack de LLM
★ 1276+0Variación de estrellas de los últimos 7 días - #235
Un paquete de Python para ejecutar modelos de temas contextualizados. Los CTM combinan incrustaciones contextualizadas (por ejemplo, BERT) con modelos de temas para obtener temas coherentes. Publicado en EACL y ACL 2021 (Bianchi et al.).
★ 1269+0Variación de estrellas de los últimos 7 días - #236
ktrain es una biblioteca de Python que hace que el aprendizaje profundo y la IA sean más accesibles y fáciles de aplicar
★ 1268+0Variación de estrellas de los últimos 7 días - #237
Implementación en Keras de "One pixel attack for fooling deep neural networks" utilizando evolución diferencial en Cifar10 e ImageNet.
★ 1237+0Variación de estrellas de los últimos 7 días - #238
Embeddings de subpalabras preentrenados en 275 idiomas, basados en Byte-Pair Encoding (BPE).
★ 1224+0Variación de estrellas de los últimos 7 días - #239
Taranis AI es una herramienta avanzada de inteligencia de fuentes abiertas (OSINT) que aprovecha la inteligencia artificial para revolucionar la recopilación de información y el análisis situacional.
★ 1206+0Variación de estrellas de los últimos 7 días - #240
Videos, notas y experimentos para comprender el aprendizaje profundo
★ 1198+0Variación de estrellas de los últimos 7 días