document-processing
Repositorios de código abierto monitorizados etiquetados con document-processing, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a document-processing en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con document-processing.
- #1
Convierte cualquier PDF de un libro técnico en una habilidad de Claude Code — lista para estudiar, consultar y usar mientras trabajas.
★ 27.016+3296Variación de estrellas de los últimos 7 días - #2★ 12.196+46Variación de estrellas de los últimos 7 días
- #3
Habilidades modulares de SenseNova para crear asistentes de oficina impulsados por IA y flujos de trabajo de productividad
★ 5254+247Variación de estrellas de los últimos 7 días - #4★ 4071+54Variación de estrellas de los últimos 7 días
- #5
Traducción de PDF conservando el diseño, las fórmulas y la estructura, adecuada para documentos científicos y técnicos.
★ 2234+20Variación de estrellas de los últimos 7 días - #6
ExtractThinker es una librería de inteligencia de documentos para LLMs que ofrece interacción al estilo ORM para flujos de trabajo de documentos flexibles y potentes.
★ 1596+2Variación de estrellas de los últimos 7 días - #7
OpenOCR: Un toolkit de código abierto para investigación y aplicaciones de OCR general, que integra un benchmark unificado de entrenamiento y evaluación, sistemas de OCR y análisis de documentos de nivel comercial, y reproducciones fieles de las implementaciones principales de una amplia gama de artículos académicos.
★ 1441+3Variación de estrellas de los últimos 7 días - #8
La biblioteca de PDF más rápida para Python y Rust. Extracción de texto, extracción de imágenes, conversión a markdown, creación y edición de PDF. 0.8ms de media, 5 veces más rápida que los líderes del sector, 100% de tasa de éxito en 3,830 archivos PDF. MIT/Apache-2.0.
★ 1010+37Variación de estrellas de los últimos 7 días - #9
Asistente de IA de código abierto y centrado en lo local para tus datos. Unifica tareas, notas, documentos, fotos y marcadores. Privado, autohospedado y extensible mediante APIs.
★ 917+15Variación de estrellas de los últimos 7 días - #10
Proporciona a tu agente de IA capacidad de lectura para archivos PDF: texto estructurado, tablas, OCR, evidencia visual y citas a nivel de página a través de MCP. Nativo en Rust, con enfoque local.
★ 911+8Variación de estrellas de los últimos 7 días - #11
Transforma documentos no estructurados en grafos de conocimiento validados, enriquecidos y consultables.
★ 851+91Variación de estrellas de los últimos 7 días - #12
Compañero de escritorio con IA emocional: privacidad primero, activación por voz, asistencia de oficina y extensibilidad MCP
★ 728+49Variación de estrellas de los últimos 7 días - #13
Biblioteca Java para extracción de tablas en PDF y OCR. Extrae tablas estructuradas de archivos PDF basados en texto y escaneados mediante análisis de flujo, de red (detección de cuadrícula estilo OpenCV) e híbrido.
★ 518-27Variación de estrellas de los últimos 7 días