document-processing
Repositórios de código aberto acompanhados marcados com document-processing, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de document-processing no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com document-processing.
- #1
Transforme qualquer PDF de livro técnico em uma habilidade do Claude Code — pronto para estudar, consultar e usar enquanto trabalha.
★ 27.016+3.296Variação de estrelas nos últimos 7 dias - #2★ 12.196+46Variação de estrelas nos últimos 7 dias
- #3
Habilidades modulares SenseNova para criar assistentes de escritório baseados em IA e fluxos de trabalho de produtividade.
★ 5.173+247Variação de estrelas nos últimos 7 dias - #4★ 4.040+54Variação de estrelas nos últimos 7 dias
- #5
Tradução de PDF preservando layout, fórmulas e estrutura, ideal para documentos científicos e técnicos
★ 2.225+20Variação de estrelas nos últimos 7 dias - #6
ExtractThinker é uma biblioteca de inteligência de documentos para LLMs, oferecendo interação estilo ORM para fluxos de trabalho de documentos flexíveis e poderosos.
★ 1.595+2Variação de estrelas nos últimos 7 dias - #7
OpenOCR: Um toolkit open-source para pesquisa e aplicações de OCR geral, integra um benchmark unificado de treinamento e avaliação, sistemas de OCR e análise de documentos de nível comercial, e reproduções fiéis das implementações centrais de uma ampla gama de artigos acadêmicos.
★ 1.440+3Variação de estrelas nos últimos 7 dias - #8
A biblioteca de PDF mais rápida para Python e Rust. Extração de texto, extração de imagem, conversão para markdown, criação e edição de PDF. Média de 0,8ms, 5x mais rápida que os líderes do setor, 100% de taxa de sucesso em 3.830 PDFs. MIT/Apache-2.0.
★ 1.006+37Variação de estrelas nos últimos 7 dias - #9
Assistente de IA local-first e de código aberto para seus dados. Unifique tarefas, notas, documentos, fotos e favoritos. Privado, auto-hospedado e extensível via APIs.
★ 916+15Variação de estrelas nos últimos 7 dias - #10
Dê olhos para o seu agente de IA para PDFs — texto estruturado, tabelas, OCR, evidências visuais e citações em nível de página via MCP. Nativo em Rust, local-first.
★ 906+8Variação de estrelas nos últimos 7 dias - #11
Transforme documentos não estruturados em grafos de conhecimento validados, ricos e consultáveis.
★ 845+91Variação de estrelas nos últimos 7 dias - #12
Um companheiro de desktop de IA com emoções — com foco em privacidade, ativação por voz, assistência de escritório e extensibilidade MCP
★ 704+49Variação de estrelas nos últimos 7 dias - #13
Biblioteca Java de extração de tabelas PDF e OCR. Extrai tabelas estruturadas de PDFs baseados em texto e digitalizados usando análise de fluxo, grade (detecção de grade estilo OpenCV) e análise híbrida.
★ 517-27Variação de estrelas nos últimos 7 dias