pdf-extraction
Repositórios de código aberto acompanhados marcados com pdf-extraction, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de pdf-extraction no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com pdf-extraction.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
PDF Parser para dados prontos para IA. Automatize a acessibilidade de PDFs. Código aberto.
★ 28.856+215Variação de estrelas nos últimos 7 dias - #2
Biblioteca Rust rápida para inspeção, classificação e extração de texto em PDF. Detecta de forma inteligente PDFs digitalizados versus baseados em texto para permitir decisões de roteamento inteligentes.
★ 16.883+436Variação de estrelas nos últimos 7 dias - #3
Um framework poliglota de inteligência de documentos com núcleo em Rust. Extraia texto, metadados, imagens e dados estruturados de 101 formatos (115 extensões de arquivo), além de inteligência de código para 371 linguagens. 15 bindings de linguagem — Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript — além de CLI, REST API e servidor MCP.
★ 9.233+48Variação de estrelas nos últimos 7 dias - #4
Extração de dados não estruturados impulsionada por LLM — Construída para implantações de API e fluxos de trabalho de pipeline ETL
★ 7.182+26Variação de estrelas nos últimos 7 dias - #5★ 1.041+23Variação de estrelas nos últimos 7 dias
- #6
Software web gratuito e de código aberto para assinar PDFs (sozinho ou com outros), organizar páginas, editar metadados e comprimir PDFs
★ 826+1Variação de estrelas nos últimos 7 dias - #7★ 788+3Variação de estrelas nos últimos 7 dias
- #8★ 607-1Variação de estrelas nos últimos 7 dias
- #9
Biblioteca Java de extração de tabelas PDF e OCR. Extrai tabelas estruturadas de PDFs baseados em texto e digitalizados usando análise de fluxo, grade (detecção de grade estilo OpenCV) e análise híbrida.
★ 517-27Variação de estrelas nos últimos 7 dias