Pular para o conteúdo principal
buildradar
Sign in
Tópico · table-extraction

table-extraction

Repositórios de código aberto acompanhados marcados com table-extraction, ordenados por estrelas.

Repositórios
8
Total de estrelas
37.910
Média de estrelas
4.739
Participação
0,00%

Tópicos que aparecem com frequência ao lado de table-extraction no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com table-extraction.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • pdfplumber@jsvine

    Analise um PDF para obter informações detalhadas sobre cada caractere, retângulo, linha, etc. — e extraia facilmente textos e tabelas.

    10.701+15Variação de estrelas nos últimos 7 dias
  • PyMuPDF@pymupdf

    PyMuPDF é uma biblioteca Python de alto desempenho para extração, análise, conversão e manipulação de documentos PDF (e outros).

    10.602+67Variação de estrelas nos últimos 7 dias
  • xberg@xberg-io

    Um framework poliglota de inteligência de documentos com núcleo em Rust. Extraia texto, metadados, imagens e dados estruturados de 101 formatos (115 extensões de arquivo), além de inteligência de código para 371 linguagens. 15 bindings de linguagem — Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript — além de CLI, REST API e servidor MCP.

    9.233+48Variação de estrelas nos últimos 7 dias
  • table-transformer@microsoft

    Table Transformer (TATR) é um modelo de deep learning para extração de tabelas de documentos não estruturados (PDFs e imagens). Este é o repositório oficial do dataset PubTables-1M e da métrica de avaliação GriTS.

    2.943+2Variação de estrelas nos últimos 7 dias
  • docext@NanoNets

    Um kit de ferramentas local para extração de dados não estruturados sem OCR, conversão para markdown e benchmarking. (https://idp-leaderboard.org/)

    2.086+4Variação de estrelas nos últimos 7 dias
  • api-llm-ocr@yigitkonur

    PDF para markdown usando LLMs de visão — tabelas, layouts e estrutura preservados

    901-2Variação de estrelas nos últimos 7 dias
  • img2table@xavctn

    img2table é uma biblioteca Python de identificação e extração de tabelas para PDF e imagens, baseada no processamento de imagens OpenCV.

    894+2Variação de estrelas nos últimos 7 dias
  • ParseBench@run-llama

    ParseBench - Um benchmark de análise de documentos para agentes de IA

    558+2Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos