Pular para o conteúdo principal
buildradar
Sign in
Tópico · document-analysis

document-analysis

Repositórios de código aberto acompanhados marcados com document-analysis, ordenados por estrelas.

Repositórios
12
Total de estrelas
103.717
Média de estrelas
8.643
Participação
0,01%

Tópicos que aparecem com frequência ao lado de document-analysis no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com document-analysis.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • MinerU@opendatalab

    Transforma documentos complexos, como PDFs e arquivos do Office, em markdown/JSON prontos para LLM para seus fluxos de trabalho de agentes.

    78.747+564Variação de estrelas nos últimos 7 dias
  • Dolphin@bytedance

    Repositório oficial do Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting, ACL, 2025.

    9.049-1Variação de estrelas nos últimos 7 dias
  • docetl@ucbepic

    Um sistema para processamento de dados e ETL baseado em agentes com LLM.

    4.040+54Variação de estrelas nos últimos 7 dias
  • PdfPig@UglyToad

    Ler e extrair texto e outros conteúdos de PDFs em C# (port do PDFBox).

    2.552+5Variação de estrelas nos últimos 7 dias
  • docext@NanoNets

    Um kit de ferramentas local para extração de dados não estruturados sem OCR, conversão para markdown e benchmarking. (https://idp-leaderboard.org/)

    2.086+4Variação de estrelas nos últimos 7 dias
  • AdvancedLiterateMachinery@AlibabaResearch

    Uma coleção de ideias e algoritmos originais e inovadores voltados para o Advanced Literate Machinery. Este projeto é mantido pela equipe de OCR do Language Technology Lab, Tongyi Lab, Alibaba Group.

    1.834-1Variação de estrelas nos últimos 7 dias
  • documind@DocumindHQ

    Plataforma de código aberto para extrair dados estruturados de documentos usando IA.

    1.520-1Variação de estrelas nos últimos 7 dias
  • OpenOCR@Topdu

    OpenOCR: Um toolkit open-source para pesquisa e aplicações de OCR geral, integra um benchmark unificado de treinamento e avaliação, sistemas de OCR e análise de documentos de nível comercial, e reproduções fiéis das implementações centrais de uma ampla gama de artigos acadêmicos.

    1.440+3Variação de estrelas nos últimos 7 dias
  • dedoc@ispras

    Dedoc é uma biblioteca (serviço) para automatizar a análise de documentos e convertê-los para um formato uniforme. Extrai automaticamente conteúdo, estrutura lógica, tabelas e metainformações de documentos eletrônicos textuais. (Análise de documentos; Extração de conteúdo de documentos; Extração de estrutura lógica; Analisador de PDF; Analisador de documentos digitalizados; Analisador de DOCX; Analisador de HTML

    732+13Variação de estrelas nos últimos 7 dias
  • MinerU-Diffusion@opendatalab

    [ECCV 2026] Um framework baseado em difusão para OCR de documentos que substitui a decodificação autorregressiva por decodificação de difusão paralela em nível de bloco.

    615+1Variação de estrelas nos últimos 7 dias
  • PICK-pytorch@wenwenyu

    Código para o artigo "PICK: Processing Key Information Extraction from Documents using Improved Graph Learning-Convolutional Networks" (ICPR 2020)

    570+0Variação de estrelas nos últimos 7 dias
  • assemblyline@CybercentreCanada

    AssemblyLine 4: Triagem de arquivos e análise de malwares

    531+3Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos