Pular para o conteúdo principal
buildradar
Sign in
Tópico · ocr

ocr

Repositórios de código aberto acompanhados marcados com ocr, ordenados por estrelas.

186 repositórios
  • deepdoctection@deepdoctection

    Um repositório para Document AI

    3.257+9Variação de estrelas nos últimos 7 dias
  • Pix2Text@breezedeus

    Uma ferramenta Python3 de código aberto com modelos pequenos para reconhecer layouts, tabelas, fórmulas matemáticas (LaTeX) e texto em imagens, convertendo-os para o formato Markdown. Uma alternativa gratuita ao Mathpix, permitindo a conversão contínua de conteúdo visual em representações baseadas em texto. Suporta mais de 80 idiomas.

    3.229+3Variação de estrelas nos últimos 7 dias
  • captcha_trainer@kerlomz

    [Reconhecimento de CAPTCHA - Treinamento] Este projeto utiliza CNN/ResNet/DenseNet + GRU/LSTM + CTC/CrossEntropy para realizar a identificação de CAPTCHA. Este projeto destina-se apenas ao treinamento do modelo.

    3.213+0Variação de estrelas nos últimos 7 dias
  • text-extract-api@CatchTheTornado

    API de extração e análise de documentos (PDF, Word, PPTX...) usando OCR moderno de última geração e modelos suportados pelo Ollama. Anonimize documentos, remova PII e converta qualquer documento ou imagem em JSON ou Markdown estruturado.

    3.177+0Variação de estrelas nos últimos 7 dias
  • gosseract@otiai10

    Pacote Go para OCR (Reconhecimento Óptico de Caracteres), utilizando a biblioteca C++ Tesseract.

    3.134+2Variação de estrelas nos últimos 7 dias
  • tools-ocr@AnyListen

    Shudong OCR (uma ferramenta de OCR multiplataforma).

    3.065+1Variação de estrelas nos últimos 7 dias
  • tesseract-ocr-for-php@thiagoalessio

    Um wrapper para trabalhar com Tesseract OCR dentro do PHP.

    3.039-2Variação de estrelas nos últimos 7 dias
  • Uma coleção curada de projetos práticos de IA implementando sistemas de OCR, RAG, agentes de IA e outros casos de uso de IA.

    3.030+58Variação de estrelas nos últimos 7 dias
  • llm_aided_ocr@Dicklesworthstone

    Aprimora a saída do Tesseract OCR usando LLMs (locais ou via API) para correção de erros, segmentação inteligente e formatação em markdown de PDFs digitalizados.

    2.996+3Variação de estrelas nos últimos 7 dias
  • markdownify-mcp@zcaceres

    Um servidor de Model Context Protocol para converter quase qualquer coisa em Markdown.

    2.983-1Variação de estrelas nos últimos 7 dias
  • CHINESE-OCR@xiaofengShi

    Detecção e reconhecimento de texto em cena em chinês de ponta a ponta com CTPN, CRNN e CTC (projeto legado).

    2.955+0Variação de estrelas nos últimos 7 dias
  • openrecall@openrecall

    OpenRecall é uma alternativa totalmente de código aberto e focada em privacidade a soluções proprietárias como o Windows Recall da Microsoft. Com o OpenRecall, você pode acessar facilmente seu histórico digital, aprimorando sua memória e produtividade sem comprometer sua privacidade.

    2.937+2Variação de estrelas nos últimos 7 dias
  • papermerge@ciur

    Sistema de gerenciamento de documentos de código aberto para arquivos digitais (documentos digitalizados).

    2.935+1Variação de estrelas nos últimos 7 dias
  • comic-translate@ogkalu2

    Aplicativo e extensão de navegador com IA para tradução automática de quadrinhos, mangás, manhwas, BDs, fumetti e mais, em múltiplos idiomas e formatos (Imagens, PDF, EPUB, CBR, CBZ, etc.).

    2.928+12Variação de estrelas nos últimos 7 dias
  • manga-ocr@kha-white

    Reconhecimento óptico de caracteres para texto em japonês, com foco principal em mangás

    2.770+7Variação de estrelas nos últimos 7 dias
  • Ferramenta de tradução de mangás de código aberto baseada em manga-image-translator. Suporta tradução automática de mangás japoneses, coreanos e americanos, inclui 5 motores de tradução como OpenAI e Gemini, e oferece um editor visual para ajustar o estilo do texto. Instalação com um clique, pronto para usar.

    2.711+35Variação de estrelas nos últimos 7 dias
  • normcap@dynobo

    Ferramenta de captura de tela baseada em OCR para capturar informações em vez de imagens.

    2.705+4Variação de estrelas nos últimos 7 dias
  • Use LLMs e LLM Vision (OCR) para gerenciar o paperless-ngx - Digitalização de documentos impulsionada por IA

    2.662+8Variação de estrelas nos últimos 7 dias
  • docs@sismics

    Sistema de gerenciamento de documentos leve, equipado com todos os recursos que você esperaria de grandes soluções caras

    2.561+0Variação de estrelas nos últimos 7 dias
  • ballerine@ballerine-io

    Plataforma de infraestrutura e orquestração de dados open source para decisão de risco

    2.427+1Variação de estrelas nos últimos 7 dias
  • ade-cli@landing-ai

    CLI oficial para Agentic Document Extraction (ADE) da LandingAI — analise documentos e extraia dados estruturados a partir do seu terminal.

    2.410+1Variação de estrelas nos últimos 7 dias
  • comfyui_LLM_party@heshengtao

    Framework de agentes LLM no ComfyUI, incluindo servidor MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 e nós de prompt FLUX, com acesso a Feishu e Discord, adaptando-se a todos os LLMs com interfaces similares à da OpenAI/aisuite, como o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi e doubao. Adaptado para LLMs locais, VLM e GGUF, como llama-3.3, Janus-Pro e Linkage graphRAG.

    2.348+5Variação de estrelas nos últimos 7 dias
  • docspell@eikek

    Ajuda a organizar pilhas de documentos provenientes de scanners, e-mails e outras fontes com o mínimo de esforço.

    2.317+2Variação de estrelas nos últimos 7 dias
  • gowall@Achno

    Uma ferramenta para converter esquemas de cores/paletas de papéis de parede, OCR com VLM tradicional e híbrido, compressão de imagem, extração de paleta de cores, upscaling de imagem com redes adversárias e mais recursos de processamento de imagem.

    2.303+1Variação de estrelas nos últimos 7 dias
  • retain-pdf@wxyhgk

    Tradução de PDF preservando layout, fórmulas e estrutura, ideal para documentos científicos e técnicos

    2.234+8Variação de estrelas nos últimos 7 dias
  • SimpleHTR@githubharald

    Sistema de reconhecimento de texto manuscrito (HTR) implementado com TensorFlow.

    2.184+0Variação de estrelas nos últimos 7 dias
  • deepseek-ocr.rs@TimmyOVO

    Motor de OCR/VLM multi-backend em Rust (DeepSeek-OCR-1/2, PaddleOCR-VL, DotsOCR) com quantização DSQ, servidor compatível com OpenAI e CLI – execute localmente sem Python

    2.184+1Variação de estrelas nos últimos 7 dias
  • tesserocr@sirfz

    Um wrapper em Python para a API do tesseract-ocr

    2.171+0Variação de estrelas nos últimos 7 dias
  • obsidian-omnisearch@scambier

    Um mecanismo de busca que simplesmente funciona para o Obsidian. Suporta OCR e indexação de PDF.

    2.131+2Variação de estrelas nos últimos 7 dias
  • docext@NanoNets

    Um kit de ferramentas local para extração de dados não estruturados sem OCR, conversão para markdown e benchmarking. (https://idp-leaderboard.org/)

    2.086-1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos