ocr
Repositórios de código aberto acompanhados marcados com ocr, ordenados por estrelas.
- #91
Servidor OCR para iOS usando o Vision Framework da Apple.
★ 2.029+19Variação de estrelas nos últimos 7 dias - #92
Uma interface Gtk/Qt para tesseract-ocr.
★ 1.989+4Variação de estrelas nos últimos 7 dias - #93★ 1.900+3Variação de estrelas nos últimos 7 dias
- #94★ 1.879+3Variação de estrelas nos últimos 7 dias
- #95
Um sistema de OCR leve baseado no PaddleOCR, desacoplado do framework de aprendizado profundo PaddlePaddle, com velocidade de inferência ultrarrápida.
★ 1.867+5Variação de estrelas nos últimos 7 dias - #96
Uma coleção de ideias e algoritmos originais e inovadores voltados para o Advanced Literate Machinery. Este projeto é mantido pela equipe de OCR do Language Technology Lab, Tongyi Lab, Alibaba Group.
★ 1.835+1Variação de estrelas nos últimos 7 dias - #97★ 1.772-1Variação de estrelas nos últimos 7 dias
- #98
Extração de dados não estruturados rápida e eficiente. Escrito em Rust com bindings para várias linguagens.
★ 1.772+0Variação de estrelas nos últimos 7 dias - #99★ 1.761+0Variação de estrelas nos últimos 7 dias
- #100★ 1.739+6Variação de estrelas nos últimos 7 dias
- #101★ 1.720+8Variação de estrelas nos últimos 7 dias
- #102
Maneira declarativa de executar modelos de IA no React Native localmente, utilizando o ExecuTorch.
★ 1.707+5Variação de estrelas nos últimos 7 dias - #103
MixTeX LaTeX multimodal, ZhEn e Table OCR. Ele realiza inferência eficiente baseada em CPU em um ambiente offline local no Windows.
★ 1.641+2Variação de estrelas nos últimos 7 dias - #104
ExtractThinker é uma biblioteca de inteligência de documentos para LLMs, oferecendo interação estilo ORM para fluxos de trabalho de documentos flexíveis e poderosos.
★ 1.596+1Variação de estrelas nos últimos 7 dias - #105
YomiToku é um pacote Python que fornece um motor de análise de documentos baseado em IA, projetado especificamente para o idioma japonês.
★ 1.583+3Variação de estrelas nos últimos 7 dias - #106
Coleção de bibliotecas e ferramentas de código aberto para Automação de Processos Robóticos (RPA), projetadas para uso com Robot Framework e Python
★ 1.555+0Variação de estrelas nos últimos 7 dias - #107
Programa de linha de comando para Windows de reconhecimento óptico de caracteres (OCR) offline, que gera resultados em formato JSON para facilitar a integração com outros programas. Oferece APIs para diversas linguagens. Compilado a partir do PaddleOCR C++.
★ 1.544+1Variação de estrelas nos últimos 7 dias - #108
Extraia e converta dados de qualquer documento, imagens, PDFs, documentos Word, PPT ou URL para múltiplos formatos (Markdown, JSON, CSV, HTML) com extração inteligente de dados estruturados e OCR avançado.
★ 1.534+1Variação de estrelas nos últimos 7 dias - #109
Plataforma de código aberto para extrair dados estruturados de documentos usando IA.
★ 1.520-1Variação de estrelas nos últimos 7 dias - #110
Uma versão empacotada e flexível do detector de texto CRAFT e do modelo de reconhecimento Keras CRNN.
★ 1.473+0Variação de estrelas nos últimos 7 dias - #111
OpenOCR: Um toolkit open-source para pesquisa e aplicações de OCR geral, integra um benchmark unificado de treinamento e avaliação, sistemas de OCR e análise de documentos de nível comercial, e reproduções fiéis das implementações centrais de uma ampla gama de artigos acadêmicos.
★ 1.441+2Variação de estrelas nos últimos 7 dias - #112
Um conjunto de notebooks e outros arquivos que podem ajudá-lo a aprender IA do zero.
★ 1.438+4Variação de estrelas nos últimos 7 dias - #113
Como copiar texto de imagens? A resposta é o TextSnatcher! Realize operações de OCR em segundos no Linux Desktop.
★ 1.387+0Variação de estrelas nos últimos 7 dias - #114★ 1.381+0Variação de estrelas nos últimos 7 dias
- #115
Um servidor de conversão de arquivos auto-hospedado e consciente de recursos, com suporte a 488 formatos em 26 idiomas.
★ 1.368+4Variação de estrelas nos últimos 7 dias - #116
Versão aprimorada de reconhecimento de fórmulas matemáticas: fórmulas manuscritas e impressas em chinês e inglês, com suporte a dedução de símbolos básicos (estrutura de dados baseada em árvore de sintaxe abstrata LaTeX).
★ 1.311+1Variação de estrelas nos últimos 7 dias - #117
Tradução ao passar o mouse para qualquer idioma - Extensão para Chrome: Tradutor de PDF, EBOOK, EPUB, OCR, TTS, NETFLIX, YOUTUBE DUAL SUBTITLES, GOOGLE DOCS, IA, VIEWER, GMAIL, WRITING, IMAGE, DUAL SUBS, MANGA, HOVER, DICTIONARY, WEBTOON, EDGE, JAPONÊS, INGLÊS.
★ 1.305+4Variação de estrelas nos últimos 7 dias - #118
Captura de tela e gravação de tela de código aberto para macOS. A alternativa nativa e gratuita ao CleanShot X. Construído com Swift 6.0 e SwiftUI.
★ 1.284+11Variação de estrelas nos últimos 7 dias - #119
Ferramenta de pesquisa open source para buscar, navegar, analisar e explorar grandes coleções de documentos por meio de um mecanismo de busca semântica e plataforma de mineração e análise de texto open source (integra ETL para processamento de documentos, OCR para imagens e PDF, reconhecimento de entidades nomeadas para pessoas, organizações e locais, gerenciamento de metadados por tesauros e ontologias, interface de usuário de busca e aplicativos de busca para texto completo).
★ 1.206+1Variação de estrelas nos últimos 7 dias - #120
Inferência de PaddleOCR em PyTorch. Convertido a partir do [PaddleOCR](https://github.com/PaddlePaddle/PaddleOCR)
★ 1.205+0Variação de estrelas nos últimos 7 dias