Aller au contenu principal
buildradar
Sign in
Sujet · ocr

ocr

Dépôts open source suivis étiquetés ocr, triés par étoiles.

186 dépôts
  • deepdoctection@deepdoctection

    Un dépôt dédié à l'IA documentaire.

    3 257+9Évolution des étoiles sur les 7 derniers jours
  • Pix2Text@breezedeus

    Outil Python3 open-source utilisant de petits modèles pour reconnaître les mises en page, tableaux, formules mathématiques (LaTeX) et textes dans les images, afin de les convertir au format Markdown. Une alternative gratuite à Mathpix permettant une conversion fluide du contenu visuel en texte. Plus de 80 langues supportées.

    3 229+3Évolution des étoiles sur les 7 derniers jours
  • captcha_trainer@kerlomz

    [Reconnaissance de CAPTCHA - Entraînement] Ce projet utilise CNN/ResNet/DenseNet+GRU/LSTM+CTC/CrossEntropy pour réaliser l'identification de CAPTCHA. Ce projet est uniquement destiné à l'entraînement du modèle.

    3 213+0Évolution des étoiles sur les 7 derniers jours
  • text-extract-api@CatchTheTornado

    API d'extraction et d'analyse de documents (PDF, Word, PPTX...) utilisant des OCR modernes de pointe et des modèles pris en charge par Ollama. Anonymisez les documents, supprimez les informations personnelles (PII) et convertissez tout document ou image en JSON ou Markdown structuré.

    3 177+0Évolution des étoiles sur les 7 derniers jours
  • gosseract@otiai10

    Package Go pour l'OCR (reconnaissance optique de caractères), utilisant la bibliothèque C++ Tesseract.

    3 134+2Évolution des étoiles sur les 7 derniers jours
  • tools-ocr@AnyListen

    TreeHole OCR, un outil OCR multiplateforme.

    3 065+1Évolution des étoiles sur les 7 derniers jours
  • tesseract-ocr-for-php@thiagoalessio

    Un wrapper pour utiliser Tesseract OCR avec PHP.

    3 039-2Évolution des étoiles sur les 7 derniers jours
  • Une collection organisée de projets IA pratiques implémentant des systèmes OCR, RAG, des agents IA et d'autres cas d'utilisation de l'IA.

    3 030+58Évolution des étoiles sur les 7 derniers jours
  • llm_aided_ocr@Dicklesworthstone

    Améliore la sortie de Tesseract OCR en utilisant des LLM (locaux ou via API) pour la correction d'erreurs, le découpage intelligent et le formatage Markdown de PDF numérisés.

    2 996+3Évolution des étoiles sur les 7 derniers jours
  • markdownify-mcp@zcaceres

    Un serveur Model Context Protocol pour convertir presque n'importe quel contenu en Markdown.

    2 983-1Évolution des étoiles sur les 7 derniers jours
  • CHINESE-OCR@xiaofengShi

    Détection et reconnaissance de texte de scène en chinois de bout en bout avec CTPN, CRNN et CTC (projet hérité).

    2 955+0Évolution des étoiles sur les 7 derniers jours
  • openrecall@openrecall

    OpenRecall est une alternative open-source axée sur la confidentialité aux solutions propriétaires comme Windows Recall de Microsoft. Accédez facilement à votre historique numérique pour améliorer votre mémoire et votre productivité sans compromettre votre vie privée.

    2 937+2Évolution des étoiles sur les 7 derniers jours
  • papermerge@ciur

    Système de gestion documentaire open source pour archives numériques (documents numérisés).

    2 935+1Évolution des étoiles sur les 7 derniers jours
  • comic-translate@ogkalu2

    Application et extension de navigateur de traduction de BD et mangas par IA pour traduire automatiquement des comics, mangas, manhwas, BD, fumetti, etc., dans plusieurs langues et formats (Images, PDF, EPUB, CBR, CBZ, etc.).

    2 928+12Évolution des étoiles sur les 7 derniers jours
  • manga-ocr@kha-white

    Reconnaissance optique de caractères pour le texte japonais, avec un accent particulier sur les mangas.

    2 770+7Évolution des étoiles sur les 7 derniers jours
  • Outil open source de traduction de mangas basé sur manga-image-translator. Prend en charge la traduction automatique de mangas japonais, coréens et américains, intègre 5 moteurs de traduction dont OpenAI et Gemini, et propose un éditeur visuel pour ajuster le style du texte. Installation en un clic, prêt à l'emploi.

    2 711+35Évolution des étoiles sur les 7 derniers jours
  • normcap@dynobo

    Outil de capture d'écran basé sur l'OCR pour capturer des informations plutôt que des images

    2 705+4Évolution des étoiles sur les 7 derniers jours
  • Utiliser des LLM et la vision LLM (OCR) pour gérer paperless-ngx - Numérisation de documents propulsée par l'IA

    2 662+8Évolution des étoiles sur les 7 derniers jours
  • docs@sismics

    Système de gestion documentaire léger doté de toutes les fonctionnalités attendues des solutions coûteuses.

    2 561+0Évolution des étoiles sur les 7 derniers jours
  • ballerine@ballerine-io

    Plateforme open-source d'infrastructure et d'orchestration de données pour la prise de décision en matière de risques.

    2 427+1Évolution des étoiles sur les 7 derniers jours
  • ade-cli@landing-ai

    CLI officielle pour l'extraction de documents par IA (ADE) de LandingAI — analysez des documents et extrayez des données structurées depuis votre terminal

    2 410+1Évolution des étoiles sur les 7 derniers jours
  • comfyui_LLM_party@heshengtao

    Framework d'agent LLM dans ComfyUI incluant des nœuds pour serveur MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 et FLUX, accès à Feishu, discord, et compatible avec tous les LLM utilisant des interfaces similaires à openai / aisuite, tels que o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi, doubao. Adapté aux LLM locaux, VLM et GGUF tels que llama-3.3, Janus-Pro et Linkage graphRAG.

    2 348+5Évolution des étoiles sur les 7 derniers jours
  • docspell@eikek

    Aide à organiser vos piles de documents provenant de scanners, d'e-mails et d'autres sources avec un minimum d'effort.

    2 317+2Évolution des étoiles sur les 7 derniers jours
  • gowall@Achno

    Outil de traitement d'image incluant la conversion de palettes de couleurs, l'OCR via VLM, la compression, l'extraction de palettes et l'upscaling par réseaux antagonistes.

    2 303+1Évolution des étoiles sur les 7 derniers jours
  • retain-pdf@wxyhgk

    Traduction de PDF tout en préservant la mise en page, les formules et la structure, adaptée aux documents scientifiques et techniques

    2 234+8Évolution des étoiles sur les 7 derniers jours
  • SimpleHTR@githubharald

    Système de reconnaissance de texte manuscrit (HTR) implémenté avec TensorFlow.

    2 184+0Évolution des étoiles sur les 7 derniers jours
  • deepseek-ocr.rs@TimmyOVO

    Moteur OCR/VLM multi-backend en Rust (DeepSeek-OCR-1/2, PaddleOCR-VL, DotsOCR) avec quantification DSQ, serveur compatible OpenAI et CLI – exécution locale sans Python.

    2 184+1Évolution des étoiles sur les 7 derniers jours
  • tesserocr@sirfz

    Wrapper Python pour l'API tesseract-ocr

    2 171+0Évolution des étoiles sur les 7 derniers jours
  • obsidian-omnisearch@scambier

    Un moteur de recherche « qui fonctionne tout simplement » pour Obsidian. Prend en charge l'OCR et l'indexation PDF.

    2 131+2Évolution des étoiles sur les 7 derniers jours
  • docext@NanoNets

    Une boîte à outils sur site pour l'extraction de données non structurées sans OCR, la conversion en markdown et l'évaluation comparative.

    2 086-1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets