Zum Hauptinhalt springen
buildradar
Thema · document-parsing

document-parsing

Erfasste Open-Source-Repos mit dem Tag document-parsing, sortiert nach Sternen.

Repos
13
Sterne gesamt
212.317
Sterne im Schnitt
16.332
Anteil
0,01%

Themen, die häufig gemeinsam mit document-parsing am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit document-parsing getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • PaddleOCR@PaddlePaddle

    Wandeln Sie jedes PDF- oder Bilddokument in strukturierte Daten für Ihre KI um. Ein leistungsstarkes, lightweight OCR-Toolkit, das die Lücke zwischen Bildern/PDFs und LLMs schließt. Unterstützt über 100 Sprachen.

    88.454+374Sterne-Änderung der letzten 7 Tage
  • docling@docling-project

    Bereite deine Dokumente für GenAI vor

    65.726+352Sterne-Änderung der letzten 7 Tage
  • opendataloader-pdf@opendataloader-project

    PDF-Parser für KI-fähige Daten. Automatisiert PDF-Accessibility. Open-source.

    28.856+215Sterne-Änderung der letzten 7 Tage
  • unstructured@Unstructured-IO

    Konvertieren Sie Dokumente mühelos in strukturierte Daten. Unstructured ist eine Open-Source-ETL-Lösung zur Umwandlung komplexer Dokumente in saubere, strukturierte Formate für Sprachmodelle.

    15.362+31Sterne-Änderung der letzten 7 Tage
  • llama_cloud_services@run-llama

    Wissensagenten und -verwaltung in der Cloud

    4.262+0Sterne-Änderung der letzten 7 Tage
  • ade-cli@landing-ai

    Die offizielle CLI für Agentic Document Extraction (ADE) von LandingAI – Dokumente parsen und schematisierte Daten direkt vom Terminal aus extrahieren.

    2.409+4Sterne-Änderung der letzten 7 Tage
  • ExtractThinker@enoch3712

    ExtractThinker ist eine Document-Intelligence-Bibliothek für LLMs und bietet eine ORM-artige Interaktion für flexible und leistungsstarke Dokumenten-Workflows.

    1.595+2Sterne-Änderung der letzten 7 Tage
  • docstrange@NanoNets

    Extrahieren und Konvertieren von Daten aus beliebigen Dokumenten, Bildern, PDFs, Word-Dokumenten, PPTs oder URLs in mehrere Formate (Markdown, JSON, CSV, HTML) durch intelligente strukturierte Datenextraktion und fortschrittliche OCR.

    1.533+5Sterne-Änderung der letzten 7 Tage
  • OpenOCR@Topdu

    OpenOCR: Ein Open-Source-Toolkit für die allgemeine OCR-Forschung und -Anwendungen. Es integriert einen einheitlichen Trainings- und Evaluierungs-Benchmark, kommerzielle OCR- und Dokumentenanalysesysteme sowie originalgetreue Reproduktionen der Kernimplementierungen aus einer Vielzahl akademischer Arbeiten.

    1.440+3Sterne-Änderung der letzten 7 Tage
  • TurboOCR@aiptimizer

    TurboOCR, >200 img/s OmnidocBench. TensorRT FP16, PP-OCRv6, HTTP + gRPC

    1.041+23Sterne-Änderung der letzten 7 Tage
  • haiku.rag@ggozad

    Agentic RAG für lokale und selbst gehostete Dokumentensuche: hybrides Retrieval, Reranking und multimodales RAG auf eingebettetem LanceDB, mit Docling-Parsing und einem MCP-Server.

    584+2Sterne-Änderung der letzten 7 Tage
  • ParseBench@run-llama

    ParseBench - Ein Dokumenten-Parsing-Benchmark für KI-Agenten

    554+2Sterne-Änderung der letzten 7 Tage
  • NexusRAG@LeDat98

    Hybrid RAG system combining vector search, knowledge graph (LightRAG), and cross-encoder reranking — with Docling document parsing, visual intelligence (image/table captioning), agentic streaming chat, and inline citations. Powered by Gemini or local Ollama models.

    505Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen