メインコンテンツへスキップ
buildradar
Sign in
トピック · document-analysis

document-analysis

document-analysis がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
12
総スター数
103,717
平均スター数
8,643
シェア
0.01%

document-analysis と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、document-analysis がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • MinerU@opendatalab

    PDFやOfficeドキュメントなどの複雑な文書を、エージェンティックワークフロー用のLLM対応のmarkdown/JSONに変換します。

    78,747+564直近 7 日のスター増減
  • Dolphin@bytedance

    「Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting」の公式リポジトリ (ACL, 2025)

    9,049-1直近 7 日のスター増減
  • docetl@ucbepic

    エージェンティックLLMを活用したデータ処理およびETLのためのシステム

    4,040+54直近 7 日のスター増減
  • PdfPig@UglyToad

    C# で PDF からテキストやその他のコンテンツを読み取って抽出する(PDFBox のポート)

    2,552+5直近 7 日のスター増減
  • docext@NanoNets

    オンプレミスで OCR 不要の非構造化データ抽出、マークダウン変換、ベンチマーク用のツールキット (https://idp-leaderboard.org/)

    2,086+4直近 7 日のスター増減
  • AdvancedLiterateMachinery@AlibabaResearch

    Advanced Literate Machinery に向けた独創的で革新的なアイデアとアルゴリズムのコレクション。このプロジェクトは Alibaba Group 達摩院言語技術ラボ OCR チームによって維持されています。

    1,834-1直近 7 日のスター増減
  • documind@DocumindHQ

    AIを使用してドキュメントから構造化データを抽出するオープンソースプラットフォーム

    1,520-1直近 7 日のスター増減
  • OpenOCR@Topdu

    OpenOCR: 一般 OCR の研究と応用向けのオープンソースツールキット。統一された学習・評価ベンチマーク、商用グレードの OCR および文書解析システム、多数の学術論文のコア実装の忠実な再現を統合しています。

    1,440+3直近 7 日のスター増減
  • dedoc@ispras

    Dedocは、ドキュメントの解析と統一フォーマットへの変換を自動化するためのライブラリ(サービス)です。テキスト電子ドキュメントから、コンテンツ、論理構造、テーブル、メタ情報を自動的に抽出します。(ドキュメント解析、ドキュメントコンテンツ抽出、論理構造抽出、PDFパーサー、スキャン済みドキュメントパーサー、DOCXパーサー、HTMLパーサー)

    732+13直近 7 日のスター増減
  • MinerU-Diffusion@opendatalab

    [ECCV 2026] 自己回帰デコーディングをブロック単位の並列拡散デコーディングに置き換える、ドキュメントOCR用の拡散ベースのフレームワーク。

    615+1直近 7 日のスター増減
  • PICK-pytorch@wenwenyu

    論文「PICK: Processing Key Information Extraction from Documents using Improved Graph Learning-Convolutional Networks」 (ICPR 2020) のコード

    570+0直近 7 日のスター増減
  • assemblyline@CybercentreCanada

    AssemblyLine 4: ファイルトリアージとマルウェア解析

    531+3直近 7 日のスター増減
← トピック一覧に戻る