メインコンテンツへスキップ
buildradar
Sign in
トピック · table-extraction

table-extraction

table-extraction がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
8
総スター数
37,910
平均スター数
4,739
シェア
0.00%

table-extraction と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、table-extraction がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • pdfplumber@jsvine

    各文字、長方形、線などの詳細情報を含むPlumb a PDF — テキストやテーブルを簡単に抽出できます。

    10,701+15直近 7 日のスター増減
  • PyMuPDF@pymupdf

    PyMuPDFは、PDF(およびその他の)ドキュメントのデータ抽出、分析、変換、操作のための高性能なPythonライブラリです。

    10,602+67直近 7 日のスター増減
  • xberg@xberg-io

    Rustコアを備えたポリグロットなドキュメントインテリジェンスフレームワーク。101のフォーマット(115のファイル拡張子)からテキスト、メタデータ、画像、構造化データを抽出し、さらに371のコード言語に対応するコードインテリジェンスを提供します。15の言語バインディング(Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript)に加え、CLI、REST API、MCPサーバーも利用可能です。

    9,233+48直近 7 日のスター増減
  • table-transformer@microsoft

    Table Transformer (TATR) は、非構造化ドキュメント(PDF および画像)から表を抽出するためのディープラーニングモデルです。PubTables-1M データセットおよび GriTS 評価指標の公式リポジトリでもあります。

    2,943+2直近 7 日のスター増減
  • docext@NanoNets

    オンプレミスで OCR 不要の非構造化データ抽出、マークダウン変換、ベンチマーク用のツールキット (https://idp-leaderboard.org/)

    2,086+4直近 7 日のスター増減
  • api-llm-ocr@yigitkonur

    ビジョン LLM を使用した PDF から Markdown への変換 — 表、レイアウト、構造を維持

    901-2直近 7 日のスター増減
  • img2table@xavctn

    img2table は、OpenCV の画像処理をベースにした、PDF や画像からテーブルを識別・抽出する Python ライブラリです

    894+2直近 7 日のスター増減
  • ParseBench@run-llama

    ParseBench - AI エージェントのためのドキュメント解析ベンチマーク

    558+2直近 7 日のスター増減
← トピック一覧に戻る