トピック · pdf-extraction
pdf-extraction
pdf-extraction がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
リポジトリ
9
総スター数
67,687
平均スター数
7,521
シェア
0.00%
関連トピック
pdf-extraction と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、pdf-extraction がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
AI 向けデータのための PDF パーサー。PDF のアクセシビリティを自動化。オープンソース。
★ 28,905+49直近 7 日のスター増減 - #2
PDFの検査、分類、テキスト抽出のための高速なRustライブラリ。スキャンされたPDFとテキストベースのPDFをインテリジェントに検出し、スマートなルーティング決定を可能にする。
★ 18,547+1,664直近 7 日のスター増減 - #3
Rustコアを備えたポリグロットなドキュメントインテリジェンスフレームワーク。101のフォーマット(115のファイル拡張子)からテキスト、メタデータ、画像、構造化データを抽出し、さらに371のコード言語に対応するコードインテリジェンスを提供します。15の言語バインディング(Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript)に加え、CLI、REST API、MCPサーバーも利用可能です。
★ 9,254+21直近 7 日のスター増減 - #4★ 7,191+9直近 7 日のスター増減
- #5★ 1,056+17直近 7 日のスター増減
- #6
PDFへの署名(単独または複数)、ページの整理、メタデータの編集、PDFの圧縮を行う無料のオープンソースWebソフトウェア
★ 828+2直近 7 日のスター増減 - #7★ 793+5直近 7 日のスター増減
- #8★ 608+2直近 7 日のスター増減
- #9
Java PDF テーブル抽出・OCR ライブラリ。ストリーム、格子(OpenCV スタイルのグリッド検出)、ハイブリッド解析を使用して、テキストベースおよびスキャンされた PDF から構造化テーブルを抽出する。
★ 520+0直近 7 日のスター増減