メインコンテンツへスキップ
buildradar
Sign in
トピック · pdf-extraction

pdf-extraction

pdf-extraction がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
9
総スター数
67,687
平均スター数
7,521
シェア
0.00%

pdf-extraction と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、pdf-extraction がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • opendataloader-pdf@opendataloader-project

    AI 向けデータのための PDF パーサー。PDF のアクセシビリティを自動化。オープンソース。

    28,905+49直近 7 日のスター増減
  • pdf-inspector@firecrawl

    PDFの検査、分類、テキスト抽出のための高速なRustライブラリ。スキャンされたPDFとテキストベースのPDFをインテリジェントに検出し、スマートなルーティング決定を可能にする。

    18,547+1,664直近 7 日のスター増減
  • xberg@xberg-io

    Rustコアを備えたポリグロットなドキュメントインテリジェンスフレームワーク。101のフォーマット(115のファイル拡張子)からテキスト、メタデータ、画像、構造化データを抽出し、さらに371のコード言語に対応するコードインテリジェンスを提供します。15の言語バインディング(Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript)に加え、CLI、REST API、MCPサーバーも利用可能です。

    9,254+21直近 7 日のスター増減
  • unstract@Zipstack

    LLM駆動による非構造化データの抽出 — APIデプロイメントおよびETLパイプラインワークフロー向けに構築

    7,191+9直近 7 日のスター増減
  • TurboOCR@aiptimizer

    TurboOCR、>200 img/s OmnidocBench。TensorRT FP16、PP-OCRv6、HTTP + gRPC

    1,056+17直近 7 日のスター増減
  • signaturepdf@24eme

    PDFへの署名(単独または複数)、ページの整理、メタデータの編集、PDFの圧縮を行う無料のオープンソースWebソフトウェア

    828+2直近 7 日のスター増減
  • pytr@pytr-org

    ターミナルで TradeRepublic を利用し、すべてのドキュメントをまとめてダウンロードする

    793+5直近 7 日のスター増減
  • mupdf.js@ArtifexSoftware

    MuPDF用のJavaScriptバインディング

    608+2直近 7 日のスター増減
  • ExtractPDF4J@ExtractPDF4J

    Java PDF テーブル抽出・OCR ライブラリ。ストリーム、格子(OpenCV スタイルのグリッド検出)、ハイブリッド解析を使用して、テキストベースおよびスキャンされた PDF から構造化テーブルを抽出する。

    520+0直近 7 日のスター増減
← トピック一覧に戻る