跳到主要内容
buildradar
Sign in
主题 · extraction

extraction

标记 extraction 主题、收录中的开源项目,按星标数排序。

项目数
16
总星标数
49,437
平均星标数
3,090
占比
0.00%

常跟 extraction 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 extraction 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • Keka@aonez

    macOS 与 iOS 文件压缩工具

    7,275+43近 7 天星标变化
  • Adversarial Robustness Toolbox (ART) - 用于机器学习安全的 Python 库,支持规避、投毒、模型提取与推理,适合红蓝队使用

    6,210+20近 7 天星标变化
  • Parsr@axa-group

    将PDF、文件和图像转换为增强结构化数据

    6,178+1近 7 天星标变化
  • mtail@google

    从应用程序日志中提取内部监控数据,供时序数据库收集

    4,028+2近 7 天星标变化
  • tika@apache

    Apache Tika 工具包可检测并提取超过千种文件类型(如 PPT、XLS、PDF)的元数据与文字

    4,017+20近 7 天星标变化
  • aubio@aubio

    音频与音乐分析的库

    3,754+2近 7 天星标变化
  • GARbro@morkt

    视觉小说资源浏览器

    3,269+13近 7 天星标变化
  • 提供使用简单字符串标记法读写对象或数组的功能

    2,814+0近 7 天星标变化
  • unblob@onekey-sec

    从各种容器格式中提取文件

    2,545+3近 7 天星标变化
  • docext@NanoNets

    本地部署、无需 OCR 的非结构化数据提取、Markdown 转换与基准测试工具包。(https://idp-leaderboard.org/)

    2,086+4近 7 天星标变化
  • extractous@yobix-ai

    快速且高效的非结构化数据提取。以 Rust 编写,并提供多种语言的绑定。

    1,772+2近 7 天星标变化
  • textract@dbashford

    用于从 html、pdf、doc、docx、xls、xlsx、csv、pptx、png、jpg、gif、rtf 等格式提取文本的 node.js 模块!

    1,695+0近 7 天星标变化
  • tika-python@chrismattmann

    Tika-Python 是 Apache Tika™ REST 服务的 Python 绑定,允许在 Python 社区中原生调用 Tika。

    1,667+1近 7 天星标变化
  • bit7z@rikyoz

    一个 C++ 静态库,为 7-zip 共享库提供干净且简单的接口。

    852+1近 7 天星标变化
  • stanford-openie-python@philipperemy

    让 Stanford Open Information Extraction 变得简单!

    682+1近 7 天星标变化
  • OWLib@overtools

    DataTool 是一个可以从 Overwatch 提取模型、地图和文件的程序。

    593+8近 7 天星标变化
← 返回主题列表