跳到主要内容
buildradar
登录
主题 · transcription

transcription

标记 transcription 主题、收录中的开源项目,按星标数排序。

项目数
54
总星标数
175,951
平均星标数
3,258
占比
0.01%

常跟 transcription 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 transcription 主题的项目。

  • claude-real-video@HUANGCHIHHUNGLeo

    让 Claude(或任何 LLM)真正观看视频——支持从网址或本地文件获取具场景感知、去除重复帧与文字记录的功能。本地运行,采用 MIT 授权。

    2,109
  • rescript@wassgha

    🎬 运行于浏览器中的开源、基于逐字稿的视频/音频编辑器。

    878
  • open-edit@veedstudio

    Open-source, agent-driven editing pipeline: create subtitles, motion graphics, slides, edit and render videos.

    620
  • meetily@Zackriya-Solutions

    以隐私为先的 AI 会议助理,具 4 倍更快的 Parakeet/Whisper 实时转录、说话者分离与基于 Rust 的 Ollama 摘要,100% 本地处理,无需云端。Meetily(Meetly Ai)是 macOS 与 Windows 上首屈一指的自托管、开源 AI 会议笔记工具。了解如何编写会议纪要

    30,252+0近 7 天星标变化
  • FunASR@modelscope

    开源语音识别工具包,支持训练、推理、流式 ASR、VAD、标点、说话人分离流水线,并提供兼容 OpenAI / MCP 的服务接口

    20,136+0近 7 天星标变化
  • VoiceStudio@debpalash

    VoiceStudio 是开源、完全本地化的 ElevenLabs 替代方案——支持 646 种语言的语音克隆、语音设计、视频配音、口述、转录与有声书制作。

    14,835+0近 7 天星标变化
  • omi@BasedHardware

    能看屏幕、听对话并告诉你该怎么做的 AI

    13,377+0近 7 天星标变化
  • voice-pro@abus-aikorea

    Gradio WebUI 为创作者与开发者提供关键 TTS(Edge‑TTS、kokoro)与零样本语音克隆(E2 & F5‑TTS、CosyVoice),并支持 Whisper 音频处理、YouTube 下载、Demucs 人声分离与多语言翻译

    12,730+0近 7 天星标变化
  • SenseVoice@QwenAudio

    开源 SenseVoiceSmall 模型,支持普通话、粤语、英语、日语和韩语的语音识别、语言识别、情绪识别和音频事件检测。

    9,209+0近 7 天星标变化
  • FunClip@modelscope

    基于 FunASR 的视频转录、字幕生成与 LLM 协助剪辑工具,配备本地 Gradio UI

    6,210+0近 7 天星标变化
  • basic-pitch@spotify

    一个轻量级但功能强大的音频转 MIDI 转换器,具备音高弯曲检测

    5,522+0近 7 天星标变化
  • auto-subs@tmoroney

    设备端字幕生成工具,可直接连接 DaVinci Resolve、Premiere 和 After Effects。

    4,122+0近 7 天星标变化
  • speaches@speaches-ai
    3,638+0近 7 天星标变化
  • whishper@pluja

    通过网页 UI 100% 在本地将任何音频转录为文字、翻译并编辑字幕。由 whisper 模型驱动!

    3,068+0近 7 天星标变化
  • Scriberr@rishikanthc

    自托管 AI 语音转文字工具

    3,016+0近 7 天星标变化
  • Hex@kitlangton

    语音 → 文字

    2,893+0近 7 天星标变化
  • vexa@Vexa-ai

    适用于 Google Meet、Microsoft Teams 与 Zoom 的开源会议转录 API。支持自动加入机器人、实时 WebSocket 转录、适用于 AI 代理的 MCP 服务器。可自行托管或使用托管的 SaaS。

    2,741+0近 7 天星标变化
  • awesome-whisper@sindresorhus

    🔊 Whisper 精彩资源列表 — 由 OpenAI 开发的开源 AI 语音识别系统

    2,375+0近 7 天星标变化
  • kalosm@floneum

    在 Rust 中实现即时、可控的本地预训练 AI 模型

    2,226+0近 7 天星标变化
  • noScribe@kaixxx

    用于自动化语音转录的前沿 AI 技术。为 OpenAI 的 Whisper 与 pyannote(说话人识别)提供优秀的 GUI。

    2,145+0近 7 天星标变化
  • claude-real-video@HUANGCHIHHUNGLeo

    让 Claude(或任何 LLM)真正观看视频——支持从网址或本地文件获取具场景感知、去除重复帧与文字记录的功能。本地运行,采用 MIT 授权。

    2,109+0近 7 天星标变化
  • diart@juanmc2005

    一个用于构建 AI 驱动的实时音频应用程序的 Python 套件

    2,024+0近 7 天星标变化
  • audapolis@bugbakery

    具备自动转录功能的语音音频编辑器

    1,892+0近 7 天星标变化
  • typewhisper-mac@TypeWhisper

    适用于 macOS 的本地语音转文字,端侧 AI,完全隐私,可选云端

    1,759+0近 7 天星标变化
  • 使用 AI 进行本地语音识别与字幕生成的 OBS 插件

    1,597+0近 7 天星标变化
  • amical@amicalhq

    🎙️ AI 语音听写应用程序 - 开源且本地优先 ⚡ 输入速度提升 3 倍,无需键盘。 🆓 基于开源模型驱动,可离线运行,快速且准确。

    1,520+0近 7 天星标变化
  • pianotrans@azuwis

    ByteDance 附踏板钢琴转谱工具的简单 GUI

    1,514+0近 7 天星标变化
  • Fun-ASR@QwenAudio

    开源基于 LLM 的中文、方言、口音及多语种语音 ASR 模型家族,具备 FunASR、vLLM、流式与 llama.cpp 运行时。

    1,512+0近 7 天星标变化
  • minutes@silverstein

    每一个会议、每一个想法、每一则语音备忘录,都能透过你的 AI 进行搜寻。开源、隐私优先的对话记忆层。

    1,472+0近 7 天星标变化
  • 多后端 whisper 应用程序。极速执行。针对 Mac-arm 优化。安装简单。输入本地文件或网址,此服务将使用 Whisper AI 进行转录。完全私密且免费 🤯🤯🤯

    1,399+0近 7 天星标变化
  • CrisperWhisper@nyrahealth

    可控制的转录。逐字(包含每个语气词、停顿、口吃、声音)或意图(说话者想表达的意思,针对可读性优化),并带有单词级别的时间戳。

    1,395+0近 7 天星标变化
  • book@hardhackerlabs

    「硬地骇客 - 两个月 $12000 ARR 实践之路」是由 硬地骇客 团队编著,本书是关于 Podwise 产品历程的忠实记录:内容包含 灵感 - 构建 - 发布 - 增长 - 复盘 五个章节。如果你觉得一个人读不够过瘾,欢迎加入「硬地骇客」官方知识星球与专家们一起讨论!Podwise 的故事才刚刚开始,我们也将在星球持续分享我们的认知,成功可能无法复制,但失败一定可以借鉴。现在就点击下方链接加入吧!

    1,370+0近 7 天星标变化
  • muesli@Muesli-HQ

    Muesli - macOS 本地会议转录与听写工具(Granola 与 WisprFlow 的替代方案)

    1,192+35近 7 天星标变化
← 返回主题列表