跳到主要內容
buildradar
登入
主題 · transcription

transcription

標記 transcription 主題、收錄中的開源專案,依星數排序。

專案數
54
總星數
175,951
平均星數
3,258
佔比
0.01%

常跟 transcription 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 transcription 主題的專案。

  • claude-real-video@HUANGCHIHHUNGLeo

    讓 Claude(或任何 LLM)真正觀看影片——支援從網址或本地檔案取得具場景感知、去除重複影格與逐字稿的功能。本機執行,採用 MIT 授權。

    2,109
  • rescript@wassgha

    🎬 運行於瀏覽器中的開源、基於逐字稿的影片/音訊編輯器。

    868
  • open-edit@veedstudio

    Open-source, agent-driven editing pipeline: create subtitles, motion graphics, slides, edit and render videos.

    610
  • meetily@Zackriya-Solutions

    以隱私為先的 AI 會議助理,具 4 倍更快的 Parakeet/Whisper 即時轉錄、說話者分離與基於 Rust 的 Ollama 摘要,100% 本地處理,無需雲端。Meetily(Meetly Ai)是 macOS 與 Windows 上首屈一指的自託管、開源 AI 會議筆記工具。了解如何撰寫會議紀要

    30,252+0近 7 天星數變化
  • FunASR@modelscope

    開源語音辨識工具包,支援訓練、推論、串流 ASR、VAD、標點、說話者分割流程,並提供相容 OpenAI / MCP 的服務介面

    20,136+0近 7 天星數變化
  • VoiceStudio@debpalash

    VoiceStudio 是開源、完全本地化的 ElevenLabs 替代方案——支援 646 種語言的語音克隆、語音設計、影片配音、口述、轉錄與有聲書製作。

    14,835+0近 7 天星數變化
  • omi@BasedHardware

    能看螢幕、聽對話並告訴你該怎麼做的 AI

    13,377+0近 7 天星數變化
  • voice-pro@abus-aikorea

    Gradio WebUI 為創作者與開發者提供關鍵 TTS(Edge‑TTS、kokoro)與零樣本語音克隆(E2 & F5‑TTS、CosyVoice),並支援 Whisper 音訊處理、YouTube 下載、Demucs 人聲分離與多語言翻譯

    12,730+0近 7 天星數變化
  • SenseVoice@QwenAudio

    開源 SenseVoiceSmall 模型,支援中文(普通話、粵語)、英文、日文與韓文的語音辨識、語言識別、情緒辨識與音訊事件偵測。

    9,209+0近 7 天星數變化
  • FunClip@modelscope

    基於 FunASR 的影片轉錄、字幕生成與 LLM 協助剪輯工具,配備本地 Gradio UI

    6,210+0近 7 天星數變化
  • basic-pitch@spotify

    一個輕量級但功能強大的音頻轉 MIDI 轉換器,具備音高彎曲檢測

    5,522+0近 7 天星數變化
  • auto-subs@tmoroney

    裝置端字幕生成工具,可直接連結 DaVinci Resolve、Premiere 與 After Effects。

    4,122+0近 7 天星數變化
  • speaches@speaches-ai
    3,638+0近 7 天星數變化
  • whishper@pluja

    透過網頁 UI 100% 在本地將任何音訊轉錄為文字、翻譯並編輯字幕。由 whisper 模型驅動!

    3,068+0近 7 天星數變化
  • Scriberr@rishikanthc

    自託管 AI 語音轉文字工具

    3,016+0近 7 天星數變化
  • Hex@kitlangton

    語音 → 文字

    2,893+0近 7 天星數變化
  • vexa@Vexa-ai

    適用於 Google Meet、Microsoft Teams 與 Zoom 的開源會議逐字稿 API。支援自動加入機器人、即時 WebSocket 逐字稿、適用於 AI 代理的 MCP 伺服器。可自行託管或使用託管的 SaaS。

    2,741+0近 7 天星數變化
  • awesome-whisper@sindresorhus

    🔊 Whisper 相關精彩資源列表 — 由 OpenAI 開發的開源 AI 語音辨識系統

    2,375+0近 7 天星數變化
  • kalosm@floneum

    在 Rust 中實現即時、可控的本機預訓練 AI 模型

    2,226+0近 7 天星數變化
  • noScribe@kaixxx

    用於自動化語音轉錄的前沿 AI 技術。為 OpenAI 的 Whisper 與 pyannote(語者辨識)提供優秀的 GUI。

    2,145+0近 7 天星數變化
  • claude-real-video@HUANGCHIHHUNGLeo

    讓 Claude(或任何 LLM)真正觀看影片——支援從網址或本地檔案取得具場景感知、去除重複影格與逐字稿的功能。本機執行,採用 MIT 授權。

    2,109+0近 7 天星數變化
  • diart@juanmc2005

    一個用於建構 AI 驅動的即時音訊應用程式的 Python 套件

    2,024+0近 7 天星數變化
  • audapolis@bugbakery

    具備自動轉錄功能的語音音訊編輯器

    1,892+0近 7 天星數變化
  • typewhisper-mac@TypeWhisper

    適用於 macOS 的本機語音轉文字,端側 AI,完全隱私,可選雲端

    1,759+0近 7 天星數變化
  • 使用 AI 進行本機語音辨識與字幕產生的 OBS 外掛模組

    1,597+0近 7 天星數變化
  • amical@amicalhq

    🎙️ AI 語音聽寫應用程式 - 開源且本機優先 ⚡ 輸入速度提升 3 倍,無需鍵盤。 🆓 基於開源模型驅動,可離線運作,快速且準確。

    1,520+0近 7 天星數變化
  • pianotrans@azuwis

    ByteDance 附踏板鋼琴轉譜工具的簡單 GUI

    1,514+0近 7 天星數變化
  • Fun-ASR@QwenAudio

    開源基於 LLM 的中文、方言、口音及多語種語音 ASR 模型家族,具備 FunASR、vLLM、串流與 llama.cpp 執行階段。

    1,512+0近 7 天星數變化
  • minutes@silverstein

    每一個會議、每一個想法、每一則語音備忘錄,都能透過你的 AI 進行搜尋。開源、隱私優先的對話記憶層。

    1,462+0近 7 天星數變化
  • 多後端 whisper 應用程式。極速執行。針對 Mac-arm 最佳化。安裝簡單。輸入本機檔案或網址,此服務將使用 Whisper AI 進行轉錄。完全私密且免費 🤯🤯🤯

    1,394+0近 7 天星數變化
  • CrisperWhisper@nyrahealth

    可控制的轉錄。逐字(包含每個填補詞、停頓、口吃、聲音)或意圖(說話者想表達的意思,針對可讀性優化),並帶有單詞級別的時間戳記。

    1,371+0近 7 天星數變化
  • book@hardhackerlabs

    「硬地駭客 - 兩個月 $12000 ARR 實踐之路」是由 硬地駭客 團隊編著,本書是關於 Podwise 產品歷程的忠實記錄:內容包含 靈感 - 構建 - 發布 - 成長 - 復盤 五個章節。如果你覺得一個人讀不夠過癮,歡迎加入「硬地駭客」官方知識星球與專家們一起討論!Podwise 的故事才剛剛開始,我們也將在星球持續分享我們的認知,成功可能無法複製,但失敗一定可以借鏡。現在就點擊下方連結加入吧!

    1,370+0近 7 天星數變化
  • 影片音訊生成字幕,生成 srt 檔案。無需申請第三方 API,本地實現音訊轉文字。基於 Transformer 的影片字幕生成框架。A GUI tool for generating subtitle from videos and generating srt files.

    1,179+0近 7 天星數變化
← 返回主題列表