跳到主要內容
buildradar
Sign in
主題 · voice-activity-detection

voice-activity-detection

標記 voice-activity-detection 主題、收錄中的開源專案,依星數排序。

專案數
23
總星數
83,655
平均星數
3,637
佔比
0.00%

常跟 voice-activity-detection 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 voice-activity-detection 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • FunASR@modelscope

    開源語音辨識工具包,支援訓練、推論、串流 ASR、VAD、標點、說話者分割流程,並提供相容 OpenAI / MCP 的服務介面

    20,136+64近 7 天星數變化
  • pyannote-audio@pyannote

    用於說話者分割的神經建構模組:語音活動偵測、說話者變換偵測、重疊語音偵測、說話者嵌入

    10,500+16近 7 天星數變化
  • NoiseTorch@noisetorch

    Linux 上的即時麥克風噪音抑制

    10,315+2近 7 天星數變化
  • silero-vad@snakers4

    Silero VAD:預訓練的企業級語音活動偵測器

    10,112+29近 7 天星數變化
  • ffsubsync@smacke

    自動同步字幕與影片。

    7,864+7近 7 天星數變化
  • FluidAudio@FluidInference

    在你的應用程式中使用前沿的 CoreML 音訊模型——文字轉語音、語音轉文字、語音活動偵測與發言者分離。使用 Swift 開發,由 SOTA 開源技術驅動。

    2,723+13近 7 天星數變化
  • pluely@iamsrikanthnani

    Cluely 的開源替代方案 - 一款極速、注重隱私的 AI 助理,能在會議、面試和對話期間無縫運作且不被察覺。使用 Tauri 建構以獲得原生效能,僅 10MB。在視訊通話、畫面分享和錄製中完全無法被偵測。

    2,619+12近 7 天星數變化
  • ten-vad@TEN-framework

    語音活動偵測(VAD):低延遲、高效能且輕量

    2,256+7近 7 天星數變化
  • voice_datasets@jim-schwoebel

    🔊 語音與聲音運算開源資料集的完整清單(95+ 個資料集)。

    2,223+1近 7 天星數變化
  • vad@ricky0123

    具備簡單 API 的瀏覽器語音活動偵測器(VAD)

    2,046+1近 7 天星數變化
  • diart@juanmc2005

    一個用於建構 AI 驅動的即時音訊應用程式的 Python 套件

    2,024+1近 7 天星數變化
  • sherpa-ncnn@k2-fsa

    使用新一代 Kaldi 與 ncnn 在無網路連線下進行即時語音辨識與語音活動檢測(VAD)。支援 iOS、Android、Linux、macOS、Windows、Raspberry Pi、VisionFive2、LicheePi4A 等。

    1,777-1近 7 天星數變化
  • 💎 適用於 ASR、TTS 及其他語音技術的無障礙語音語料庫清單

    1,399+0近 7 天星數變化
  • speech-swift@soniqo

    適用於 Apple Silicon 的 AI 語音工具組 — 由 MLX 與 CoreML 驅動的 ASR、TTS、語音轉語音、VAD 與說話者分段

    1,161+4近 7 天星數變化
  • Python AI 助理 🧠

    1,014+0近 7 天星數變化
  • whisper.net@sandrohanea

    Whisper.net。使用 Whisper Models 輕鬆實現語音轉文字

    941+1近 7 天星數變化
  • inaSpeechSegmenter@ina-foss

    基於 CNN 的音訊分割工具包。可用於偵測語音、音樂、噪音與發話者性別,專為基於各性別發話時間的大規模兩性平等研究而設計。

    910+1近 7 天星數變化
  • auditok@amsehili

    語音活動偵測與音訊分割工具

    860+1近 7 天星數變化
  • FireRedASR2S@FireRedTeam

    一個 SOTA 工業級一體化 ASR 系統,包含 ASR、VAD、LID 與 Punc 模組。FireRedASR2 支援中文(普通話、20+ 種方言/口音)、英文、中英夾雜(code-switching),以及語音和歌唱的 ASR。FireRedVAD 支援 100+ 種語言的語音/歌唱/音樂。FireRedLID 支援 100+ 種語言與 20+ 種中文方言。FireRedPunc 支援中英文。

    673+15近 7 天星數變化
  • WhisperS2T@shashikg

    支援多種推論引擎的 Whisper 模型語音轉文字優化管線。

    578+1近 7 天星數變化
  • FireRedVAD@FireRedTeam

    工業級語音活動偵測與音訊事件偵測技術,支援超過 100 種語言,效能優於 Silero-VAD、TEN-VAD、FunASR-VAD 與 WebRTC-VAD。

    523+7近 7 天星數變化
  • subaligner@baxtree

    使用預訓練 DNN、強制對齊與 Transformer 自動同步與翻譯字幕,或透過轉錄建立新字幕。https://subaligner.readthedocs.io/

    510+0近 7 天星數變化
  • android-vad@gkonovalov

    Android 語音活動檢測 (VAD) 函式庫。支援 WebRTC VAD GMM、Silero VAD DNN 與 Yamnet VAD DNN 模型。

    506+1近 7 天星數變化
← 返回主題列表