跳到主要內容
buildradar
Sign in
主題 · voice-recognition

voice-recognition

標記 voice-recognition 主題、收錄中的開源專案,依星數排序。

專案數
23
總星數
85,588
平均星數
3,721
佔比
0.00%

常跟 voice-recognition 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 voice-recognition 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • vosk-api@alphacep

    支援 Android、iOS、Raspberry Pi 與伺服器的離線語音辨識 API,提供 Python、Java、C# 與 Node 介面

    15,101+17近 7 天星數變化
  • PaddleSpeech@PaddlePaddle

    易用的語音工具包,包含自監督學習模型、SOTA/串流 ASR(含標點)、串流 TTS(含文字前端)、說話者驗證系統、端到端語音翻譯與關鍵詞偵測。榮獲 NAACL2022 最佳示範獎

    12,676+5近 7 天星數變化
  • speechbrain@speechbrain

    基於 PyTorch 的語音工具包

    11,802+10近 7 天星數變化
  • moonshine@moonshine-ai

    極低延遲的語音轉文字、意圖辨識與文字轉語音,適用於構建語音代理與介面

    10,997+33近 7 天星數變化
  • silero-vad@snakers4

    Silero VAD:預訓練的企業級語音活動偵測器

    10,112+29近 7 天星數變化
  • WhisperLive@collabora

    近乎即時的 OpenAI Whisper 實作

    4,246+3近 7 天星數變化
  • cnchar@theajack

    功能全面的漢字工具庫(拼音、筆畫、偏旁、成語、語音、可視化等)(Chinese character util)

    3,087+3近 7 天星數變化
  • STT@coqui-ai

    🐸STT - 用於語音轉文字的深度學習工具組。訓練與部署 STT 模型從未如此簡單。

    2,606+1近 7 天星數變化
  • ten-vad@TEN-framework

    語音活動偵測(VAD):低延遲、高效能且輕量

    2,256+7近 7 天星數變化
  • voice_datasets@jim-schwoebel

    🔊 語音與聲音運算開源資料集的完整清單(95+ 個資料集)。

    2,223+1近 7 天星數變化
  • 💎 適用於 ASR、TTS 及其他語音技術的無障礙語音語料庫清單

    1,399+0近 7 天星數變化
  • 本專案使用多種先進的語音特徵辨識模型,如 EcapaTdnn、ResNetSE、ERes2Net、CAM++ 等,未來不排除支援更多模型。同時,本專案亦支援 MelSpectrogram、Spectrogram 資料前處理方法。

    1,313+1近 7 天星數變化
  • Python AI 助理 🧠

    1,014+0近 7 天星數變化
  • EDDiscovery@EDDiscovery

    Elite Dangerous 的船長日誌與 3D 星圖

    898+2近 7 天星數變化
  • rhino@Picovoice

    由深度學習驅動的裝置端語音意圖(Speech-to-Intent)引擎。

    712+2近 7 天星數變化
  • voicetypr@moinulmoin

    Voicetypr - 專為 macOS、Windows 上的忙碌創辦人、vibe coders 與 AI 高階使用者打造的 AI 離線語音轉文字聽寫工具。是 wispr flow 與 superwhisper 的替代方案。

    709+12近 7 天星數變化
  • 語音轉文字效能評測框架

    697+0近 7 天星數變化
  • 適用於 React Native Expo 專案的語音辨識

    677+5近 7 天星數變化
  • cheetah@Picovoice

    由深度學習驅動的裝置端串流語音轉文字引擎

    671+0近 7 天星數變化
  • sonus@evancohen

    :speech_balloon: /so.nus/ 適用於 Node 的 STT (語音轉文字),具備離線熱詞偵測功能

    638+0近 7 天星數變化
  • LiveTranslate@TheDeathDragon

    即時音訊翻譯,可擷取系統音訊與麥克風,執行 ASR (Whisper/SenseVoice),並透過 LLM API 進行翻譯與串流顯示。適用於 VTuber、直播主與觀看外語內容。

    625+34近 7 天星數變化
  • speech-to-text@reriiasu

    使用 faster-whisper 進行即時語音轉文字。

    614+0近 7 天星數變化
  • 🗣 一個在自訂 UI 中取得使用者語音權限並將輸入轉為文字的覆疊介面

    557+1近 7 天星數變化
← 返回主題列表