主題 · speech
speech
標記 speech 主題、收錄中的開源專案,依星數排序。
共 74 個專案
- #61
🐸 TTS 論文集
★ 734+1近 7 天星數變化 - #62
Pytorch實現的流式與非流式的自動語音識別框架,同時兼容在線和離線識別,目前支持Conformer、Squeezeformer、DeepSpeech2模型,支持多種數據增強方法。
★ 727+0近 7 天星數變化 - #63★ 716+0近 7 天星數變化
- #64
基於 PyTorch-Lightning 與 Hydra 的端對端語音辨識開源工具包。
★ 714+0近 7 天星數變化 - #65★ 693+0近 7 天星數變化
- #66
使用 Chatterbox 的本地、相容 OpenAI 的文字轉語音 (TTS) API,讓使用者能在任何使用 OpenAI API 的地方產生語音複製內容(例如 Open WebUI、AnythingLLM 等)
★ 677+1近 7 天星數變化 - #67
MOSS-Audio 是一個用於統一語音理解的開源基礎模型,在真實世界場景中支援語音、聲音、音樂、標題生成、問答與推理。
★ 657+3近 7 天星數變化 - #68★ 638+0近 7 天星數變化
- #69
語音方向實驗室、公司、資源、實習等資訊,歡迎推薦或自薦
★ 610+0近 7 天星數變化 - #70
公開的房間脈衝響應資料集列表及下載腳本
★ 609+3近 7 天星數變化 - #71
SpeechIO Leaderboard:一個大型、穩健且全面的自動語音識別基準測試平台。
★ 553+0近 7 天星數變化 - #72★ 539+0近 7 天星數變化
- #73★ 524+1近 7 天星數變化
- #74
StarGANv2-VC:一個用於自然語音轉換的多樣化、非監督式、非平行框架。
★ 522+0近 7 天星數變化