audio-generation
標記 audio-generation 主題、收錄中的開源專案,依星數排序。
相關主題
常跟 audio-generation 一起出現在同一個專案上的主題。
近期新秀
近 90 天內建立、標記 audio-generation 主題的專案。
- #1
用於圖像、影片、音訊、文字、製作名單與模型探索的 Flatkey 媒體生成 CLI
★ 634
- #1★ 48,749+135近 7 天星數變化
- #2★ 23,067+215近 7 天星數變化
- #3★ 10,275+17近 7 天星數變化
- #4★ 6,457+229近 7 天星數變化
- #5★ 6,408+14近 7 天星數變化
- #6
單一 Gradio + React WebUI,整合 ACE-Step、OmniVoice、Kimi Audio、Piper TTS、GPT-SoVITS、CosyVoice、XTTSv2、DIA、Kokoro、OpenVoice、ParlerTTS、Stable Audio、MMS、StyleTTS2、MAGNet、AudioGen、MusicGen、Tortoise、RVC、Vocos、Demucs、SeamlessM4T 與 Bark 的擴充功能!
★ 3,245+5近 7 天星數變化 - #7★ 2,908+2近 7 天星數變化
- #8★ 2,639+1近 7 天星數變化
- #9
音訊生成最新 AI 模型的時間軸,始於 2023 年!
★ 1,904+0近 7 天星數變化 - #10
在 Pytorch 中實作 Google Deepmind 的 SoundStorm(高效平行音訊生成)
★ 1,547+1近 7 天星數變化 - #11
自架強大的 Chatterbox TTS 模型。此伺服器提供使用者友善的 Web UI、靈活的 API 端點(包含相容 OpenAI)、預定義語音、語音複製,以及大型有聲書規模的文字處理。可在 NVIDIA (CUDA)、AMD (ROCm) 和 CPU 上加速執行。
★ 1,426+12近 7 天星數變化 - #12★ 1,238+0近 7 天星數變化
- #13★ 1,226+0近 7 天星數變化
- #14
一個 ComfyUI 自訂節點整合套件,用於本機多引擎、多語言文字轉語音與語音轉換。支援:RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(經典與多語言)、F5-TTS、Higgs Audio 2、3 與 VibeVoice,具備無限文字長度、SRT 計時、角色支援及多種音訊工具
★ 1,184+9近 7 天星數變化 - #15★ 1,043+1近 7 天星數變化
- #16
SGLang-Omni 為 TTS、ASR、語音與全能模型提供高效能服務。
★ 978+70近 7 天星數變化 - #17
AI 音訊資料集 (AI-ADS) 🎵,包含語音、音樂與音效,可為生成式 AI、AIGC、AI 模型訓練、智慧音訊工具開發及音訊應用程式提供訓練資料。
★ 961+0近 7 天星數變化 - #18
語音 AI 研究中樞:涵蓋語音 LLM、語音識別、TTS、音樂與語音生成的論文、開源模型、基準測試與資料集。
★ 950+0近 7 天星數變化 - #19
即時語音助理 —— WebRTC 串流、faster-whisper ASR、本地 LLM、Vui Nano (300M) TTS。相容 OpenAI Realtime API。支援語音複製、插話打斷,在 4090 上約有 9 倍即時效能。採用 Apache 2.0 授權。
★ 748+0近 7 天星數變化 - #20
用於圖像、影片、音訊、文字、製作名單與模型探索的 Flatkey 媒體生成 CLI
★ 634+89近 7 天星數變化 - #21★ 559-1近 7 天星數變化
- #22
一個統一音訊處理與生成的開源專案。
★ 510+3近 7 天星數變化