audio-processing
標記 audio-processing 主題、收錄中的開源專案,依星數排序。
- #31★ 1,372+0近 7 天星數變化
- #32
用於產生 AcoustID 所使用的音訊指紋的 C 函式庫。
★ 1,362+0近 7 天星數變化 - #33
使用 Python 的數位音訊工作站;包含 VST 樂器/效果器、參數自動化、FAUST、JAX、Warp 標記與 JUCE 處理器
★ 1,289+0近 7 天星數變化 - #34
StreamSpeech 是一個用於離線與同步語音辨識、語音翻譯及語音合成的「一體化」無縫模型。
★ 1,288+0近 7 天星數變化 - #35
FFME:進階的 WPF MediaElement(基於 FFmpeg)
★ 1,274+0近 7 天星數變化 - #36
一個 ComfyUI 自訂節點整合套件,用於本機多引擎、多語言文字轉語音與語音轉換。支援:RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(經典與多語言)、F5-TTS、Higgs Audio 2、3 與 VibeVoice,具備無限文字長度、SRT 計時、角色支援及多種音訊工具
★ 1,187+0近 7 天星數變化 - #37★ 1,146+0近 7 天星數變化
- #38★ 1,126+0近 7 天星數變化
- #39★ 1,058+1近 7 天星數變化
- #40
.NET 的開源音訊指紋辨識。純 C# 編寫的高效聲學指紋演算法。
★ 1,036+0近 7 天星數變化 - #41★ 876+1近 7 天星數變化
- #42
適用於 react-native 的高效能音訊引擎
★ 837+2近 7 天星數變化 - #43★ 771+0近 7 天星數變化
- #44
AI 生產力工具 - 免費且開源,提升使用者生產力,並保護隱私與資料安全。包含但不限於:內建本機專屬 ChatGPT、DeepSeek、Phi、Qwen 等模型,一鍵批次智慧處理圖片、影片、音訊等。
★ 768-1近 7 天星數變化 - #45
大型語言模型(LLMs)在音訊 AI 應用之資源收集
★ 738+0近 7 天星數變化 - #46
高品質專業音訊重取樣器 / 取樣率轉換表頭檔限定(header-only)C++ 庫。非常快速,適用於音訊重取樣與時間序列插值。
★ 736+4近 7 天星數變化 - #47
基於 C++ 的輕量級 YouTube 及其他網路媒體音樂與雜音消除工具,使用 DeepFilterNet 進行音訊增強。
★ 721+1近 7 天星數變化 - #48
⏩ 快轉句子之間的冗長停頓——以約 1.5 倍的速度觀看講座(瀏覽器擴充功能)
★ 663+0近 7 天星數變化 - #49
[IJCV 2026] FoleyCrafter:為無聲影片賦予生動且同步的音效。AI 擬音大師,給你的無聲影片添加生動而且同步的音效 😝
★ 663+0近 7 天星數變化 - #50★ 631+1近 7 天星數變化
- #51★ 578+2近 7 天星數變化
- #52★ 571+1近 7 天星數變化
- #53★ 564+0近 7 天星數變化
- #54
一個統一音訊處理與生成的開源專案。
★ 520+4近 7 天星數變化 - #55
適用於 .NET 8+ 的高效能模組化音訊與 MIDI 引擎。提供完整的音訊生命週期工具組:播放、錄製、多軌編輯、專業合成(MPE/SF2)、即時 DSP 與視覺化。包含用於 AES-256 加密、聲學指紋識別與浮水印的獨特安全套件。支援 SIMD 與 NativeAOT。
★ 511+5近 7 天星數變化 - #56
Android 語音活動檢測 (VAD) 函式庫。支援 WebRTC VAD GMM、Silero VAD DNN 與 Yamnet VAD DNN 模型。
★ 506+0近 7 天星數變化 - #57
一款能協助您製作精美影片的非線性剪輯軟體。
★ 503+0近 7 天星數變化