audio-processing
标记 audio-processing 主题、收录中的开源项目,按星标数排序。
- #31★ 1,372+0近 7 天星标变化
- #32
用于生成 AcoustID 所使用的音频指纹的 C 库。
★ 1,362+0近 7 天星标变化 - #33
使用 Python 的数字音频工作站;包含 VST 乐器/效果器、参数自动化、FAUST、JAX、Warp 标记与 JUCE 处理器
★ 1,289+0近 7 天星标变化 - #34
StreamSpeech 是一个用于离线与同步语音识别、语音翻译及语音合成的“一体化”无缝模型。
★ 1,288+0近 7 天星标变化 - #35
FFME:进阶的 WPF MediaElement(基于 FFmpeg)
★ 1,274+0近 7 天星标变化 - #36
一个 ComfyUI 自定义节点集成套件,用于本地多引擎、多语言文本转语音与语音转换。支持:RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(经典与多语言)、F5-TTS、Higgs Audio 2、3 与 VibeVoice,具备无限文本长度、SRT 计时、角色支持及多种音频工具
★ 1,187+0近 7 天星标变化 - #37★ 1,146+0近 7 天星标变化
- #38★ 1,126+0近 7 天星标变化
- #39★ 1,058+1近 7 天星标变化
- #40
.NET 的开源音频指纹识别。纯 C# 编写的高效声学指纹算法。
★ 1,036+0近 7 天星标变化 - #41★ 876+1近 7 天星标变化
- #42
适用于 react-native 的高性能音频引擎
★ 837+2近 7 天星标变化 - #43★ 771+0近 7 天星标变化
- #44
AI 生产力工具 - 免费且开源,提升用户生产力,并保护隐私与数据安全。包含但不限于:内置本地专属 ChatGPT、DeepSeek、Phi、Qwen 等模型,一键批量智能处理图片、视频、音频等。
★ 768-1近 7 天星标变化 - #45
大型语言模型(LLMs)在音频 AI 应用之资源收集
★ 738+0近 7 天星标变化 - #46
高质量专业音频重采样器 / 采样率转换表头档限定(header-only)C++ 库。非常快速,适用于音频重采样与时间序列插值。
★ 736+4近 7 天星标变化 - #47
基于 C++ 的轻量级 YouTube 及其他网络媒体音乐与杂音消除工具,使用 DeepFilterNet 进行音频增强。
★ 721+1近 7 天星标变化 - #48
⏩ 快进句子之间的冗长停顿——以约 1.5 倍的速度观看讲座(浏览器扩展程序)
★ 663+0近 7 天星标变化 - #49
[IJCV 2026] FoleyCrafter:为无声视频赋予生动且同步的音效。AI 拟音大师,给你的无声视频添加生动而且同步的音效 😝
★ 663+0近 7 天星标变化 - #50★ 631+1近 7 天星标变化
- #51★ 578+2近 7 天星标变化
- #52★ 571+1近 7 天星标变化
- #53★ 564+0近 7 天星标变化
- #54
一个统一音频处理与生成的开源项目。
★ 520+4近 7 天星标变化 - #55
适用于 .NET 8+ 的高性能模块化音频与 MIDI 引擎。提供完整的音频生命周期工具组:播放、录制、多轨编辑、专业合成(MPE/SF2)、实时 DSP 与可视化。包含用于 AES-256 加密、声学指纹识别与水印的独特安全套件。支持 SIMD 与 NativeAOT。
★ 511+5近 7 天星标变化 - #56
Android 语音活动检测 (VAD) 库。支持 WebRTC VAD GMM、Silero VAD DNN 与 Yamnet VAD DNN 模型。
★ 506+0近 7 天星标变化 - #57
一款能协助您制作精美视频的非线性剪辑软件。
★ 503+0近 7 天星标变化