跳到主要内容
buildradar
登录
主题 · audio-processing

audio-processing

标记 audio-processing 主题、收录中的开源项目,按星标数排序。

共 57 个项目
  • LanPaint@scraed

    适用于所有 Stable Diffusion 模型的高质量免训练 Inpaint。支持 ComfyUI

    1,372+0近 7 天星标变化
  • chromaprint@acoustid

    用于生成 AcoustID 所使用的音频指纹的 C 库。

    1,362+0近 7 天星标变化
  • DawDreamer@DBraun

    使用 Python 的数字音频工作站;包含 VST 乐器/效果器、参数自动化、FAUST、JAX、Warp 标记与 JUCE 处理器

    1,289+0近 7 天星标变化
  • StreamSpeech@ictnlp

    StreamSpeech 是一个用于离线与同步语音识别、语音翻译及语音合成的“一体化”无缝模型。

    1,288+0近 7 天星标变化
  • ffmediaelement@unosquare

    FFME:进阶的 WPF MediaElement(基于 FFmpeg)

    1,274+0近 7 天星标变化
  • TTS-Audio-Suite@diodiogod

    一个 ComfyUI 自定义节点集成套件,用于本地多引擎、多语言文本转语音与语音转换。支持:RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(经典与多语言)、F5-TTS、Higgs Audio 2、3 与 VibeVoice,具备无限文本长度、SRT 计时、角色支持及多种音频工具

    1,187+0近 7 天星标变化
  • audino@midas-research

    适用于人类的开源音频标注工具

    1,146+0近 7 天星标变化
  • nnAudio@KinWaiCheuk

    使用 PyTorch 1D 卷积网络进行音频处理

    1,126+0近 7 天星标变化
  • SLAM-LLM@X-LANCE

    结合大型语言模型的语音、语言、音频、音乐处理框架

    1,058+1近 7 天星标变化
  • .NET 的开源音频指纹识别。纯 C# 编写的高效声学指纹算法。

    1,036+0近 7 天星标变化
  • klio@spotify

    更聪明的音频数据管道。

    876+1近 7 天星标变化
  • react-native-audio-api@software-mansion

    适用于 react-native 的高性能音频引擎

    837+2近 7 天星标变化
  • XR3Player@goxr3plus

    🎧 🎼 最先进的 JavaFX 媒体播放器

    771+0近 7 天星标变化
  • APT@rnchg

    AI 生产力工具 - 免费且开源,提升用户生产力,并保护隐私与数据安全。包含但不限于:内置本地专属 ChatGPT、DeepSeek、Phi、Qwen 等模型,一键批量智能处理图片、视频、音频等。

    768-1近 7 天星标变化
  • 大型语言模型(LLMs)在音频 AI 应用之资源收集

    738+0近 7 天星标变化
  • 高质量专业音频重采样器 / 采样率转换表头档限定(header-only)C++ 库。非常快速,适用于音频重采样与时间序列插值。

    736+4近 7 天星标变化
  • fast-music-remover@omeryusufyagci

    基于 C++ 的轻量级 YouTube 及其他网络媒体音乐与杂音消除工具,使用 DeepFilterNet 进行音频增强。

    721+1近 7 天星标变化
  • jumpcutter@WofWca

    ⏩ 快进句子之间的冗长停顿——以约 1.5 倍的速度观看讲座(浏览器扩展程序)

    663+0近 7 天星标变化
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter:为无声视频赋予生动且同步的音效。AI 拟音大师,给你的无声视频添加生动而且同步的音效 😝

    663+0近 7 天星标变化
  • PESQ@ludlows

    适用于 Python 用户的 PESQ(语音质量感知评估)包装器(窄带与宽带)

    631+1近 7 天星标变化
  • checkrr@aetaric

    Checkrr 可扫描你的媒体库文件以检查损坏,并可选择通过 sonarr 与 radarr 进行替换

    578+2近 7 天星标变化
  • nara_wpe@fgnt

    用于语音去混响的“加权预测误差”(Weighted Prediction Error) 不同实现方式

    571+1近 7 天星标变化
  • Dplug@AuburnSounds

    使用 D 语言为 Linux/macOS/Windows 制作 VST2 / VST3 / AU / AAX / CLAP / LV2 / FLP 插件

    564+0近 7 天星标变化
  • unified-audio@alibaba

    一个统一音频处理与生成的开源项目。

    520+4近 7 天星标变化
  • SoundFlow@LSXPrime

    适用于 .NET 8+ 的高性能模块化音频与 MIDI 引擎。提供完整的音频生命周期工具组:播放、录制、多轨编辑、专业合成(MPE/SF2)、实时 DSP 与可视化。包含用于 AES-256 加密、声学指纹识别与水印的独特安全套件。支持 SIMD 与 NativeAOT。

    511+5近 7 天星标变化
  • android-vad@gkonovalov

    Android 语音活动检测 (VAD) 库。支持 WebRTC VAD GMM、Silero VAD DNN 与 Yamnet VAD DNN 模型。

    506+0近 7 天星标变化
  • MediaEditor@opencodewin

    一款能协助您制作精美视频的非线性剪辑软件。

    503+0近 7 天星标变化
← 返回主题列表