audio-processing
Repositórios de código aberto acompanhados marcados com audio-processing, ordenados por estrelas.
- #31
Inpainting de alta qualidade sem necessidade de treinamento para qualquer modelo de Stable Diffusion. Suporta ComfyUI.
★ 1.372+0Variação de estrelas nos últimos 7 dias - #32
Biblioteca C para gerar impressões digitais de áudio usadas pelo AcoustID.
★ 1.362+0Variação de estrelas nos últimos 7 dias - #33
Estação de trabalho de áudio digital (DAW) com Python; inclui instrumentos/efeitos VST, automação de parâmetros, FAUST, JAX, Warp Markers e processadores JUCE.
★ 1.289+0Variação de estrelas nos últimos 7 dias - #34
StreamSpeech é um modelo "tudo em um" contínuo para reconhecimento, tradução e síntese de fala offline e simultânea.
★ 1.288+0Variação de estrelas nos últimos 7 dias - #35
FFME: O MediaElement avançado para WPF (baseado em FFmpeg).
★ 1.274+0Variação de estrelas nos últimos 7 dias - #36
Uma integração de nó personalizado do ComfyUI para conversão de texto em fala e voz local com múltiplos motores e idiomas. Suporta: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (clássico e multilíngue), F5-TTS, Higgs Audio 2, 3 e VibeVoice com comprimento de texto ilimitado, temporização SRT, suporte a personagens e muitas ferramentas de áudio
★ 1.187+0Variação de estrelas nos últimos 7 dias - #37★ 1.146+0Variação de estrelas nos últimos 7 dias
- #38★ 1.126+0Variação de estrelas nos últimos 7 dias
- #39
Um framework para processamento de fala, linguagem, áudio e música com Large Language Model
★ 1.058+1Variação de estrelas nos últimos 7 dias - #40
Fingerprinting de áudio de código aberto em .NET. Um algoritmo eficiente para fingerprinting acústico escrito puramente em C#.
★ 1.036+0Variação de estrelas nos últimos 7 dias - #41★ 876+1Variação de estrelas nos últimos 7 dias
- #42
Motor de áudio de alto desempenho para react-native
★ 837+2Variação de estrelas nos últimos 7 dias - #43★ 771+0Variação de estrelas nos últimos 7 dias
- #44
Ferramenta de produtividade de IA - Gratuita e de código aberto, melhora a produtividade do usuário e protege a privacidade e a segurança dos dados. Incluindo, mas não limitado a: modelos locais integrados como ChatGPT, DeepSeek, Phi, Qwen e outros, processamento inteligente em lote com um clique de imagens, vídeos, áudio, etc.
★ 768-1Variação de estrelas nos últimos 7 dias - #45
Coleção de recursos sobre as aplicações de Modelos de Linguagem Grande (LLMs) em Áudio AI.
★ 738+0Variação de estrelas nos últimos 7 dias - #46
Biblioteca C++ header-only de conversão de taxa de amostragem / reamostrador de áudio profissional de alta qualidade. Muito rápida, tanto para reamostragem de áudio quanto para interpolação de séries temporais.
★ 736+4Variação de estrelas nos últimos 7 dias - #47
Um removedor de ruído e música leve baseado em C++ para o YouTube e outras mídias de internet, usando DeepFilterNet para aprimoramento de áudio.
★ 721+1Variação de estrelas nos últimos 7 dias - #48
⏩ Avança rapidamente pausas longas entre frases — assista a palestras ~1.5x mais rápido (extensão de navegador)
★ 663+0Variação de estrelas nos últimos 7 dias - #49
[IJCV 2026] FoleyCrafter: Dê vida a vídeos silenciosos com sons realistas e sincronizados. Mestre de Foley por IA, adicione efeitos sonoros vívidos e sincronizados aos seus vídeos silenciosos 😝
★ 663+0Variação de estrelas nos últimos 7 dias - #50
Wrapper PESQ (Perceptual Evaluation of Speech Quality) para usuários de Python (banda estreita e banda larga)
★ 631+1Variação de estrelas nos últimos 7 dias - #51
O Checkrr verifica seus arquivos de biblioteca em busca de mídia corrompida e opcionalmente substitui os arquivos via sonarr e radarr
★ 578+2Variação de estrelas nos últimos 7 dias - #52
Diferentes implementações de "Weighted Prediction Error" para remoção de reverberação de fala
★ 571+1Variação de estrelas nos últimos 7 dias - #53
Crie plugins VST2 / VST3 / AU / AAX / CLAP / LV2 / FLP para Linux/macOS/Windows usando D.
★ 564+0Variação de estrelas nos últimos 7 dias - #54
Um Projeto de Código Aberto para Unificar o Processamento e a Geração de Áudio
★ 520+4Variação de estrelas nos últimos 7 dias - #55
Um mecanismo de áudio e MIDI modular de alto desempenho para .NET 8+. Um kit de ferramentas completo para todo o ciclo de vida do áudio: Reprodução, Gravação, Edição Multitrack, Síntese Profissional (MPE/SF2), DSP em tempo real e Visualização. Inclui um conjunto de segurança exclusivo para criptografia AES-256, impressão digital acústica e marca d'água. Com suporte a SIMD e NativeAOT.
★ 511+5Variação de estrelas nos últimos 7 dias - #56
Biblioteca de Detecção de Atividade de Voz (VAD) para Android. Suporta modelos WebRTC VAD GMM, Silero VAD DNN e Yamnet VAD DNN.
★ 506+0Variação de estrelas nos últimos 7 dias - #57
Um software de edição não linear que ajuda você a criar vídeos bonitos.
★ 503+0Variação de estrelas nos últimos 7 dias