Pular para o conteúdo principal
buildradar
Entrar
Tópico · audio-processing

audio-processing

Repositórios de código aberto acompanhados marcados com audio-processing, ordenados por estrelas.

57 repositórios
  • LanPaint@scraed

    Inpainting de alta qualidade sem necessidade de treinamento para qualquer modelo de Stable Diffusion. Suporta ComfyUI.

    1.372+0Variação de estrelas nos últimos 7 dias
  • chromaprint@acoustid

    Biblioteca C para gerar impressões digitais de áudio usadas pelo AcoustID.

    1.362+0Variação de estrelas nos últimos 7 dias
  • DawDreamer@DBraun

    Estação de trabalho de áudio digital (DAW) com Python; inclui instrumentos/efeitos VST, automação de parâmetros, FAUST, JAX, Warp Markers e processadores JUCE.

    1.289+0Variação de estrelas nos últimos 7 dias
  • StreamSpeech@ictnlp

    StreamSpeech é um modelo "tudo em um" contínuo para reconhecimento, tradução e síntese de fala offline e simultânea.

    1.288+0Variação de estrelas nos últimos 7 dias
  • ffmediaelement@unosquare

    FFME: O MediaElement avançado para WPF (baseado em FFmpeg).

    1.274+0Variação de estrelas nos últimos 7 dias
  • TTS-Audio-Suite@diodiogod

    Uma integração de nó personalizado do ComfyUI para conversão de texto em fala e voz local com múltiplos motores e idiomas. Suporta: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (clássico e multilíngue), F5-TTS, Higgs Audio 2, 3 e VibeVoice com comprimento de texto ilimitado, temporização SRT, suporte a personagens e muitas ferramentas de áudio

    1.187+0Variação de estrelas nos últimos 7 dias
  • audino@midas-research

    Ferramenta de anotação de áudio de código aberto para humanos

    1.146+0Variação de estrelas nos últimos 7 dias
  • nnAudio@KinWaiCheuk

    Processamento de áudio usando rede de convolução 1D do PyTorch.

    1.126+0Variação de estrelas nos últimos 7 dias
  • SLAM-LLM@X-LANCE

    Um framework para processamento de fala, linguagem, áudio e música com Large Language Model

    1.058+1Variação de estrelas nos últimos 7 dias
  • Fingerprinting de áudio de código aberto em .NET. Um algoritmo eficiente para fingerprinting acústico escrito puramente em C#.

    1.036+0Variação de estrelas nos últimos 7 dias
  • klio@spotify

    Pipelines de dados mais inteligentes para áudio.

    876+1Variação de estrelas nos últimos 7 dias
  • react-native-audio-api@software-mansion

    Motor de áudio de alto desempenho para react-native

    837+2Variação de estrelas nos últimos 7 dias
  • XR3Player@goxr3plus

    🎧 🎼 O reprodutor de mídia JavaFX MAIS AVANÇADO

    771+0Variação de estrelas nos últimos 7 dias
  • APT@rnchg

    Ferramenta de produtividade de IA - Gratuita e de código aberto, melhora a produtividade do usuário e protege a privacidade e a segurança dos dados. Incluindo, mas não limitado a: modelos locais integrados como ChatGPT, DeepSeek, Phi, Qwen e outros, processamento inteligente em lote com um clique de imagens, vídeos, áudio, etc.

    768-1Variação de estrelas nos últimos 7 dias
  • Coleção de recursos sobre as aplicações de Modelos de Linguagem Grande (LLMs) em Áudio AI.

    738+0Variação de estrelas nos últimos 7 dias
  • Biblioteca C++ header-only de conversão de taxa de amostragem / reamostrador de áudio profissional de alta qualidade. Muito rápida, tanto para reamostragem de áudio quanto para interpolação de séries temporais.

    736+4Variação de estrelas nos últimos 7 dias
  • fast-music-remover@omeryusufyagci

    Um removedor de ruído e música leve baseado em C++ para o YouTube e outras mídias de internet, usando DeepFilterNet para aprimoramento de áudio.

    721+1Variação de estrelas nos últimos 7 dias
  • jumpcutter@WofWca

    ⏩ Avança rapidamente pausas longas entre frases — assista a palestras ~1.5x mais rápido (extensão de navegador)

    663+0Variação de estrelas nos últimos 7 dias
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter: Dê vida a vídeos silenciosos com sons realistas e sincronizados. Mestre de Foley por IA, adicione efeitos sonoros vívidos e sincronizados aos seus vídeos silenciosos 😝

    663+0Variação de estrelas nos últimos 7 dias
  • PESQ@ludlows

    Wrapper PESQ (Perceptual Evaluation of Speech Quality) para usuários de Python (banda estreita e banda larga)

    631+1Variação de estrelas nos últimos 7 dias
  • checkrr@aetaric

    O Checkrr verifica seus arquivos de biblioteca em busca de mídia corrompida e opcionalmente substitui os arquivos via sonarr e radarr

    578+2Variação de estrelas nos últimos 7 dias
  • nara_wpe@fgnt

    Diferentes implementações de "Weighted Prediction Error" para remoção de reverberação de fala

    571+1Variação de estrelas nos últimos 7 dias
  • Dplug@AuburnSounds

    Crie plugins VST2 / VST3 / AU / AAX / CLAP / LV2 / FLP para Linux/macOS/Windows usando D.

    564+0Variação de estrelas nos últimos 7 dias
  • unified-audio@alibaba

    Um Projeto de Código Aberto para Unificar o Processamento e a Geração de Áudio

    520+4Variação de estrelas nos últimos 7 dias
  • SoundFlow@LSXPrime

    Um mecanismo de áudio e MIDI modular de alto desempenho para .NET 8+. Um kit de ferramentas completo para todo o ciclo de vida do áudio: Reprodução, Gravação, Edição Multitrack, Síntese Profissional (MPE/SF2), DSP em tempo real e Visualização. Inclui um conjunto de segurança exclusivo para criptografia AES-256, impressão digital acústica e marca d'água. Com suporte a SIMD e NativeAOT.

    511+5Variação de estrelas nos últimos 7 dias
  • android-vad@gkonovalov

    Biblioteca de Detecção de Atividade de Voz (VAD) para Android. Suporta modelos WebRTC VAD GMM, Silero VAD DNN e Yamnet VAD DNN.

    506+0Variação de estrelas nos últimos 7 dias
  • MediaEditor@opencodewin

    Um software de edição não linear que ajuda você a criar vídeos bonitos.

    503+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos