audio-processing
Repositorios de código abierto monitorizados etiquetados con audio-processing, ordenados por estrellas.
- #31
Inpainting de alta calidad sin entrenamiento para cualquier modelo de Stable Diffusion. Compatible con ComfyUI
★ 1372+0Variación de estrellas de los últimos 7 días - #32
Biblioteca en C para generar huellas digitales de audio utilizadas por AcoustID
★ 1362+0Variación de estrellas de los últimos 7 días - #33
Estación de trabajo de audio digital con Python; instrumentos/efectos VST, automatización de parámetros, FAUST, JAX, marcadores de deformación y procesadores JUCE.
★ 1289+0Variación de estrellas de los últimos 7 días - #34
StreamSpeech es un modelo integrado "Todo en uno" para el reconocimiento, traducción y síntesis de voz tanto fuera de línea como simultáneos.
★ 1288+0Variación de estrellas de los últimos 7 días - #35
FFME: El MediaElement avanzado de WPF (basado en FFmpeg).
★ 1274+0Variación de estrellas de los últimos 7 días - #36
Una integración de nodos personalizados para ComfyUI que permite el uso local de motores de conversión de texto a voz y voz a voz en múltiples idiomas. Soporta: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (clásico y multilingüe), F5-TTS, Higgs Audio 2, 3 y VibeVoice, con longitud de texto ilimitada, temporización SRT, soporte de personajes y diversas herramientas de audio.
★ 1187+0Variación de estrellas de los últimos 7 días - #37★ 1146+0Variación de estrellas de los últimos 7 días
- #38★ 1126+0Variación de estrellas de los últimos 7 días
- #39
Un framework para procesamiento de voz, lenguaje, audio y música con modelos de lenguaje grandes
★ 1058+1Variación de estrellas de los últimos 7 días - #40
Huella digital de audio de código abierto en .NET. Un algoritmo eficiente para huellas acústicas escrito puramente en C#.
★ 1036+0Variación de estrellas de los últimos 7 días - #41★ 876+1Variación de estrellas de los últimos 7 días
- #42
Motor de audio de alto rendimiento para react-native.
★ 837+2Variación de estrellas de los últimos 7 días - #43★ 771+0Variación de estrellas de los últimos 7 días
- #44
Herramienta de productividad con IA: gratuita y de código abierto, diseñada para mejorar la productividad del usuario y proteger la privacidad y la seguridad de los datos. Incluye, entre otros: modelos locales exclusivos integrados como ChatGPT, DeepSeek, Phi, Qwen y otros, además de procesamiento inteligente por lotes con un solo clic para imágenes, videos, audio, etc.
★ 768-1Variación de estrellas de los últimos 7 días - #45
Colección de recursos sobre las aplicaciones de modelos de lenguaje (LLM) en IA de audio.
★ 738+0Variación de estrellas de los últimos 7 días - #46
Biblioteca C++ de solo cabecera para remuestreo de audio profesional de alta calidad y conversión de frecuencia de muestreo. Muy rápida, tanto para remuestreo de audio como para interpolación de series temporales.
★ 736+4Variación de estrellas de los últimos 7 días - #47
Eliminador de música y ruido ligero basado en C++ para YouTube y otros medios de internet, que utiliza DeepFilterNet para la mejora de audio.
★ 721+1Variación de estrellas de los últimos 7 días - #48
⏩ Adelanta las pausas largas entre frases: mira conferencias ~1.5 veces más rápido (extensión de navegador).
★ 663+0Variación de estrellas de los últimos 7 días - #49
[IJCV 2026] FoleyCrafter: Da vida a videos mudos con sonidos realistas y sincronizados.
★ 663+0Variación de estrellas de los últimos 7 días - #50
Wrapper de PESQ (Perceptual Evaluation of Speech Quality) para usuarios de Python (banda estrecha y banda ancha)
★ 631+1Variación de estrellas de los últimos 7 días - #51
Checkrr escanea los archivos de tu biblioteca en busca de archivos multimedia corruptos y, opcionalmente, los reemplaza a través de sonarr y radarr
★ 578+2Variación de estrellas de los últimos 7 días - #52
Diferentes implementaciones de "Weighted Prediction Error" para la desreverberación de voz
★ 571+1Variación de estrellas de los últimos 7 días - #53
Crea complementos VST2 / VST3 / AU / AAX / CLAP / LV2 / FLP para Linux/macOS/Windows usando D.
★ 564+0Variación de estrellas de los últimos 7 días - #54
Un proyecto de código abierto para unificar el procesamiento y la generación de audio.
★ 520+4Variación de estrellas de los últimos 7 días - #55
Motor de audio y MIDI modular de alto rendimiento para .NET 8+. Un kit de herramientas completo para el ciclo de vida del audio: reproducción, grabación, edición multipista, síntesis profesional (MPE/SF2), DSP en tiempo real y visualización. Incluye una suite de seguridad única para cifrado AES-256, huella acústica y marca de agua. Cuenta con soporte para SIMD y NativeAOT.
★ 511+5Variación de estrellas de los últimos 7 días - #56
Biblioteca de detección de actividad de voz (VAD) para Android. Soporta modelos WebRTC VAD GMM, Silero VAD DNN y Yamnet VAD DNN.
★ 506+0Variación de estrellas de los últimos 7 días - #57
Un software de edición no lineal que ayuda a crear videos de alta calidad
★ 503+0Variación de estrellas de los últimos 7 días