Saltar al contenido principal
buildradar
Iniciar sesión
Tema · audio-processing

audio-processing

Repositorios de código abierto monitorizados etiquetados con audio-processing, ordenados por estrellas.

57 repositorios
  • LanPaint@scraed

    Inpainting de alta calidad sin entrenamiento para cualquier modelo de Stable Diffusion. Compatible con ComfyUI

    1372+0Variación de estrellas de los últimos 7 días
  • chromaprint@acoustid

    Biblioteca en C para generar huellas digitales de audio utilizadas por AcoustID

    1362+0Variación de estrellas de los últimos 7 días
  • DawDreamer@DBraun

    Estación de trabajo de audio digital con Python; instrumentos/efectos VST, automatización de parámetros, FAUST, JAX, marcadores de deformación y procesadores JUCE.

    1289+0Variación de estrellas de los últimos 7 días
  • StreamSpeech@ictnlp

    StreamSpeech es un modelo integrado "Todo en uno" para el reconocimiento, traducción y síntesis de voz tanto fuera de línea como simultáneos.

    1288+0Variación de estrellas de los últimos 7 días
  • ffmediaelement@unosquare

    FFME: El MediaElement avanzado de WPF (basado en FFmpeg).

    1274+0Variación de estrellas de los últimos 7 días
  • TTS-Audio-Suite@diodiogod

    Una integración de nodos personalizados para ComfyUI que permite el uso local de motores de conversión de texto a voz y voz a voz en múltiples idiomas. Soporta: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (clásico y multilingüe), F5-TTS, Higgs Audio 2, 3 y VibeVoice, con longitud de texto ilimitada, temporización SRT, soporte de personajes y diversas herramientas de audio.

    1187+0Variación de estrellas de los últimos 7 días
  • audino@midas-research

    Herramienta de código abierto para la anotación de audio

    1146+0Variación de estrellas de los últimos 7 días
  • nnAudio@KinWaiCheuk

    Procesamiento de audio mediante redes de convolución 1D de PyTorch.

    1126+0Variación de estrellas de los últimos 7 días
  • SLAM-LLM@X-LANCE

    Un framework para procesamiento de voz, lenguaje, audio y música con modelos de lenguaje grandes

    1058+1Variación de estrellas de los últimos 7 días
  • Huella digital de audio de código abierto en .NET. Un algoritmo eficiente para huellas acústicas escrito puramente en C#.

    1036+0Variación de estrellas de los últimos 7 días
  • klio@spotify

    Canalizaciones de datos más inteligentes para audio.

    876+1Variación de estrellas de los últimos 7 días
  • react-native-audio-api@software-mansion

    Motor de audio de alto rendimiento para react-native.

    837+2Variación de estrellas de los últimos 7 días
  • XR3Player@goxr3plus

    El reproductor multimedia JavaFX más avanzado

    771+0Variación de estrellas de los últimos 7 días
  • APT@rnchg

    Herramienta de productividad con IA: gratuita y de código abierto, diseñada para mejorar la productividad del usuario y proteger la privacidad y la seguridad de los datos. Incluye, entre otros: modelos locales exclusivos integrados como ChatGPT, DeepSeek, Phi, Qwen y otros, además de procesamiento inteligente por lotes con un solo clic para imágenes, videos, audio, etc.

    768-1Variación de estrellas de los últimos 7 días
  • Colección de recursos sobre las aplicaciones de modelos de lenguaje (LLM) en IA de audio.

    738+0Variación de estrellas de los últimos 7 días
  • Biblioteca C++ de solo cabecera para remuestreo de audio profesional de alta calidad y conversión de frecuencia de muestreo. Muy rápida, tanto para remuestreo de audio como para interpolación de series temporales.

    736+4Variación de estrellas de los últimos 7 días
  • fast-music-remover@omeryusufyagci

    Eliminador de música y ruido ligero basado en C++ para YouTube y otros medios de internet, que utiliza DeepFilterNet para la mejora de audio.

    721+1Variación de estrellas de los últimos 7 días
  • jumpcutter@WofWca

    ⏩ Adelanta las pausas largas entre frases: mira conferencias ~1.5 veces más rápido (extensión de navegador).

    663+0Variación de estrellas de los últimos 7 días
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter: Da vida a videos mudos con sonidos realistas y sincronizados.

    663+0Variación de estrellas de los últimos 7 días
  • PESQ@ludlows

    Wrapper de PESQ (Perceptual Evaluation of Speech Quality) para usuarios de Python (banda estrecha y banda ancha)

    631+1Variación de estrellas de los últimos 7 días
  • checkrr@aetaric

    Checkrr escanea los archivos de tu biblioteca en busca de archivos multimedia corruptos y, opcionalmente, los reemplaza a través de sonarr y radarr

    578+2Variación de estrellas de los últimos 7 días
  • nara_wpe@fgnt

    Diferentes implementaciones de "Weighted Prediction Error" para la desreverberación de voz

    571+1Variación de estrellas de los últimos 7 días
  • Dplug@AuburnSounds

    Crea complementos VST2 / VST3 / AU / AAX / CLAP / LV2 / FLP para Linux/macOS/Windows usando D.

    564+0Variación de estrellas de los últimos 7 días
  • unified-audio@alibaba

    Un proyecto de código abierto para unificar el procesamiento y la generación de audio.

    520+4Variación de estrellas de los últimos 7 días
  • SoundFlow@LSXPrime

    Motor de audio y MIDI modular de alto rendimiento para .NET 8+. Un kit de herramientas completo para el ciclo de vida del audio: reproducción, grabación, edición multipista, síntesis profesional (MPE/SF2), DSP en tiempo real y visualización. Incluye una suite de seguridad única para cifrado AES-256, huella acústica y marca de agua. Cuenta con soporte para SIMD y NativeAOT.

    511+5Variación de estrellas de los últimos 7 días
  • android-vad@gkonovalov

    Biblioteca de detección de actividad de voz (VAD) para Android. Soporta modelos WebRTC VAD GMM, Silero VAD DNN y Yamnet VAD DNN.

    506+0Variación de estrellas de los últimos 7 días
  • MediaEditor@opencodewin

    Un software de edición no lineal que ayuda a crear videos de alta calidad

    503+0Variación de estrellas de los últimos 7 días
← Volver a temas