audio-processing
Dépôts open source suivis étiquetés audio-processing, triés par étoiles.
- #31
Inpainting de haute qualité sans entraînement pour tous les modèles stable diffusion. Supporte ComfyUI.
★ 1 372+0Évolution des étoiles sur les 7 derniers jours - #32
Bibliothèque C pour générer des empreintes audio utilisées par AcoustID
★ 1 362+0Évolution des étoiles sur les 7 derniers jours - #33
Station de travail audio numérique en Python ; instruments/effets VST, automatisation des paramètres, FAUST, JAX, Warp Markers et processeurs JUCE
★ 1 289+0Évolution des étoiles sur les 7 derniers jours - #34
StreamSpeech est un modèle tout-en-un fluide pour la reconnaissance vocale, la traduction et la synthèse vocale, en mode hors ligne et simultané.
★ 1 288+0Évolution des étoiles sur les 7 derniers jours - #35
FFME : Le MediaElement WPF avancé (basé sur FFmpeg)
★ 1 274+0Évolution des étoiles sur les 7 derniers jours - #36
Intégration de nœuds personnalisés pour ComfyUI dédiée à la synthèse vocale (TTS) et à la conversion de voix multi-moteurs et multilingue. Supporte RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox, F5-TTS, Higgs Audio 2, 3 et VibeVoice avec gestion des durées illimitées, timing SRT et outils audio.
★ 1 187+0Évolution des étoiles sur les 7 derniers jours - #37★ 1 146+0Évolution des étoiles sur les 7 derniers jours
- #38★ 1 126+0Évolution des étoiles sur les 7 derniers jours
- #39
Un framework pour le traitement de la parole, du langage, de l'audio et de la musique basé sur des modèles de langage de grande taille.
★ 1 058+1Évolution des étoiles sur les 7 derniers jours - #40
Empreinte audio open source en .NET. Un algorithme efficace pour l'empreinte acoustique écrit entièrement en C#.
★ 1 036+0Évolution des étoiles sur les 7 derniers jours - #41★ 876+1Évolution des étoiles sur les 7 derniers jours
- #42
Moteur audio haute performance pour React Native.
★ 837+2Évolution des étoiles sur les 7 derniers jours - #43★ 771+0Évolution des étoiles sur les 7 derniers jours
- #44
Outil de productivité IA gratuit et open source, conçu pour améliorer la productivité des utilisateurs tout en protégeant la confidentialité et la sécurité des données. Inclut, sans s'y limiter : des modèles locaux intégrés comme ChatGPT, DeepSeek, Phi, Qwen, ainsi que le traitement intelligent par lots en un clic d'images, de vidéos, d'audio, etc.
★ 768-1Évolution des étoiles sur les 7 derniers jours - #45
Collection de ressources sur les applications des grands modèles de langage (LLM) dans l'IA audio.
★ 738+0Évolution des étoiles sur les 7 derniers jours - #46
Bibliothèque C++ header-only de rééchantillonnage audio professionnel de haute qualité. Très rapide, adaptée au rééchantillonnage audio et à l'interpolation de séries temporelles.
★ 736+4Évolution des étoiles sur les 7 derniers jours - #47
Outil C++ léger de suppression de musique et de bruit pour YouTube et autres médias, utilisant DeepFilterNet pour l'amélioration audio.
★ 721+1Évolution des étoiles sur les 7 derniers jours - #48
⏩ Accélère les longues pauses entre les phrases — regardez vos cours environ 1,5x plus vite (extension de navigateur)
★ 663+0Évolution des étoiles sur les 7 derniers jours - #49
[IJCV 2026] FoleyCrafter : Donnez vie aux vidéos silencieuses avec des sons réalistes et synchronisés. AI拟音大师,给你的无声视频添加生动而且同步的音效 😝
★ 663+0Évolution des étoiles sur les 7 derniers jours - #50
Wrapper PESQ (Perceptual Evaluation of Speech Quality) pour les utilisateurs de Python (bande étroite et bande large)
★ 631+1Évolution des étoiles sur les 7 derniers jours - #51
Checkrr analyse les fichiers de votre bibliothèque à la recherche de médias corrompus et remplace optionnellement les fichiers via Sonarr et Radarr
★ 578+2Évolution des étoiles sur les 7 derniers jours - #52
Différentes implémentations de la « Weighted Prediction Error » pour la déverbération de la parole
★ 571+1Évolution des étoiles sur les 7 derniers jours - #53
Créez des plug-ins VST2 / VST3 / AU / AAX / CLAP / LV2 / FLP pour Linux/macOS/Windows, en utilisant D.
★ 564+0Évolution des étoiles sur les 7 derniers jours - #54
Un projet open source pour unifier le traitement et la génération audio
★ 520+4Évolution des étoiles sur les 7 derniers jours - #55
Un moteur audio et MIDI modulaire haute performance pour .NET 8+. Une boîte à outils complète pour l'ensemble du cycle de vie audio : lecture, enregistrement, édition multipiste, synthèse pro (MPE/SF2), DSP en temps réel et visualisation. Inclut une suite de sécurité unique pour le chiffrement AES-256, l'empreinte acoustique et le filigrane. Prend en charge SIMD et NativeAOT.
★ 511+5Évolution des étoiles sur les 7 derniers jours - #56
Bibliothèque de détection d'activité vocale (VAD) pour Android. Supporte les modèles WebRTC VAD GMM, Silero VAD DNN et Yamnet VAD DNN.
★ 506+0Évolution des étoiles sur les 7 derniers jours - #57
A non-linear editing software that helps you to make nice video.
★ 503+0Évolution des étoiles sur les 7 derniers jours