audio-processing
Erfasste Open-Source-Repos mit dem Tag audio-processing, sortiert nach Sternen.
- #31
Hochwertiges, trainingsfreies Inpainting für jedes Stable Diffusion-Modell. Unterstützt ComfyUI
★ 1.372+0Sterne-Änderung der letzten 7 Tage - #32
C-Bibliothek zum Generieren von Audio-Fingerprints für AcoustID
★ 1.362+0Sterne-Änderung der letzten 7 Tage - #33
Digitale Audio-Workstation mit Python; VST-Instrumente/-Effekte, Parameterautomatisierung, FAUST, JAX, Warp-Marker und JUCE-Prozessoren
★ 1.289+0Sterne-Änderung der letzten 7 Tage - #34
StreamSpeech ist ein All-in-One-Modell für nahtlose Offline- und Simultanspracherkennung, -sprachübersetzung und -sprachsynthese.
★ 1.288+0Sterne-Änderung der letzten 7 Tage - #35
FFME: Das erweiterte WPF MediaElement (basierend auf FFmpeg)
★ 1.274+0Sterne-Änderung der letzten 7 Tage - #36
Eine ComfyUI-Custom-Node-Integration für lokales Multi-Engine- und Multi-Language-Text-to-Speech sowie Voice Conversion. Unterstützt: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (klassisch und multilingual), F5-TTS, Higgs Audio 2, 3 und VibeVoice mit unbegrenzter Textlänge, SRT-Timing, Charakter-Unterstützung und vielen Audiowerkzeugen
★ 1.187+0Sterne-Änderung der letzten 7 Tage - #37★ 1.146+0Sterne-Änderung der letzten 7 Tage
- #38★ 1.126+0Sterne-Änderung der letzten 7 Tage
- #39
Ein Framework für Sprach-, Audio-, Musik- und Textverarbeitung mit Large Language Models
★ 1.058+1Sterne-Änderung der letzten 7 Tage - #40
Open-Source-Audio-Fingerprinting in .NET. Ein effizienter Algorithmus für akustisches Fingerprinting, rein in C# geschrieben.
★ 1.036+0Sterne-Änderung der letzten 7 Tage - #41★ 876+1Sterne-Änderung der letzten 7 Tage
- #42
Leistungsstarke Audio-Engine für react-native
★ 837+2Sterne-Änderung der letzten 7 Tage - #43★ 771+0Sterne-Änderung der letzten 7 Tage
- #44
KI-Produktivitätstool – Kostenlos und Open Source, verbessert die Benutzerproduktivität und schützt Privatsphäre sowie Datensicherheit. Beinhaltet unter anderem: integrierte lokale exklusive ChatGPT-, DeepSeek-, Phi-, Qwen- und andere Modelle, KI-gestützte Stapelverarbeitung von Bildern, Videos, Audio usw. mit nur einem Klick.
★ 768-1Sterne-Änderung der letzten 7 Tage - #45
Sammlung von Ressourcen zu Anwendungen von Large Language Models (LLMs) in der Audio-KI.
★ 738+0Sterne-Änderung der letzten 7 Tage - #46
Hochwertiger, header-only C++ Resampler für Profi-Audio / Abtastratenkonvertierung. Sehr schnell, sowohl für Audio-Resampling als auch für Zeitreiheninterpolation.
★ 736+4Sterne-Änderung der letzten 7 Tage - #47
Ein C++-basierter, leichtgewichtiger Musik- und Rauschentferner für YouTube und andere Internetmedien, der DeepFilterNet zur Audioverbesserung nutzt.
★ 721+1Sterne-Änderung der letzten 7 Tage - #48
⏩ Überspringt lange Pausen zwischen Sätzen automatisch – Vorlesungen ca. 1,5x schneller ansehen (Browser-Erweiterung)
★ 663+0Sterne-Änderung der letzten 7 Tage - #49
[IJCV 2026] FoleyCrafter: Erwecken Sie stumme Videos mit lebensechten und synchronisierten Klängen zum Leben
★ 663+0Sterne-Änderung der letzten 7 Tage - #50
PESQ-Wrapper (Perceptual Evaluation of Speech Quality) für Python-Nutzer (Schmalband und Breitband)
★ 631+1Sterne-Änderung der letzten 7 Tage - #51
Checkrr durchsucht Ihre Bibliotheksdateien nach beschädigten Medien und ersetzt diese optional über sonarr und radarr.
★ 578+2Sterne-Änderung der letzten 7 Tage - #52★ 571+1Sterne-Änderung der letzten 7 Tage
- #53
Erstellung von VST2-, VST3-, AU-, AAX-, CLAP-, LV2- und FLP-Plugins für Linux, macOS und Windows mit D
★ 564+0Sterne-Änderung der letzten 7 Tage - #54
Ein Open-Source-Projekt zur Vereinheitlichung von Audioverarbeitung und -generierung
★ 520+4Sterne-Änderung der letzten 7 Tage - #55
Eine hochperformante, modulare Audio- & MIDI-Engine für .NET 8+. Ein vollständiges Toolkit für den gesamten Audio-Lebenszyklus: Wiedergabe, Aufnahme, Mehrspur-Bearbeitung, professionelle Synthese (MPE/SF2), Echtzeit-DSP und Visualisierung. Enthält eine Sicherheits-Suite für AES-256-Verschlüsselung, akustisches Fingerprinting und Wasserzeichen. Mit SIMD- und NativeAOT-Unterstützung.
★ 511+5Sterne-Änderung der letzten 7 Tage - #56
Android-Bibliothek für Voice Activity Detection (VAD). Unterstützt WebRTC VAD GMM, Silero VAD DNN und Yamnet VAD DNN Modelle.
★ 506+0Sterne-Änderung der letzten 7 Tage - #57
Eine nicht-lineare Videobearbeitungssoftware zur Erstellung hochwertiger Videos.
★ 503+0Sterne-Änderung der letzten 7 Tage