audio-processing
Repositori open source terpantau bertanda audio-processing, diurutkan berdasarkan bintang.
- #31
Inpainting gratis pelatihan berkualitas tinggi untuk setiap model stable diffusion. Mendukung ComfyUI
★ 1.372+0Perubahan bintang dalam 7 hari terakhir - #32
Pustaka C untuk menghasilkan sidik jari audio yang digunakan oleh AcoustID
★ 1.362+0Perubahan bintang dalam 7 hari terakhir - #33
Digital Audio Workstation dengan Python; instrumen/efek VST, otomatisasi parameter, FAUST, JAX, Warp Markers, dan prosesor JUCE
★ 1.289+0Perubahan bintang dalam 7 hari terakhir - #34
StreamSpeech adalah model "All in One" yang mulus untuk pengenalan suara offline dan simultan, terjemahan suara, serta sintesis suara.
★ 1.288+0Perubahan bintang dalam 7 hari terakhir - #35
FFME: WPF MediaElement Tingkat Lanjut (berbasis FFmpeg)
★ 1.274+0Perubahan bintang dalam 7 hari terakhir - #36
Integrasi node kustom ComfyUI untuk Text-to-Speech dan Konversi Suara multi-mesin multi-bahasa lokal. Mendukung: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (klasik dan multilingual), F5-TTS, Higgs Audio 2, 3, dan VibeVoice dengan panjang teks tak terbatas, penentuan waktu SRT, dukungan Karakter, dan banyak alat audio
★ 1.187+0Perubahan bintang dalam 7 hari terakhir - #37★ 1.146+0Perubahan bintang dalam 7 hari terakhir
- #38★ 1.126+0Perubahan bintang dalam 7 hari terakhir
- #39
Kerangka kerja untuk Pemrosesan Ucapan, Bahasa, Audio, dan Musik dengan Large Language Model.
★ 1.058+1Perubahan bintang dalam 7 hari terakhir - #40
Sidik jari audio open source di .NET. Algoritma efisien untuk sidik jari akustik yang ditulis murni dalam C#.
★ 1.036+0Perubahan bintang dalam 7 hari terakhir - #41★ 876+1Perubahan bintang dalam 7 hari terakhir
- #42
Engine audio berkinerja tinggi untuk react-native
★ 837+2Perubahan bintang dalam 7 hari terakhir - #43★ 771+0Perubahan bintang dalam 7 hari terakhir
- #44
Alat Produktivitas AI - Gratis dan sumber terbuka, meningkatkan produktivitas pengguna, serta melindungi privasi dan keamanan data. Mencakup namun tidak terbatas pada: ChatGPT lokal eksklusif bawaan, DeepSeek, Phi, Qwen, dan model lainnya, pemrosesan cerdas batch satu klik untuk gambar, video, audio, dll.
★ 768-1Perubahan bintang dalam 7 hari terakhir - #45
Kumpulan sumber daya tentang penerapan Large Language Models (LLMs) dalam Audio AI.
★ 738+0Perubahan bintang dalam 7 hari terakhir - #46
Perpustakaan C++ header-only resampler audio profesional / konversi sample rate berkualitas tinggi. Sangat cepat, untuk resampling audio dan interpolasi deret waktu.
★ 736+4Perubahan bintang dalam 7 hari terakhir - #47
Penghapus musik dan kebisingan berbasis C++ yang ringan untuk YouTube dan media internet lainnya, menggunakan DeepFilterNet untuk peningkatan audio.
★ 721+1Perubahan bintang dalam 7 hari terakhir - #48
⏩ Melewati jeda panjang antar kalimat — tonton kuliah ~1.5x lebih cepat (ekstensi browser)
★ 663+0Perubahan bintang dalam 7 hari terakhir - #49
[IJCV 2026] FoleyCrafter: Hidupkan Video Bisu dengan Suara yang Realistis dan Sinkron.
★ 663+0Perubahan bintang dalam 7 hari terakhir - #50
Pembungkus PESQ (Perceptual Evaluation of Speech Quality) untuk Pengguna Python (pita sempit dan pita lebar)
★ 631+1Perubahan bintang dalam 7 hari terakhir - #51
Checkrr Memindai file pustaka Anda untuk media yang rusak dan secara opsional mengganti file melalui sonarr dan radarr
★ 578+2Perubahan bintang dalam 7 hari terakhir - #52★ 571+1Perubahan bintang dalam 7 hari terakhir
- #53
Membuat plugin VST2 / VST3 / AU / AAX / CLAP / LV2 / FLP untuk Linux/macOS/Windows, menggunakan D.
★ 564+0Perubahan bintang dalam 7 hari terakhir - #54
Proyek Sumber Terbuka untuk Menyatukan Pemrosesan dan Pembuatan Audio
★ 520+4Perubahan bintang dalam 7 hari terakhir - #55
Mesin audio & MIDI modular berkinerja tinggi untuk .NET 8+. Toolkit lengkap untuk seluruh siklus hidup audio: Pemutaran, Perekaman, Pengeditan Multi-track, Sintesis Pro (MPE/SF2), DSP Waktu Nyata, dan Visualisasi. Mencakup rangkaian keamanan unik untuk enkripsi AES-256, sidik jari akustik, dan watermark. Dilengkapi dengan dukungan SIMD dan NativeAOT.
★ 511+5Perubahan bintang dalam 7 hari terakhir - #56
Pustaka Android Voice Activity Detection (VAD). Mendukung model WebRTC VAD GMM, Silero VAD DNN, Yamnet VAD DNN.
★ 506+0Perubahan bintang dalam 7 hari terakhir - #57
Perangkat lunak penyuntingan non-linear yang membantu Anda membuat video yang menarik.
★ 503+0Perubahan bintang dalam 7 hari terakhir