voice-cloning
Repositori open source terpantau bertanda voice-cloning, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan voice-cloning di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda voice-cloning.
- #1
Data suara 1 menit pun bisa digunakan untuk melatih model TTS yang bagus! (few-shot voice cloning)
★ 61.476+138Perubahan bintang dalam 7 hari terakhir - #2
Kloning suara dalam 5 detik untuk menghasilkan ucapan arbitrer secara real-time.
★ 60.117-4Perubahan bintang dalam 7 hari terakhir - #3★ 45.985+18Perubahan bintang dalam 7 hari terakhir
- #4
VoxCPM2: TTS tanpa tokenizer untuk pembuatan ucapan multibahasa, desain suara kreatif, dan kloning suara yang realistis
★ 36.595+345Perubahan bintang dalam 7 hari terakhir - #5
Model generasi suara besar multibahasa, menyediakan kemampuan full-stack untuk inferensi, pelatihan, dan penerapan.
★ 23.426+359Perubahan bintang dalam 7 hari terakhir - #6
Hasilkan buku audio dari e-book, kloning suara, & 1158+ bahasa!
★ 20.097+34Perubahan bintang dalam 7 hari terakhir - #7
Pemotongan, penerjemahan, penyelarasan, dan bahkan sulih suara (dubbing) subtitle tingkat Netflix - tim subtitle video AI otomatis sekali klik.
★ 18.339+49Perubahan bintang dalam 7 hari terakhir - #8
VoiceStudio adalah alternatif ElevenLabs sumber terbuka yang sepenuhnya lokal — kloning suara, desain suara, sulih suara video, dikte, transkripsi, & pembuatan buku audio dalam 646 bahasa.
★ 14.835+2.880Perubahan bintang dalam 7 hari terakhir - #9
Gradio WebUI untuk kreator dan pengembang, menampilkan TTS utama (Edge-TTS, kokoro) dan Kloning Suara zero-shot (E2 & F5-TTS, CosyVoice), dengan pemrosesan audio Whisper, unduhan YouTube, isolasi vokal Demucs, dan terjemahan multibahasa.
★ 12.730+54Perubahan bintang dalam 7 hari terakhir - #10
Toolkit Speech yang mudah digunakan mencakup model Self-Supervised Learning, SOTA/Streaming ASR dengan tanda baca, Streaming TTS dengan frontend teks, Sistem Verifikasi Pembicara, End-to-End Speech Translation, dan Keyword Spotting. Pemenang Penghargaan Demo Terbaik NAACL2022.
★ 12.676+5Perubahan bintang dalam 7 hari terakhir - #11
YuE: Model Fondasi Generasi Musik Lagu Penuh Terbuka, mirip dengan Suno.ai tetapi bersifat terbuka
★ 6.416+8Perubahan bintang dalam 7 hari terakhir - #12
Alat lokalisasi video AI sumber terbuka: otomatis mengunduh video YouTube/Bilibili, mengenali dan menerjemahkan subtitle, kloning suara, mencampur trek audio, dan menyematkan subtitle.
★ 5.404+25Perubahan bintang dalam 7 hari terakhir - #13
MOSS‑TTS Family adalah keluarga model pembuatan suara dan ucapan open‑source dari MOSI.AI dan tim OpenMOSS. Dirancang untuk skenario dunia nyata yang sangat akurat, sangat ekspresif, dan kompleks, mencakup ucapan berdurasi panjang yang stabil, dialog multi-pembicara, desain suara/karakter, efek suara lingkungan, dan TTS streaming waktu nyata.
★ 4.058+18Perubahan bintang dalam 7 hari terakhir - #14
Alat konversi suara yang sederhana dan berkualitas tinggi dengan fokus pada kemudahan penggunaan dan performa.
★ 3.674+14Perubahan bintang dalam 7 hari terakhir - #15★ 2.818+1Perubahan bintang dalam 7 hari terakhir
- #16
Mesin inferensi C++ murni yang lengkap untuk model audio, didukung oleh ggml. Mendukung TTS, STT, VAD, konversi suara, pembuatan musik, dan lainnya, dengan performa yang sangat dioptimalkan. Tanpa dependensi Python.
★ 2.214+115Perubahan bintang dalam 7 hari terakhir - #17★ 1.760+3Perubahan bintang dalam 7 hari terakhir
- #18
Server Model Context Protocol (MCP) resmi dari MiniMax yang memungkinkan interaksi dengan API Text to Speech, pembuatan gambar, dan pembuatan video yang canggih.
★ 1.573+2Perubahan bintang dalam 7 hari terakhir - #19
Integrasi ComfyUI yang komprehensif untuk model text-to-speech VibeVoice dari Microsoft, memungkinkan sintesis suara tunggal dan multi-pembicara berkualitas tinggi langsung di dalam alur kerja ComfyUI Anda.
★ 1.555+4Perubahan bintang dalam 7 hari terakhir - #20
Aplikasi Python/Pytorch untuk mensintesis suara manusia dengan mudah
★ 1.440+0Perubahan bintang dalam 7 hari terakhir - #21
Host sendiri model TTS Chatterbox yang kuat. Server ini menawarkan Web UI yang ramah pengguna, endpoint API yang fleksibel (termasuk kompatibel dengan OpenAI), suara prasetel, kloning suara, dan pemrosesan teks skala buku audio besar. Berjalan dipercepat di NVIDIA (CUDA), AMD (ROCm), dan CPU.
★ 1.427+1Perubahan bintang dalam 7 hari terakhir - #22
💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya
★ 1.399+0Perubahan bintang dalam 7 hari terakhir - #23
Generator Podcast AI untuk episode bilingual, Multi Bahasa, Alternatif untuk NotebookLLM; Generator podcast AI percakapan manusia, multi-bahasa, multi-suara
★ 1.289-1Perubahan bintang dalam 7 hari terakhir - #24
Antarmuka web (webui) untuk berbagai Jaringan Saraf Tiruan terkait audio
★ 1.246+0Perubahan bintang dalam 7 hari terakhir - #25
Model Text-to-Speech berbasis Flow Matching dengan Kontrol Gaya berbasis Emoji
★ 1.228+4Perubahan bintang dalam 7 hari terakhir - #26
Integrasi node kustom ComfyUI untuk Text-to-Speech dan Konversi Suara multi-mesin multi-bahasa lokal. Mendukung: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (klasik dan multilingual), F5-TTS, Higgs Audio 2, 3, dan VibeVoice dengan panjang teks tak terbatas, penentuan waktu SRT, dukungan Karakter, dan banyak alat audio
★ 1.187+7Perubahan bintang dalam 7 hari terakhir - #27
Server inferensi LLM native untuk Apple Silicon. Kompatibel dengan API OpenAI + Anthropic. Tanpa Python. Termasuk aplikasi macOS MLX Core dengan obrolan, mode agen, dan pemanggilan alat.
★ 1.115+245Perubahan bintang dalam 7 hari terakhir - #28
Generator buku audio multi-suara berbasis AI — anotasi skrip LLM, kloning suara, desain suara, pelatihan LoRA, kontrol gaya per baris, dan ekspor ke MP3, M4B dengan bab, atau multi-track Audacity. Dibangun di atas Qwen3-TTS.
★ 999+17Perubahan bintang dalam 7 hari terakhir - #29
Model pengeditan audio Reinforcement Learning berbasis LLM dengan 3B parameter yang kuat, unggul dalam mengedit emosi, gaya bicara, dan paralinguistik, serta dilengkapi teks-ke-suara zero-shot yang tangguh
★ 972+1Perubahan bintang dalam 7 hari terakhir - #30
Engine Text-to-Speech (TTS) Android ringan dan luring yang memungkinkan kloning suara seluruh sistem yang mulus dan pembacaan teks berketepatan tinggi.
★ 803+2Perubahan bintang dalam 7 hari terakhir