speech-synthesis
Repositori open source terpantau bertanda speech-synthesis, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan speech-synthesis di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda speech-synthesis.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1★ 45.985+18Perubahan bintang dalam 7 hari terakhir
- #2
VoxCPM2: TTS tanpa tokenizer untuk pembuatan ucapan multibahasa, desain suara kreatif, dan kloning suara yang realistis
★ 36.595+345Perubahan bintang dalam 7 hari terakhir - #3
Kerangka kerja AI generatif yang skalabel yang dibangun untuk peneliti dan pengembang yang bekerja pada Large Language Models, Multimodal, dan Speech AI (Automatic Speech Recognition dan Text-to-Speech)
★ 18.379+21Perubahan bintang dalam 7 hari terakhir - #4★ 17.476+1Perubahan bintang dalam 7 hari terakhir
- #5
Skrip Deep Learning mutakhir yang diatur berdasarkan model - mudah dilatih dan diterapkan dengan akurasi serta performa yang dapat direproduksi pada infrastruktur kelas perusahaan.
★ 14.846+4Perubahan bintang dalam 7 hari terakhir - #6
TTS multibahasa yang sangat cepat dan berjalan di perangkat — dijalankan secara native melalui ONNX.
★ 13.757+20Perubahan bintang dalam 7 hari terakhir - #7
Membangun agen suara dengan model open-source
★ 13.015+82Perubahan bintang dalam 7 hari terakhir - #8
Gradio WebUI untuk kreator dan pengembang, menampilkan TTS utama (Edge-TTS, kokoro) dan Kloning Suara zero-shot (E2 & F5-TTS, CosyVoice), dengan pemrosesan audio Whisper, unduhan YouTube, isolasi vokal Demucs, dan terjemahan multibahasa.
★ 12.730+54Perubahan bintang dalam 7 hari terakhir - #9
Toolkit Speech yang mudah digunakan mencakup model Self-Supervised Learning, SOTA/Streaming ASR dengan tanda baca, Streaming TTS dengan frontend teks, Sistem Verifikasi Pembicara, End-to-End Speech Translation, dan Keyword Spotting. Pemenang Penghargaan Demo Terbaik NAACL2022.
★ 12.676+5Perubahan bintang dalam 7 hari terakhir - #10
Gunakan layanan text-to-speech daring Microsoft Edge dari Python TANPA memerlukan Microsoft Edge, Windows, atau kunci API
★ 11.847+29Perubahan bintang dalam 7 hari terakhir - #11
Amphion (/æmˈfaɪən/) adalah toolkit untuk Pembuatan Audio, Musik, dan Ucapan. Tujuannya adalah untuk mendukung penelitian yang dapat direproduksi dan membantu para peneliti serta insinyur junior untuk memulai di bidang penelitian dan pengembangan pembuatan audio, musik, dan ucapan.
★ 10.276+1Perubahan bintang dalam 7 hari terakhir - #12★ 9.949+3Perubahan bintang dalam 7 hari terakhir
- #13
Fork so-vits-svc dengan dukungan waktu nyata, antarmuka yang ditingkatkan, dan fitur lainnya.
★ 9.329+3Perubahan bintang dalam 7 hari terakhir - #14
EmotiVoice 😊: Mesin TTS Multi-Suara dan Terkontrol-Prompt
★ 8.522-1Perubahan bintang dalam 7 hari terakhir - #15
Pustaka text-to-speech (TTS), speech-to-text (STT), dan speech-to-speech (STS) yang dibangun di atas framework MLX Apple, menyediakan analisis suara yang efisien di Apple Silicon.
★ 7.826+23Perubahan bintang dalam 7 hari terakhir - #16
eSpeak NG adalah penyintesis suara sumber terbuka yang mendukung lebih dari seratus bahasa dan aksen.
★ 6.802+13Perubahan bintang dalam 7 hari terakhir - #17
StyleTTS 2: Menuju Text-to-Speech Setingkat Manusia melalui Style Diffusion dan Pelatihan Adversarial dengan Large Speech Language Models
★ 6.342+3Perubahan bintang dalam 7 hari terakhir - #18
Silero Models: model text-to-speech pra-latih yang dibuat sangat sederhana
★ 6.084-1Perubahan bintang dalam 7 hari terakhir - #19
Menghasilkan buku audio dari EPUB, PDF, dan teks dengan teks terjemahan (caption) yang disinkronkan.
★ 5.831+45Perubahan bintang dalam 7 hari terakhir - #20
DiffSinger: Sintesis Suara Nyanyian melalui Mekanisme Difusi Dangkal (SVS & TTS); AAAI 2022; Kode resmi
★ 4.855+3Perubahan bintang dalam 7 hari terakhir - #21
Sistem text-to-speech Open Source yang dibangun dengan membalikkan Whisper.
★ 4.645+3Perubahan bintang dalam 7 hari terakhir - #22★ 4.258+18Perubahan bintang dalam 7 hari terakhir
- #23
Model dasar untuk TTS yang ekspresif dan mirip manusia
★ 4.203-1Perubahan bintang dalam 7 hari terakhir - #24
Mengubah teks menjadi suara secara real-time.
★ 4.021+2Perubahan bintang dalam 7 hari terakhir - #25
TensorFlowTTS: Sintesis ucapan real-time mutakhir untuk Tensorflow 2 (mendukung bahasa Inggris, Prancis, Korea, Mandarin, Jerman, dan mudah diadaptasi untuk bahasa lain)
★ 3.996+0Perubahan bintang dalam 7 hari terakhir - #26★ 2.864+0Perubahan bintang dalam 7 hari terakhir
- #27★ 2.818+1Perubahan bintang dalam 7 hari terakhir
- #28
MARY TTS — sistem sintesis text-to-speech multibahasa sumber terbuka yang ditulis dalam Java murni
★ 2.583+0Perubahan bintang dalam 7 hari terakhir - #29
TTS bahasa Vietnam dengan kloning suara instan • On-device • Inferensi CPU real-time • Kualitas audio 24kHz
★ 2.468+21Perubahan bintang dalam 7 hari terakhir - #30
HiFi-GAN: Generative Adversarial Networks untuk sintesis ucapan yang efisien dan fidelitas tinggi
★ 2.367+0Perubahan bintang dalam 7 hari terakhir