tts
Repositori open source terpantau bertanda tts, diurutkan berdasarkan bintang.
- #91
🍦 Speech-AI-Forge adalah proyek yang dikembangkan di sekitar model generasi TTS, mengimplementasikan API Server dan WebUI berbasis Gradio.
★ 1.418+2Perubahan bintang dalam 7 hari terakhir - #92
Terjemahan Tersinkronisasi untuk Video. Sulih suara video
★ 1.413+3Perubahan bintang dalam 7 hari terakhir - #93
💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya
★ 1.399+0Perubahan bintang dalam 7 hari terakhir - #94
Pemulihan Ucapan Umum
★ 1.375+2Perubahan bintang dalam 7 hari terakhir - #95
Alat (platform Windows) untuk merekam sintesis suara (TTS) browser Microsoft Edge dan mengekspornya sebagai audio .wav.
★ 1.370+1Perubahan bintang dalam 7 hari terakhir - #96
[ICASSP 2024] 🍵 Matcha-TTS: Arsitektur TTS cepat dengan pencocokan alur bersyarat
★ 1.353+4Perubahan bintang dalam 7 hari terakhir - #97★ 1.347+6Perubahan bintang dalam 7 hari terakhir
- #98
Platform manajemen tingkat perusahaan Java untuk Xiaozhi ESP32, menyediakan solusi ujung depan-belakang dan sisi server terpadu untuk pemantauan perangkat, penyesuaian suara, peralihan peran, dan manajemen catatan dialog
★ 1.337+1Perubahan bintang dalam 7 hari terakhir - #99
Ekstensi Chrome untuk menerjemahkan bahasa apa pun saat kursor diarahkan: Penerjemah PDF, EBOOK, EPUB, OCR, TTS, NETFLIX, SUBTITLE GANDA YOUTUBE, GOOGLE DOCS, AI, PENAMPIL, GMAIL, MENULIS, GAMBAR, SUB GANDA, MANGA, HOVER, KAMUS, WEBTOON, EDGE, JEPANG, INGGRIS
★ 1.305+5Perubahan bintang dalam 7 hari terakhir - #100
Digital human interaktif suara secara real-time, dengan tampilan dan suara yang dapat disesuaikan, mendukung kloning suara, serta latensi dialog serendah 3 detik.
★ 1.303+0Perubahan bintang dalam 7 hari terakhir - #101
StreamSpeech adalah model "All in One" yang mulus untuk pengenalan suara offline dan simultan, terjemahan suara, serta sintesis suara.
★ 1.288+1Perubahan bintang dalam 7 hari terakhir - #102
Terjemahan ucapan waktu nyata — macOS & Windows, TTS gratis, tanpa server, hanya menggunakan kunci API Anda
★ 1.278+3Perubahan bintang dalam 7 hari terakhir - #103
Antarmuka web (webui) untuk berbagai Jaringan Saraf Tiruan terkait audio
★ 1.246-1Perubahan bintang dalam 7 hari terakhir - #104
Model Text-to-Speech berbasis Flow Matching dengan Kontrol Gaya berbasis Emoji
★ 1.228+8Perubahan bintang dalam 7 hari terakhir - #105
Praktik terbaik TTS berbasis BERT dan VITS dengan beberapa Fitur Ucapan Alami dari Microsoft; Mendukung streaming ONNX!
★ 1.226+0Perubahan bintang dalam 7 hari terakhir - #106★ 1.211-1Perubahan bintang dalam 7 hari terakhir
- #107
Integrasi node kustom ComfyUI untuk Text-to-Speech dan Konversi Suara multi-mesin multi-bahasa lokal. Mendukung: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (klasik dan multilingual), F5-TTS, Higgs Audio 2, 3, dan VibeVoice dengan panjang teks tak terbatas, penentuan waktu SRT, dukungan Karakter, dan banyak alat audio
★ 1.187+8Perubahan bintang dalam 7 hari terakhir - #108
Terjemahan suara dua arah secara real-time untuk rapat bilingual — mendeteksi bahasa yang diucapkan secara otomatis dan menerjemahkan ke dua arah, berbasis cloud atau sepenuhnya luring di perangkat. Desktop (Windows · macOS · Linux) + ekstensi browser (Chrome · Edge) untuk Zoom, Meet, Teams & aplikasi apa pun.
★ 1.186+54Perubahan bintang dalam 7 hari terakhir - #109
Toolkit bicara AI untuk Apple Silicon — ASR, TTS, speech-to-speech, VAD, dan diarisasi yang didukung oleh MLX dan CoreML
★ 1.161+11Perubahan bintang dalam 7 hari terakhir - #110
Irina - asisten suara berbahasa Rusia untuk bekerja secara offline. Mendukung keterampilan melalui plugin.
★ 1.153+1Perubahan bintang dalam 7 hari terakhir - #111
Pustaka inferensi C++ untuk beberapa SVC/TTS
★ 1.128-1Perubahan bintang dalam 7 hari terakhir - #112
AI Vtuber untuk streaming di Youtube/Twitch
★ 1.115-1Perubahan bintang dalam 7 hari terakhir - #113
SGLang-Omni mendukung penyajian berkinerja tinggi untuk model TTS, ASR, ucapan, dan omni.
★ 1.105+107Perubahan bintang dalam 7 hari terakhir - #114
NobodyWho adalah mesin inferensi yang memungkinkan Anda menjalankan LLM secara lokal dan efisien di perangkat apa pun.
★ 1.094+6Perubahan bintang dalam 7 hari terakhir - #115
GLM-TTS: TTS Zero-shot yang dapat dikontrol dan ekspresif secara emosional dengan Multi-Reward Reinforcement Learning
★ 1.063+5Perubahan bintang dalam 7 hari terakhir - #116
Dengan satu perintah, buat buku audio bersuara natural dari berbagai format masukan (epub, mobi, txt, PDF, HTML, dan lainnya!)
★ 1.058+1Perubahan bintang dalam 7 hari terakhir - #117
API text-to-speech online gratis
★ 1.057+3Perubahan bintang dalam 7 hari terakhir - #118
YourTTS: Menuju TTS Multi-Speaker Zero-Shot dan Konversi Suara Zero-Shot untuk semua orang.
★ 1.053+0Perubahan bintang dalam 7 hari terakhir - #119
API HTTP VITS sederhana, dikembangkan dengan memperluas Moegoe dengan fitur tambahan.
★ 1.051-1Perubahan bintang dalam 7 hari terakhir - #120
Kode contoh API Text-to-Speech Microsoft dalam beberapa bahasa, bagian dari Cognitive Services.
★ 1.014+2Perubahan bintang dalam 7 hari terakhir