text-to-speech
Repositori open source terpantau bertanda text-to-speech, diurutkan berdasarkan bintang.
- #91
Integrasi node kustom ComfyUI untuk Text-to-Speech dan Konversi Suara multi-mesin multi-bahasa lokal. Mendukung: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (klasik dan multilingual), F5-TTS, Higgs Audio 2, 3, dan VibeVoice dengan panjang teks tak terbatas, penentuan waktu SRT, dukungan Karakter, dan banyak alat audio
★ 1.187+0Perubahan bintang dalam 7 hari terakhir - #92
Lab praktis untuk membangun, menguji, dan mengevaluasi aplikasi dengan kerangka kerja Foundation Models dari Apple.
★ 1.178+0Perubahan bintang dalam 7 hari terakhir - #93★ 1.173+0Perubahan bintang dalam 7 hari terakhir
- #94
Toolkit bicara AI untuk Apple Silicon — ASR, TTS, speech-to-speech, VAD, dan diarisasi yang didukung oleh MLX dan CoreML
★ 1.161+0Perubahan bintang dalam 7 hari terakhir - #95
Sistem Pengodean Mandiri untuk Aplikasi Anda — Alan AI SDK untuk Cordova
★ 1.132+0Perubahan bintang dalam 7 hari terakhir - #96
Studio AI lokal tanpa sensor untuk Windows, Linux, dan macOS. GUI tanpa pengaturan untuk Pembuatan Gambar, LLM GGUF, Text-to-Speech & Speech-to-Text
★ 1.118+13Perubahan bintang dalam 7 hari terakhir - #97
SGLang-Omni mendukung penyajian berkinerja tinggi untuk model TTS, ASR, ucapan, dan omni.
★ 1.118+56Perubahan bintang dalam 7 hari terakhir - #98
SDK voice-AI open-source. Alternatif Vapi/Retell bagi pembuat yang ingin memiliki stack sendiri. Berikan agen AI Anda nomor telepon dalam 4 baris — Python dan TypeScript, lisensi MIT, Twilio, Telnyx, dan Plivo.
★ 1.051+7Perubahan bintang dalam 7 hari terakhir - #99
Kode contoh API Text-to-Speech Microsoft dalam beberapa bahasa, bagian dari Cognitive Services.
★ 1.014+1Perubahan bintang dalam 7 hari terakhir - #100
Generator buku audio multi-suara berbasis AI — anotasi skrip LLM, kloning suara, desain suara, pelatihan LoRA, kontrol gaya per baris, dan ekspor ke MP3, M4B dengan bab, atau multi-track Audacity. Dibangun di atas Qwen3-TTS.
★ 1.000+10Perubahan bintang dalam 7 hari terakhir - #101
Model pengeditan audio Reinforcement Learning berbasis LLM dengan 3B parameter yang kuat, unggul dalam mengedit emosi, gaya bicara, dan paralinguistik, serta dilengkapi teks-ke-suara zero-shot yang tangguh
★ 973+1Perubahan bintang dalam 7 hari terakhir - #102★ 972+4Perubahan bintang dalam 7 hari terakhir
- #103
Pemrosesan Ucapan Botium
★ 943+0Perubahan bintang dalam 7 hari terakhir - #104
Membuat suara TTS alami Azure dapat diakses oleh aplikasi apa pun yang kompatibel dengan SAPI 5.
★ 934+7Perubahan bintang dalam 7 hari terakhir - #105
Klien Vonage REST API untuk PHP. Dukungan API untuk SMS, Suara, Text-to-Speech, Nomor, Verifikasi (2FA), dan lainnya.
★ 931-1Perubahan bintang dalam 7 hari terakhir - #106
Sistem TTS Foundation open-source yang didukung oleh LLM
★ 919-1Perubahan bintang dalam 7 hari terakhir - #107
Catatan kapten dan peta bintang 3D untuk Elite Dangerous
★ 900+4Perubahan bintang dalam 7 hari terakhir - #108
DiffWave adalah vocoder neural dan synthesizer gelombang yang cepat serta berkualitas tinggi.
★ 884-1Perubahan bintang dalam 7 hari terakhir - #109★ 868+2Perubahan bintang dalam 7 hari terakhir
- #110
Pembaca eBook terminal dengan Text-to-Speech berkualitas audiobook — Mendukung EPUB, PDF, DOCX, HTML, RTF, TXT, dan MD.
★ 805+1Perubahan bintang dalam 7 hari terakhir - #111
🎤 Lobe TTS - Pustaka TTS/STT yang berkualitas tinggi & andal untuk Server dan Browser
★ 805-1Perubahan bintang dalam 7 hari terakhir - #112
Speech to Text to Speech. Lagu sedang diputar. Mengirim teks sebagai pesan OSC ke VRChat untuk ditampilkan di avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)
★ 804+5Perubahan bintang dalam 7 hari terakhir - #113
Engine Text-to-Speech (TTS) Android ringan dan luring yang memungkinkan kloning suara seluruh sistem yang mulus dan pembacaan teks berketepatan tinggi.
★ 804+5Perubahan bintang dalam 7 hari terakhir - #114
Editor video sumber terbuka berbasis lokal di mana kreator dan agen AI mengedit garis waktu nyata yang sama.
★ 798+82Perubahan bintang dalam 7 hari terakhir - #115
Confucius4-TTS: Mesin TTS Zero-Shot multibahasa dan lintas bahasa
★ 794+6Perubahan bintang dalam 7 hari terakhir - #116
Alat penerjemah layar real-time Android sumber terbuka tanpa ROOT, cocok untuk game, novel visual, dan manga. Mendukung OCR perangkat dan cloud, LLM offline, berbagai layanan terjemahan, dan text-to-speech (TTS), dengan terjemahan yang langsung ditampilkan di layar.
★ 794+73Perubahan bintang dalam 7 hari terakhir - #117
Chatbot suara lokal untuk percakapan interaktif, didukung oleh Ollama, Hugging Face Transformers, dan Coqui TTS Toolkit
★ 788+1Perubahan bintang dalam 7 hari terakhir - #118
SDK Swift modular untuk pemrosesan audio dengan MLX di Apple Silicon
★ 774+5Perubahan bintang dalam 7 hari terakhir - #119
Asisten suara waktu nyata — streaming WebRTC, faster-whisper ASR, LLM lokal, Vui Nano (300M) TTS. Kompatibel dengan OpenAI Realtime API. Kloning suara, barge-in, ~9x waktu nyata pada RTX 4090. Apache 2.0.
★ 759+7Perubahan bintang dalam 7 hari terakhir - #120
Sistem Komunikasi Augmentatif dan Alternatif (AAC) dengan text-to-speech untuk browser
★ 756+9Perubahan bintang dalam 7 hari terakhir