text-to-speech
Repositori open source terpantau bertanda text-to-speech, diurutkan berdasarkan bintang.
- #121
Paket Text to Speech untuk Flutter
★ 753+0Perubahan bintang dalam 7 hari terakhir - #122
🔊 Kokoro Web: Text-to-speech AI gratis, online atau self-hosted, kompatibel dengan OpenAI!
★ 733+2Perubahan bintang dalam 7 hari terakhir - #123
Rapida adalah platform orkestrasi AI suara end-to-end sumber terbuka untuk membangun agen suara percakapan real-time dengan streaming audio, STT, TTS, VAD, integrasi multi-saluran, manajemen status agen, dan observabilitas.
★ 723+4Perubahan bintang dalam 7 hari terakhir - #124★ 718-1Perubahan bintang dalam 7 hari terakhir
- #125
Implementasi Voicebox, jaringan Text-to-speech SOTA baru dari MetaAI, dalam Pytorch
★ 703+0Perubahan bintang dalam 7 hari terakhir - #126
Pembuat video otomatis penuh yang menggunakan motion graphics dan sintesis text-to-speech untuk mengubah buletin menjadi video YouTube harian.
★ 703+0Perubahan bintang dalam 7 hari terakhir - #127
Pengenalan suara luring (offline) menggunakan OpenAI Whisper dan TensorFlow Lite untuk Android.
★ 689+0Perubahan bintang dalam 7 hari terakhir - #128
API text-to-speech (TTS) lokal yang kompatibel dengan OpenAI menggunakan Chatterbox, memungkinkan pengguna menghasilkan ucapan tiruan suara di mana pun API OpenAI digunakan (mis. Open WebUI, AnythingLLM, dll.)
★ 677+1Perubahan bintang dalam 7 hari terakhir - #129
📚 Ekstensi kamus yang dapat disesuaikan yang mendukung pencarian klik ganda dalam 20+ bahasa, 1000+ kamus, teks-ke-suara, terjemahan, dan integrasi Anki.
★ 671+1Perubahan bintang dalam 7 hari terakhir - #130
LLaSA: Penskalaan Komputasi Waktu Latih dan Waktu Inferensi untuk Sintesis Ucapan Berbasis LLaMA
★ 658+1Perubahan bintang dalam 7 hari terakhir - #131
Implementasi F5-TTS dalam MLX
★ 644+0Perubahan bintang dalam 7 hari terakhir - #132★ 626+2Perubahan bintang dalam 7 hari terakhir
- #133
Ubah PDF dan EPUB menjadi buku audio; subtitle atau video menjadi video sulih suara (termasuk terjemahan), dan banyak lagi. Gratis. Pandrator menggunakan model lokal, termasuk kloning suara (instan, RVC-enhanced, fine-tuning XTTS) dan pemrosesan LLM. Aplikasi ini dirancang agar ramah pengguna dengan GUI, installer, dan paket all-in-one.
★ 620+3Perubahan bintang dalam 7 hari terakhir - #134
Skrip Python sederhana untuk berinteraksi dengan API TikTok TTS
★ 611+0Perubahan bintang dalam 7 hari terakhir - #135
Node kustom ComfyUI untuk VibeVoice TTS. Audio percakapan ekspresif, berdurasi panjang, dan multi-penutur.
★ 596-1Perubahan bintang dalam 7 hari terakhir - #136
Versi modifikasi dari Chatterbox yang menerima file teks sebagai input dan tanpa batasan karakter. Saya menggunakannya untuk membuat buku audio, terutama untuk anak-anak saya.
★ 575-1Perubahan bintang dalam 7 hari terakhir - #137
Sistem pengodean mandiri untuk aplikasi Anda — Alan AI SDK untuk React Native
★ 575+0Perubahan bintang dalam 7 hari terakhir - #138
Jalankan konversi teks-ke-suara Qwen3-TTS secara lokal di Mac (M1/M2/M3/M4). Kloning suara, desain suara, suara kustom. 100% offline menggunakan MLX.
★ 561+2Perubahan bintang dalam 7 hari terakhir - #139
🔥🔥🔥 Daftar kurasi makalah tentang generasi multimodal berbasis LLM (gambar, video, 3D, dan audio).
★ 552+0Perubahan bintang dalam 7 hari terakhir - #140
Jalankan Orpheus 3B secara lokal dengan LM Studio
★ 549+0Perubahan bintang dalam 7 hari terakhir - #141
Implementasi vits2-TTS tidak resmi di pytorch
★ 549+1Perubahan bintang dalam 7 hari terakhir - #142
AI Plugin adalah ekstensi canggih untuk Payload CMS, mengintegrasikan kemampuan AI tingkat lanjut untuk meningkatkan pembuatan dan pengelolaan konten.
★ 547-1Perubahan bintang dalam 7 hari terakhir - #143
Node OmniVoice TTS untuk ComfyUI - Teks-ke-suara multilingual zero-shot dengan kloning suara, desain suara, dan dialog multi-pembicara
★ 545+5Perubahan bintang dalam 7 hari terakhir - #144
Dikte suara lokal yang sangat cepat, gratis, dan mengutamakan privasi untuk macOS dengan transkripsi pada perangkat
★ 544+11Perubahan bintang dalam 7 hari terakhir - #145★ 525+2Perubahan bintang dalam 7 hari terakhir
- #146
Implementasi E2-TTS, "Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS", di PyTorch
★ 517+0Perubahan bintang dalam 7 hari terakhir - #147
Model Text-to-Speech Kloning Suara Bahasa Vietnam ✨
★ 516+0Perubahan bintang dalam 7 hari terakhir - #148
Server inferensi bahasa yang sangat dioptimalkan, sumber terbuka, lokal, dan mandiri yang mendukung ASR/STT, TTS, dan LLM melalui WebRTC, REST, dan WS
★ 512+0Perubahan bintang dalam 7 hari terakhir - #149
Node ComfyUI untuk ucapan yang sangat ekspresif dan kloning suara zero-shot yang realistis
★ 509-1Perubahan bintang dalam 7 hari terakhir - #150
An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.
★ 506+5Perubahan bintang dalam 7 hari terakhir