tts
Repositori open source terpantau bertanda tts, diurutkan berdasarkan bintang.
- #31
Antarmuka web lokal sederhana yang menggunakan ChatTTS untuk menyintesis teks menjadi suara, sekaligus mendukung penyediaan antarmuka API eksternal.
★ 7.648+4Perubahan bintang dalam 7 hari terakhir - #32
Pustaka text-to-speech multibahasa berkualitas tinggi oleh MyShell.ai. Mendukung bahasa Inggris, Spanyol, Prancis, Mandarin, Jepang, dan Korea.
★ 7.616+7Perubahan bintang dalam 7 hari terakhir - #33
🤖 wukong-robot adalah proyek robot percakapan suara/speaker pintar bahasa Mandarin yang sederhana, fleksibel, dan elegan, mendukung kemampuan percakapan multi-putaran ChatGPT, dan mungkin merupakan proyek speaker pintar sumber terbuka pertama yang mendukung interaksi otak-komputer.
★ 7.126+2Perubahan bintang dalam 7 hari terakhir - #34
StyleTTS 2: Menuju Text-to-Speech Setingkat Manusia melalui Style Diffusion dan Pelatihan Adversarial dengan Large Speech Language Models
★ 6.342+3Perubahan bintang dalam 7 hari terakhir - #35
Menuju Ucapan yang Terdengar Manusiawi
★ 6.324+5Perubahan bintang dalam 7 hari terakhir - #36
🎤 Alat sintesis suara Microsoft, dibangun menggunakan Electron + Vue + ElementPlus + Vite.
★ 6.103+1Perubahan bintang dalam 7 hari terakhir - #37
Silero Models: model text-to-speech pra-latih yang dibuat sangat sederhana
★ 6.084-1Perubahan bintang dalam 7 hari terakhir - #38
Menghasilkan buku audio dari EPUB, PDF, dan teks dengan teks terjemahan (caption) yang disinkronkan.
★ 5.831+45Perubahan bintang dalam 7 hari terakhir - #39
Wrapper berbasis Docker yang kompatibel dengan OpenAI untuk text-to-speech Kokoro-82M, mendukung PyTorch di CPU, AMD, dan NVIDIA GPU; fitur multi-speaker, pencampuran suara, auto-stitching, timestamp caption, SSML, dan antarmuka web readalong.
★ 5.399+19Perubahan bintang dalam 7 hari terakhir - #40
Mesin video AIGC serbaguna: dari naskah hingga film jadi dalam satu alur — drama, iklan, video produk, game otome, dan banyak lagi.
★ 4.900+384Perubahan bintang dalam 7 hari terakhir - #41
DiffSinger: Sintesis Suara Nyanyian melalui Mekanisme Difusi Dangkal (SVS & TTS); AAAI 2022; Kode resmi
★ 4.855+3Perubahan bintang dalam 7 hari terakhir - #42
Sistem text-to-speech Open Source yang dibangun dengan membalikkan Whisper.
★ 4.645+3Perubahan bintang dalam 7 hari terakhir - #43
Aplikasi TTS sistem Android dengan antarmuka demo Microsoft bawaan, mendukung kustomisasi permintaan HTTP, impor mesin TTS lokal, pengenalan narasi/dialog berdasarkan tanda kutip bahasa Mandarin, serta fitur percobaan ulang otomatis, konfigurasi cadangan, dan penggantian teks.
★ 4.488+5Perubahan bintang dalam 7 hari terakhir - #44
MOSS-TTS-Nano adalah model generasi ucapan mini multibahasa sumber terbuka dari MOSI.AI dan tim OpenMOSS. Dengan hanya 0,1 miliar parameter, model ini dirancang untuk pembuatan ucapan waktu nyata, dapat berjalan langsung di CPU tanpa GPU, dan menjaga tumpukan penyebaran tetap sederhana untuk demo lokal, layanan web, dan integrasi produk ringan.
★ 4.282+11Perubahan bintang dalam 7 hari terakhir - #45
Model dasar untuk TTS yang ekspresif dan mirip manusia
★ 4.203-1Perubahan bintang dalam 7 hari terakhir - #46
TensorFlowTTS: Sintesis ucapan real-time mutakhir untuk Tensorflow 2 (mendukung bahasa Inggris, Prancis, Korea, Mandarin, Jerman, dan mudah diadaptasi untuk bahasa lain)
★ 3.996+0Perubahan bintang dalam 7 hari terakhir - #47
Streamer-Sales 销冠 — LLM untuk streamer penjualan barang 🛒🎁, model yang mampu menjelaskan produk untuk memicu minat beli pengguna berdasarkan fitur produk. 🚀⭐ Termasuk alur pembuatan data yang mendetail ❗ 📦 Terintegrasi dengan LMDeploy untuk akselerasi inferensi 🚀, RAG untuk augmentasi pengambilan 📚, TTS untuk teks-ke-suara 🔊, pembuatan avatar digital 🦸, Agent untuk pencarian informasi real-time 🌐, ASR untuk suara-ke-teks 🎙️, frontend berbasis ekosistem Vue 🍍, backend FastAPI 🗝️, dan deployment Docker-compose 🐋
★ 3.764+1Perubahan bintang dalam 7 hari terakhir - #48
Alat konversi suara yang sederhana dan berkualitas tinggi dengan fokus pada kemudahan penggunaan dan performa.
★ 3.674+14Perubahan bintang dalam 7 hari terakhir - #49
Satu WebUI Gradio + React dengan ekstensi untuk ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T, dan Bark.
★ 3.250+5Perubahan bintang dalam 7 hari terakhir - #50
[AutoArk] GPA (General Purpose Audio) dapat melakukan ASR, TTS, dan konversi suara dengan satu model kecil!
★ 3.061+164Perubahan bintang dalam 7 hari terakhir - #51
openctp提供CTP股票期权、中泰证券XTP、华鑫证券奇点TORA、东方证券OST、东方财富证券EMT、盈透证券TWS、易盛TAP、量投QDP等各通道的CTPAPI兼容接口,CTP程序可以无缝对接各股票柜台。openctp也提供了一套基于TTS交易系统的模拟环境,同样提供了CTPAPI兼容接口,不仅支持国内期货与期权全品种,也支持A股股票、基金、债券以及股票期权模拟交易,可以替代Simnow,为CTP量化交易开发者提供7x24可用的模拟环境。
★ 2.920+7Perubahan bintang dalam 7 hari terakhir - #52★ 2.864+0Perubahan bintang dalam 7 hari terakhir
- #53
aeneas adalah pustaka Python/C dan sekumpulan alat untuk menyinkronkan audio dan teks secara otomatis (dikenal sebagai forced alignment)
★ 2.862+0Perubahan bintang dalam 7 hari terakhir - #54
FLUX, Stable Diffusion, SDXL, SD3, LoRA, Fine Tuning, DreamBooth, Pelatihan, Automatic1111, Forge WebUI, SwarmUI, DeepFake, TTS, Animasi, Text To Video, Tutorial, Panduan, Kuliah, Kursus, ComfyUI, Google Colab, RunPod, Kaggle, NoteBooks, ControlNet, TTS, Kloning Suara, AI, Berita AI, ML, Berita ML, Berita, Teknologi, Berita Teknologi, Kohya, Midjourney, RunPod.
★ 2.762-1Perubahan bintang dalam 7 hari terakhir - #55
TTS dengan kokoro dan onnx runtime
★ 2.694+8Perubahan bintang dalam 7 hari terakhir - #56
Pustaka Python dan alat CLI untuk berinteraksi dengan API text-to-speech Google Translate
★ 2.628+0Perubahan bintang dalam 7 hari terakhir - #57★ 2.586+1Perubahan bintang dalam 7 hari terakhir
- #58
MARY TTS — sistem sintesis text-to-speech multibahasa sumber terbuka yang ditulis dalam Java murni
★ 2.583+0Perubahan bintang dalam 7 hari terakhir - #59
TTS bahasa Vietnam dengan kloning suara instan • On-device • Inferensi CPU real-time • Kualitas audio 24kHz
★ 2.468+21Perubahan bintang dalam 7 hari terakhir - #60
HiFi-GAN: Generative Adversarial Networks untuk sintesis ucapan yang efisien dan fidelitas tinggi
★ 2.367+0Perubahan bintang dalam 7 hari terakhir