tts
Repositori open source terpantau bertanda tts, diurutkan berdasarkan bintang.
- #121
Generator buku audio multi-suara berbasis AI — anotasi skrip LLM, kloning suara, desain suara, pelatihan LoRA, kontrol gaya per baris, dan ekspor ke MP3, M4B dengan bab, atau multi-track Audacity. Dibangun di atas Qwen3-TTS.
★ 999+17Perubahan bintang dalam 7 hari terakhir - #122
🧸 Lobe Vidol - Membuat Idol Virtual Dapat Diakses oleh Semua Orang
★ 986+1Perubahan bintang dalam 7 hari terakhir - #123
Model pengeditan audio Reinforcement Learning berbasis LLM dengan 3B parameter yang kuat, unggul dalam mengedit emosi, gaya bicara, dan paralinguistik, serta dilengkapi teks-ke-suara zero-shot yang tangguh
★ 972+1Perubahan bintang dalam 7 hari terakhir - #124★ 971+2Perubahan bintang dalam 7 hari terakhir
- #125★ 955-1Perubahan bintang dalam 7 hari terakhir
- #126
Pusat penelitian AI audio: makalah, model terbuka, tolok ukur, & dataset di seluruh LLM audio, pengenalan ucapan, TTS, musik & pembuatan audio.
★ 953+3Perubahan bintang dalam 7 hari terakhir - #127
Membuat suara TTS alami Azure dapat diakses oleh aplikasi apa pun yang kompatibel dengan SAPI 5.
★ 934+12Perubahan bintang dalam 7 hari terakhir - #128
Sistem TTS Foundation open-source yang didukung oleh LLM
★ 920+1Perubahan bintang dalam 7 hari terakhir - #129
Toolbox algoritma AI offline gratis untuk Java, mendukung pengenalan wajah, deteksi liveness, pengenalan ekspresi, deteksi objek, segmentasi instans, deteksi pejalan kaki, pengenalan teks OCR, pengenalan pelat nomor, pengenalan tabel, ASR+TTS, terjemahan mesin, dan lainnya. Dapat digunakan melalui Maven. Mendukung PyTorch, Tensorflow, serta telah mengintegrasikan model utama seperti Mtcnn, InsightFace, SeetaFace6, YOLOv8~v12, PaddleOCR(PPOCRv5), dan Whisper.
★ 909+3Perubahan bintang dalam 7 hari terakhir - #130
Framework penyajian model ML performa tinggi, menawarkan batching dinamis dan pipeline CPU/GPU untuk memaksimalkan mesin komputasi Anda
★ 902+0Perubahan bintang dalam 7 hari terakhir - #131
Webui untuk menggunakan XTTS dan melakukan fine-tuning
★ 896+0Perubahan bintang dalam 7 hari terakhir - #132
DiffWave adalah vocoder neural dan synthesizer gelombang yang cepat serta berkualitas tinggi.
★ 885+0Perubahan bintang dalam 7 hari terakhir - #133
Ubah PDF menjadi podcast AI untuk konten audio yang menarik saat bepergian.
★ 874+1Perubahan bintang dalam 7 hari terakhir - #134
Toolkit yang ramah pengguna untuk pengenalan/transkripsi/konversi suara, dll.
★ 873+0Perubahan bintang dalam 7 hari terakhir - #135★ 867+1Perubahan bintang dalam 7 hari terakhir
- #136
Solusi integrasi AI paling sederhana dan berbiaya rendah. Jika Anda menyukai proyek ini, silakan berikan Star~
★ 856+2Perubahan bintang dalam 7 hari terakhir - #137
SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.
★ 829+15Perubahan bintang dalam 7 hari terakhir - #138
Voxtral ASR & TTS berjalan secara native dan di dalam browser. Implementasi Rust dari ASR / TTS real-time mini Voxtral milik Mistral menggunakan framework Burn ML
★ 819+2Perubahan bintang dalam 7 hari terakhir - #139★ 818+1Perubahan bintang dalam 7 hari terakhir
- #140
Ubah repositori git apa pun menjadi podcast yang menarik
★ 814-1Perubahan bintang dalam 7 hari terakhir - #141
Pembaca eBook terminal dengan Text-to-Speech berkualitas audiobook — Mendukung EPUB, PDF, DOCX, HTML, RTF, TXT, dan MD.
★ 806+2Perubahan bintang dalam 7 hari terakhir - #142
🎤 Lobe TTS - Pustaka TTS/STT yang berkualitas tinggi & andal untuk Server dan Browser
★ 805+1Perubahan bintang dalam 7 hari terakhir - #143
Engine Text-to-Speech (TTS) Android ringan dan luring yang memungkinkan kloning suara seluruh sistem yang mulus dan pembacaan teks berketepatan tinggi.
★ 803+2Perubahan bintang dalam 7 hari terakhir - #144
Speech to Text to Speech. Lagu sedang diputar. Mengirim teks sebagai pesan OSC ke VRChat untuk ditampilkan di avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)
★ 803+4Perubahan bintang dalam 7 hari terakhir - #145
AI VTuber dengan teknologi LLM, ASR, TTS, OCR, CV, dan lainnya untuk siaran langsung atau bermain Minecraft bersama Anda.
★ 803+5Perubahan bintang dalam 7 hari terakhir - #146
Confucius4-TTS: Mesin TTS Zero-Shot multibahasa dan lintas bahasa
★ 794+10Perubahan bintang dalam 7 hari terakhir - #147
Alat penerjemah layar real-time Android sumber terbuka tanpa ROOT, cocok untuk game, novel visual, dan manga. Mendukung OCR perangkat dan cloud, LLM offline, berbagai layanan terjemahan, dan text-to-speech (TTS), dengan terjemahan yang langsung ditampilkan di layar.
★ 786+82Perubahan bintang dalam 7 hari terakhir - #148
SDK Swift modular untuk pemrosesan audio dengan MLX di Apple Silicon
★ 772+6Perubahan bintang dalam 7 hari terakhir - #149★ 762+1Perubahan bintang dalam 7 hari terakhir
- #150
Asisten suara waktu nyata — streaming WebRTC, faster-whisper ASR, LLM lokal, Vui Nano (300M) TTS. Kompatibel dengan OpenAI Realtime API. Kloning suara, barge-in, ~9x waktu nyata pada RTX 4090. Apache 2.0.
★ 757+10Perubahan bintang dalam 7 hari terakhir