text-to-speech
Repositori open source terpantau bertanda text-to-speech, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan text-to-speech di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda text-to-speech.
- #1
Runtime suara real-time yang menjaga Agen tetap berbicara, bekerja, dan hadir. Runtime Suara Real-time untuk Agen AI.
★ 2.377 - #2
Mesin inferensi C++ murni yang lengkap untuk model audio, didukung oleh ggml. Mendukung TTS, STT, VAD, konversi suara, pembuatan musik, dan lainnya, dengan performa yang sangat dioptimalkan. Tanpa dependensi Python.
★ 2.214 - #3
Editor video sumber terbuka berbasis lokal di mana kreator dan agen AI mengedit garis waktu nyata yang sama.
★ 792 - #4
Alat penerjemah layar real-time Android sumber terbuka tanpa ROOT, cocok untuk game, novel visual, dan manga. Mendukung OCR perangkat dan cloud, LLM offline, berbagai layanan terjemahan, dan text-to-speech (TTS), dengan terjemahan yang langsung ditampilkan di layar.
★ 786 - #5
Dikte suara lokal yang sangat cepat, gratis, dan mengutamakan privasi untuk macOS dengan transkripsi pada perangkat
★ 541
- #1
Hasilkan video pendek HD dari topik atau kata kunci dengan alur kerja AI otomatis.
★ 119.977+1.509Perubahan bintang dalam 7 hari terakhir - #2
UI lokal untuk menjalankan dan melatih LLM serta model difusi, termasuk Qwen3.8, Kimi K3, MiniMax-H3, Gemma 4, DeepSeek-V4, FLUX, dan lainnya.
★ 75.515+337Perubahan bintang dalam 7 hari terakhir - #3
Data suara 1 menit pun bisa digunakan untuk melatih model TTS yang bagus! (few-shot voice cloning)
★ 61.476+138Perubahan bintang dalam 7 hari terakhir - #4
Sistem produksi video berbasis agen sumber terbuka pertama di dunia. 12 alur kerja produksi, 100+ alat, 700+ keterampilan agen, dan file pengetahuan produksi. Ubah asisten pengodean AI Anda menjadi studio produksi video lengkap.
★ 55.719+1.707Perubahan bintang dalam 7 hari terakhir - #5★ 45.985+18Perubahan bintang dalam 7 hari terakhir
- #6★ 39.814+9Perubahan bintang dalam 7 hari terakhir
- #7★ 37.419+61Perubahan bintang dalam 7 hari terakhir
- #8
🚀 Kloning suara dalam 5 detik untuk menghasilkan ucapan arbitrer secara real-time.
★ 36.912+0Perubahan bintang dalam 7 hari terakhir - #9
VoxCPM2: TTS tanpa tokenizer untuk pembuatan ucapan multibahasa, desain suara kreatif, dan kloning suara yang realistis
★ 36.595+345Perubahan bintang dalam 7 hari terakhir - #10
Sistem Text-To-Speech Zero-Shot yang efisien dan dapat dikontrol untuk tingkat industri
★ 23.686+109Perubahan bintang dalam 7 hari terakhir - #11
Model generasi suara besar multibahasa, menyediakan kemampuan full-stack untuk inferensi, pelatihan, dan penerapan.
★ 23.426+359Perubahan bintang dalam 7 hari terakhir - #12★ 19.387+2Perubahan bintang dalam 7 hari terakhir
- #13
Menerjemahkan video dari satu bahasa ke bahasa lain serta menyematkan sulih suara dan takarir.
★ 18.871+38Perubahan bintang dalam 7 hari terakhir - #14★ 17.476+1Perubahan bintang dalam 7 hari terakhir
- #15
VoiceStudio adalah alternatif ElevenLabs sumber terbuka yang sepenuhnya lokal — kloning suara, desain suara, sulih suara video, dikte, transkripsi, & pembuatan buku audio dalam 646 bahasa.
★ 14.835+2.880Perubahan bintang dalam 7 hari terakhir - #16
Speech-to-text, text-to-speech, speaker diarization, peningkatan kualitas suara, pemisahan sumber, dan VAD menggunakan next-gen Kaldi dengan onnxruntime tanpa koneksi internet. Mendukung sistem embedded, Android, iOS, HarmonyOS, Raspberry Pi, RISC-V, RK NPU, Axera NPU, Ascend NPU, server x86_64, websocket server/client, serta mendukung 12 bahasa pemrograman.
★ 14.575+95Perubahan bintang dalam 7 hari terakhir - #17
TTS multibahasa yang sangat cepat dan berjalan di perangkat — dijalankan secara native melalui ONNX.
★ 13.757+20Perubahan bintang dalam 7 hari terakhir - #18
Gradio WebUI untuk kreator dan pengembang, menampilkan TTS utama (Edge-TTS, kokoro) dan Kloning Suara zero-shot (E2 & F5-TTS, CosyVoice), dengan pemrosesan audio Whisper, unduhan YouTube, isolasi vokal Demucs, dan terjemahan multibahasa.
★ 12.730+54Perubahan bintang dalam 7 hari terakhir - #19
Gunakan layanan text-to-speech daring Microsoft Edge dari Python TANPA memerlukan Microsoft Edge, Windows, atau kunci API
★ 11.847+29Perubahan bintang dalam 7 hari terakhir - #20
Amphion (/æmˈfaɪən/) adalah toolkit untuk Pembuatan Audio, Musik, dan Ucapan. Tujuannya adalah untuk mendukung penelitian yang dapat direproduksi dan membantu para peneliti serta insinyur junior untuk memulai di bidang penelitian dan pengembangan pembuatan audio, musik, dan ucapan.
★ 10.276+1Perubahan bintang dalam 7 hari terakhir - #21★ 9.949+3Perubahan bintang dalam 7 hari terakhir
- #22
EmotiVoice 😊: Mesin TTS Multi-Suara dan Terkontrol-Prompt
★ 8.522-1Perubahan bintang dalam 7 hari terakhir - #23
Pustaka text-to-speech (TTS), speech-to-text (STT), dan speech-to-speech (STS) yang dibangun di atas framework MLX Apple, menyediakan analisis suara yang efisien di Apple Silicon.
★ 7.826+23Perubahan bintang dalam 7 hari terakhir - #24
Pustaka text-to-speech multibahasa berkualitas tinggi oleh MyShell.ai. Mendukung bahasa Inggris, Spanyol, Prancis, Mandarin, Jepang, dan Korea.
★ 7.616+7Perubahan bintang dalam 7 hari terakhir - #25
eSpeak NG adalah penyintesis suara sumber terbuka yang mendukung lebih dari seratus bahasa dan aksen.
★ 6.802+13Perubahan bintang dalam 7 hari terakhir - #26
AI Suara On-device untuk Apple Silicon
★ 6.353+8Perubahan bintang dalam 7 hari terakhir - #27
StyleTTS 2: Menuju Text-to-Speech Setingkat Manusia melalui Style Diffusion dan Pelatihan Adversarial dengan Large Speech Language Models
★ 6.342+3Perubahan bintang dalam 7 hari terakhir - #28
Repositori ini berisi sumber daya yang dipilih secara manual untuk Prompt Engineering dengan fokus pada Generative Pre-trained Transformer (GPT), ChatGPT, PaLM, dll.
★ 6.306+7Perubahan bintang dalam 7 hari terakhir - #29
Silero Models: model text-to-speech pra-latih yang dibuat sangat sederhana
★ 6.084-1Perubahan bintang dalam 7 hari terakhir - #30
Ubah PC, Mac, atau perangkat Linux Anda menjadi server AI. Inferensi LLM, UI obrolan, suara, agen, alur kerja, RAG, dan pembuatan gambar.
★ 5.931+1.108Perubahan bintang dalam 7 hari terakhir