Lompat ke konten utama
buildradar
Sign in
Topik · tts

tts

Repositori open source terpantau bertanda tts, diurutkan berdasarkan bintang.

189 repositori
  • alexandria-audiobook@Finrandojin

    Generator buku audio multi-suara berbasis AI — anotasi skrip LLM, kloning suara, desain suara, pelatihan LoRA, kontrol gaya per baris, dan ekspor ke MP3, M4B dengan bab, atau multi-track Audacity. Dibangun di atas Qwen3-TTS.

    999+17Perubahan bintang dalam 7 hari terakhir
  • lobe-vidol@lobehub

    🧸 Lobe Vidol - Membuat Idol Virtual Dapat Diakses oleh Semua Orang

    986+1Perubahan bintang dalam 7 hari terakhir
  • Step-Audio-EditX@stepfun-ai

    Model pengeditan audio Reinforcement Learning berbasis LLM dengan 3B parameter yang kuat, unggul dalam mengedit emosi, gaya bicara, dan paralinguistik, serta dilengkapi teks-ke-suara zero-shot yang tangguh

    972+1Perubahan bintang dalam 7 hari terakhir
  • NISQA@gabrielmittag

    NISQA - Penilaian Kualitas Suara Non-Intrusif dan Kealamian TTS

    971+2Perubahan bintang dalam 7 hari terakhir
  • epub2tts@aedocw

    Ubah file epub atau teks menjadi buku audio.

    955-1Perubahan bintang dalam 7 hari terakhir
  • audio-ai-hub@BinWang28

    Pusat penelitian AI audio: makalah, model terbuka, tolok ukur, & dataset di seluruh LLM audio, pengenalan ucapan, TTS, musik & pembuatan audio.

    953+3Perubahan bintang dalam 7 hari terakhir
  • Membuat suara TTS alami Azure dapat diakses oleh aplikasi apa pun yang kompatibel dengan SAPI 5.

    934+12Perubahan bintang dalam 7 hari terakhir
  • FireRedTTS@FireRedTeam

    Sistem TTS Foundation open-source yang didukung oleh LLM

    920+1Perubahan bintang dalam 7 hari terakhir
  • SmartJavaAI@geekwenjie

    Toolbox algoritma AI offline gratis untuk Java, mendukung pengenalan wajah, deteksi liveness, pengenalan ekspresi, deteksi objek, segmentasi instans, deteksi pejalan kaki, pengenalan teks OCR, pengenalan pelat nomor, pengenalan tabel, ASR+TTS, terjemahan mesin, dan lainnya. Dapat digunakan melalui Maven. Mendukung PyTorch, Tensorflow, serta telah mengintegrasikan model utama seperti Mtcnn, InsightFace, SeetaFace6, YOLOv8~v12, PaddleOCR(PPOCRv5), dan Whisper.

    909+3Perubahan bintang dalam 7 hari terakhir
  • mosec@mosecorg

    Framework penyajian model ML performa tinggi, menawarkan batching dinamis dan pipeline CPU/GPU untuk memaksimalkan mesin komputasi Anda

    902+0Perubahan bintang dalam 7 hari terakhir
  • xtts-webui@daswer123

    Webui untuk menggunakan XTTS dan melakukan fine-tuning

    896+0Perubahan bintang dalam 7 hari terakhir
  • diffwave@lmnt-com

    DiffWave adalah vocoder neural dan synthesizer gelombang yang cepat serta berkualitas tinggi.

    885+0Perubahan bintang dalam 7 hari terakhir
  • pdf-to-podcast@NVIDIA-AI-Blueprints

    Ubah PDF menjadi podcast AI untuk konten audio yang menarik saat bepergian.

    874+1Perubahan bintang dalam 7 hari terakhir
  • Easy-Voice-Toolkit@Spr-Aachen

    Toolkit yang ramah pengguna untuk pengenalan/transkripsi/konversi suara, dll.

    873+0Perubahan bintang dalam 7 hari terakhir
  • bark.cpp@PABannier

    Model Bark Suno AI dalam C/C++ untuk pembuatan text-to-speech yang cepat

    867+1Perubahan bintang dalam 7 hari terakhir
  • esp-ai@wangzongming

    Solusi integrasi AI paling sederhana dan berbiaya rendah. Jika Anda menyukai proyek ini, silakan berikan Star~

    856+2Perubahan bintang dalam 7 hari terakhir
  • SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.

    829+15Perubahan bintang dalam 7 hari terakhir
  • Voxtral ASR & TTS berjalan secara native dan di dalam browser. Implementasi Rust dari ASR / TTS real-time mini Voxtral milik Mistral menggunakan framework Burn ML

    819+2Perubahan bintang dalam 7 hari terakhir
  • Kokoros@lucasjinreal

    Kokoro dalam Rust. TTS real-time yang sangat cepat dengan kualitas tinggi.

    818+1Perubahan bintang dalam 7 hari terakhir
  • gitpodcast@BandarLabs

    Ubah repositori git apa pun menjadi podcast yang menarik

    814-1Perubahan bintang dalam 7 hari terakhir
  • lue@paulilaaso

    Pembaca eBook terminal dengan Text-to-Speech berkualitas audiobook — Mendukung EPUB, PDF, DOCX, HTML, RTF, TXT, dan MD.

    806+2Perubahan bintang dalam 7 hari terakhir
  • lobe-tts@lobehub

    🎤 Lobe TTS - Pustaka TTS/STT yang berkualitas tinggi & andal untuk Server dan Browser

    805+1Perubahan bintang dalam 7 hari terakhir
  • CloneTTS@sipeter

    Engine Text-to-Speech (TTS) Android ringan dan luring yang memungkinkan kloning suara seluruh sistem yang mulus dan pembacaan teks berketepatan tinggi.

    803+2Perubahan bintang dalam 7 hari terakhir
  • Speech to Text to Speech. Lagu sedang diputar. Mengirim teks sebagai pesan OSC ke VRChat untuk ditampilkan di avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    803+4Perubahan bintang dalam 7 hari terakhir
  • ZerolanLiveRobot@AkagawaTsurunaki

    AI VTuber dengan teknologi LLM, ASR, TTS, OCR, CV, dan lainnya untuk siaran langsung atau bermain Minecraft bersama Anda.

    803+5Perubahan bintang dalam 7 hari terakhir
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: Mesin TTS Zero-Shot multibahasa dan lintas bahasa

    794+10Perubahan bintang dalam 7 hari terakhir
  • Alat penerjemah layar real-time Android sumber terbuka tanpa ROOT, cocok untuk game, novel visual, dan manga. Mendukung OCR perangkat dan cloud, LLM offline, berbagai layanan terjemahan, dan text-to-speech (TTS), dengan terjemahan yang langsung ditampilkan di layar.

    786+82Perubahan bintang dalam 7 hari terakhir
  • mlx-audio-swift@Blaizzy

    SDK Swift modular untuk pemrosesan audio dengan MLX di Apple Silicon

    772+6Perubahan bintang dalam 7 hari terakhir
  • dla@markovka17

    Deep learning untuk pemrosesan audio

    762+1Perubahan bintang dalam 7 hari terakhir
  • vui@fluxions-ai

    Asisten suara waktu nyata — streaming WebRTC, faster-whisper ASR, LLM lokal, Vui Nano (300M) TTS. Kompatibel dengan OpenAI Realtime API. Kloning suara, barge-in, ~9x waktu nyata pada RTX 4090. Apache 2.0.

    757+10Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik