Lompat ke konten utama
buildradar
Sign in
Topik · speech-synthesis

speech-synthesis

Repositori open source terpantau bertanda speech-synthesis, diurutkan berdasarkan bintang.

66 repositori
  • chat-with-gpt@cogentapps

    Aplikasi ChatGPT open-source dengan suara

    2.350-1Perubahan bintang dalam 7 hari terakhir
  • IMS-Toucan@DigitalPhonetics

    Text-to-Speech yang cepat dan dapat dikontrol untuk lebih dari 7000 bahasa!

    2.207-1Perubahan bintang dalam 7 hari terakhir
  • RHVoice@RHVoice

    sintesis suara sumber terbuka gratis untuk bahasa Rusia dan bahasa lainnya

    1.836+1Perubahan bintang dalam 7 hari terakhir
  • ParallelWaveGAN@kan-bayashi

    Parallel WaveGAN Tidak Resmi (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN) dengan Pytorch

    1.646+1Perubahan bintang dalam 7 hari terakhir
  • dsnote@mkiol

    Aplikasi Linux Speech Note. Mencatat, membaca, dan menerjemahkan dengan Speech to Text, Text to Speech, dan terjemahan mesin secara luring.

    1.622+8Perubahan bintang dalam 7 hari terakhir
  • Node kustom yang memperluas kemampuan Comfyui

    1.525+1Perubahan bintang dalam 7 hari terakhir
  • SAM@s-macke

    Software Automatic Mouth - Sintesis Ucapan Mungil

    1.498+0Perubahan bintang dalam 7 hari terakhir
  • SpeechT5@microsoft

    Pra-pelatihan Ucapan-Teks Modal-Terpadu untuk Pemrosesan Bahasa Lisan

    1.449+0Perubahan bintang dalam 7 hari terakhir
  • Host sendiri model TTS Chatterbox yang kuat. Server ini menawarkan Web UI yang ramah pengguna, endpoint API yang fleksibel (termasuk kompatibel dengan OpenAI), suara prasetel, kloning suara, dan pemrosesan teks skala buku audio besar. Berjalan dipercepat di NVIDIA (CUDA), AMD (ROCm), dan CPU.

    1.427+1Perubahan bintang dalam 7 hari terakhir
  • 💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya

    1.399+0Perubahan bintang dalam 7 hari terakhir
  • voicefixer@haoheliu

    Pemulihan Ucapan Umum

    1.375+0Perubahan bintang dalam 7 hari terakhir
  • World@mmorise

    Sistem analisis, manipulasi, dan sintesis ucapan berkualitas tinggi

    1.339+0Perubahan bintang dalam 7 hari terakhir
  • StreamSpeech@ictnlp

    StreamSpeech adalah model "All in One" yang mulus untuk pengenalan suara offline dan simultan, terjemahan suara, serta sintesis suara.

    1.288+0Perubahan bintang dalam 7 hari terakhir
  • Irodori-TTS@Aratako

    Model Text-to-Speech berbasis Flow Matching dengan Kontrol Gaya berbasis Emoji

    1.228+4Perubahan bintang dalam 7 hari terakhir
  • BigVGAN@NVIDIA

    Implementasi resmi PyTorch dari BigVGAN (ICLR 2023)

    1.227+1Perubahan bintang dalam 7 hari terakhir
  • Irina - asisten suara berbahasa Rusia untuk bekerja secara offline. Mendukung keterampilan melalui plugin.

    1.153+0Perubahan bintang dalam 7 hari terakhir
  • AI-Waifu-Vtuber@ardha27

    AI Vtuber untuk streaming di Youtube/Twitch

    1.116+2Perubahan bintang dalam 7 hari terakhir
  • autovc@auspicious3000

    AutoVC: Transfer Gaya Suara Zero-Shot hanya dengan Autoencoder Loss

    1.100+0Perubahan bintang dalam 7 hari terakhir
  • YourTTS@Edresson

    YourTTS: Menuju TTS Multi-Speaker Zero-Shot dan Konversi Suara Zero-Shot untuk semua orang.

    1.054+0Perubahan bintang dalam 7 hari terakhir
  • Cognitive-Speech-TTS@Azure-Samples

    Kode contoh API Text-to-Speech Microsoft dalam beberapa bahasa, bagian dari Cognitive Services.

    1.014+3Perubahan bintang dalam 7 hari terakhir
  • alexandria-audiobook@Finrandojin

    Generator buku audio multi-suara berbasis AI — anotasi skrip LLM, kloning suara, desain suara, pelatihan LoRA, kontrol gaya per baris, dan ekspor ke MP3, M4B dengan bab, atau multi-track Audacity. Dibangun di atas Qwen3-TTS.

    1.000+20Perubahan bintang dalam 7 hari terakhir
  • NISQA@gabrielmittag

    NISQA - Penilaian Kualitas Suara Non-Intrusif dan Kealamian TTS

    972+3Perubahan bintang dalam 7 hari terakhir
  • Membuat suara TTS alami Azure dapat diakses oleh aplikasi apa pun yang kompatibel dengan SAPI 5.

    934+13Perubahan bintang dalam 7 hari terakhir
  • FireRedTTS@FireRedTeam

    Sistem TTS Foundation open-source yang didukung oleh LLM

    919+1Perubahan bintang dalam 7 hari terakhir
  • LLM berbasis suara yang berjalan di komputer Anda tanpa memerlukan internet.

    891+2Perubahan bintang dalam 7 hari terakhir
  • diffwave@lmnt-com

    DiffWave adalah vocoder neural dan synthesizer gelombang yang cepat serta berkualitas tinggi.

    884+0Perubahan bintang dalam 7 hari terakhir
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: Mesin TTS Zero-Shot multibahasa dan lintas bahasa

    794+10Perubahan bintang dalam 7 hari terakhir
  • vui@fluxions-ai

    Asisten suara waktu nyata — streaming WebRTC, faster-whisper ASR, LLM lokal, Vui Nano (300M) TTS. Kompatibel dengan OpenAI Realtime API. Kloning suara, barge-in, ~9x waktu nyata pada RTX 4090. Apache 2.0.

    759+10Perubahan bintang dalam 7 hari terakhir
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: Suara TTS Jerman berkualitas tinggi, bekerja secara offline, dan gratis untuk digunakan yang harus tersedia untuk setiap proyek tanpa masalah lisensi.

    729+1Perubahan bintang dalam 7 hari terakhir
  • Makalah INTERSPEECH 2023-2024: Kumpulan lengkap makalah penelitian yang berpengaruh dan menarik dari konferensi INTERSPEECH 2023-24. Jelajahi kemajuan terbaru dalam pemrosesan ucapan dan bahasa. Disertai kode. Beri bintang pada repositori untuk mendukung kemajuan teknologi ucapan!

    684+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik