Lompat ke konten utama
buildradar
Sign in
Topik · speech-synthesis

speech-synthesis

Repositori open source terpantau bertanda speech-synthesis, diurutkan berdasarkan bintang.

Repositori
66
Total bintang
348.104
Rata-rata bintang
5.274
Porsi
0,02%

Topik yang sering muncul berdampingan dengan speech-synthesis di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda speech-synthesis.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • TTS@coqui-ai

    🐸💬 - toolkit deep learning untuk Text-to-Speech, teruji dalam penelitian dan produksi

    45.985+18Perubahan bintang dalam 7 hari terakhir
  • VoxCPM@OpenBMB

    VoxCPM2: TTS tanpa tokenizer untuk pembuatan ucapan multibahasa, desain suara kreatif, dan kloning suara yang realistis

    36.595+345Perubahan bintang dalam 7 hari terakhir
  • Speech@NVIDIA-NeMo

    Kerangka kerja AI generatif yang skalabel yang dibangun untuk peneliti dan pengembang yang bekerja pada Large Language Models, Multimodal, dan Speech AI (Automatic Speech Recognition dan Text-to-Speech)

    18.379+21Perubahan bintang dalam 7 hari terakhir
  • leon@leon-ai

    Leon adalah asisten pribadi open source Anda.

    17.476+1Perubahan bintang dalam 7 hari terakhir
  • DeepLearningExamples@NVIDIA

    Skrip Deep Learning mutakhir yang diatur berdasarkan model - mudah dilatih dan diterapkan dengan akurasi serta performa yang dapat direproduksi pada infrastruktur kelas perusahaan.

    14.846+4Perubahan bintang dalam 7 hari terakhir
  • supertonic@supertone-inc

    TTS multibahasa yang sangat cepat dan berjalan di perangkat — dijalankan secara native melalui ONNX.

    13.757+20Perubahan bintang dalam 7 hari terakhir
  • speech-to-speech@huggingface

    Membangun agen suara dengan model open-source

    13.015+82Perubahan bintang dalam 7 hari terakhir
  • voice-pro@abus-aikorea

    Gradio WebUI untuk kreator dan pengembang, menampilkan TTS utama (Edge-TTS, kokoro) dan Kloning Suara zero-shot (E2 & F5-TTS, CosyVoice), dengan pemrosesan audio Whisper, unduhan YouTube, isolasi vokal Demucs, dan terjemahan multibahasa.

    12.730+54Perubahan bintang dalam 7 hari terakhir
  • PaddleSpeech@PaddlePaddle

    Toolkit Speech yang mudah digunakan mencakup model Self-Supervised Learning, SOTA/Streaming ASR dengan tanda baca, Streaming TTS dengan frontend teks, Sistem Verifikasi Pembicara, End-to-End Speech Translation, dan Keyword Spotting. Pemenang Penghargaan Demo Terbaik NAACL2022.

    12.676+5Perubahan bintang dalam 7 hari terakhir
  • edge-tts@rany2

    Gunakan layanan text-to-speech daring Microsoft Edge dari Python TANPA memerlukan Microsoft Edge, Windows, atau kunci API

    11.847+29Perubahan bintang dalam 7 hari terakhir
  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) adalah toolkit untuk Pembuatan Audio, Musik, dan Ucapan. Tujuannya adalah untuk mendukung penelitian yang dapat direproduksi dan membantu para peneliti serta insinyur junior untuk memulai di bidang penelitian dan pengembangan pembuatan audio, musik, dan ucapan.

    10.276+1Perubahan bintang dalam 7 hari terakhir
  • espnet@espnet

    Toolkit Pemrosesan Suara End-to-End

    9.949+3Perubahan bintang dalam 7 hari terakhir
  • so-vits-svc-fork@voicepaw

    Fork so-vits-svc dengan dukungan waktu nyata, antarmuka yang ditingkatkan, dan fitur lainnya.

    9.329+3Perubahan bintang dalam 7 hari terakhir
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: Mesin TTS Multi-Suara dan Terkontrol-Prompt

    8.522-1Perubahan bintang dalam 7 hari terakhir
  • mlx-audio@Blaizzy

    Pustaka text-to-speech (TTS), speech-to-text (STT), dan speech-to-speech (STS) yang dibangun di atas framework MLX Apple, menyediakan analisis suara yang efisien di Apple Silicon.

    7.826+23Perubahan bintang dalam 7 hari terakhir
  • espeak-ng@espeak-ng

    eSpeak NG adalah penyintesis suara sumber terbuka yang mendukung lebih dari seratus bahasa dan aksen.

    6.802+13Perubahan bintang dalam 7 hari terakhir
  • StyleTTS2@yl4579

    StyleTTS 2: Menuju Text-to-Speech Setingkat Manusia melalui Style Diffusion dan Pelatihan Adversarial dengan Large Speech Language Models

    6.342+3Perubahan bintang dalam 7 hari terakhir
  • silero-models@snakers4

    Silero Models: model text-to-speech pra-latih yang dibuat sangat sederhana

    6.084-1Perubahan bintang dalam 7 hari terakhir
  • abogen@denizsafak

    Menghasilkan buku audio dari EPUB, PDF, dan teks dengan teks terjemahan (caption) yang disinkronkan.

    5.831+45Perubahan bintang dalam 7 hari terakhir
  • DiffSinger@MoonInTheRiver

    DiffSinger: Sintesis Suara Nyanyian melalui Mekanisme Difusi Dangkal (SVS & TTS); AAAI 2022; Kode resmi

    4.855+3Perubahan bintang dalam 7 hari terakhir
  • WhisperSpeech@WhisperSpeech

    Sistem text-to-speech Open Source yang dibangun dengan membalikkan Whisper.

    4.645+3Perubahan bintang dalam 7 hari terakhir
  • OpenUtau@openutau

    Platform sintesis menyanyi terbuka / Penerus UTAU sumber terbuka

    4.258+18Perubahan bintang dalam 7 hari terakhir
  • metavoice-src@metavoiceio

    Model dasar untuk TTS yang ekspresif dan mirip manusia

    4.203-1Perubahan bintang dalam 7 hari terakhir
  • RealtimeTTS@KoljaB

    Mengubah teks menjadi suara secara real-time.

    4.021+2Perubahan bintang dalam 7 hari terakhir
  • TensorFlowTTS@TensorSpeech

    TensorFlowTTS: Sintesis ucapan real-time mutakhir untuk Tensorflow 2 (mendukung bahasa Inggris, Prancis, Korea, Mandarin, Jerman, dan mudah diadaptasi untuk bahasa lain)

    3.996+0Perubahan bintang dalam 7 hari terakhir
  • lingvo@tensorflow

    Lingvo

    2.864+0Perubahan bintang dalam 7 hari terakhir
  • MARS5-TTS@Camb-ai

    Model ucapan (TTS) MARS5 dari CAMB.AI

    2.818+1Perubahan bintang dalam 7 hari terakhir
  • marytts@marytts

    MARY TTS — sistem sintesis text-to-speech multibahasa sumber terbuka yang ditulis dalam Java murni

    2.583+0Perubahan bintang dalam 7 hari terakhir
  • VieNeu-TTS@pnnbao97

    TTS bahasa Vietnam dengan kloning suara instan • On-device • Inferensi CPU real-time • Kualitas audio 24kHz

    2.468+21Perubahan bintang dalam 7 hari terakhir
  • hifi-gan@jik876

    HiFi-GAN: Generative Adversarial Networks untuk sintesis ucapan yang efisien dan fidelitas tinggi

    2.367+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik