Lompat ke konten utama
buildradar
Sign in
Topik · voice-cloning

voice-cloning

Repositori open source terpantau bertanda voice-cloning, diurutkan berdasarkan bintang.

Repositori
41
Total bintang
355.522
Rata-rata bintang
8.671
Porsi
0,02%

Topik yang sering muncul berdampingan dengan voice-cloning di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda voice-cloning.

  • audio.cpp@0xShug0

    Mesin inferensi C++ murni yang lengkap untuk model audio, didukung oleh ggml. Mendukung TTS, STT, VAD, konversi suara, pembuatan musik, dan lainnya, dengan performa yang sangat dioptimalkan. Tanpa dependensi Python.

    2.214
  • GPT-SoVITS@RVC-Boss

    Data suara 1 menit pun bisa digunakan untuk melatih model TTS yang bagus! (few-shot voice cloning)

    61.476+138Perubahan bintang dalam 7 hari terakhir
  • Kloning suara dalam 5 detik untuk menghasilkan ucapan arbitrer secara real-time.

    60.117-4Perubahan bintang dalam 7 hari terakhir
  • TTS@coqui-ai

    🐸💬 - toolkit deep learning untuk Text-to-Speech, teruji dalam penelitian dan produksi

    45.985+18Perubahan bintang dalam 7 hari terakhir
  • VoxCPM@OpenBMB

    VoxCPM2: TTS tanpa tokenizer untuk pembuatan ucapan multibahasa, desain suara kreatif, dan kloning suara yang realistis

    36.595+345Perubahan bintang dalam 7 hari terakhir
  • CosyVoice@QwenAudio

    Model generasi suara besar multibahasa, menyediakan kemampuan full-stack untuk inferensi, pelatihan, dan penerapan.

    23.426+359Perubahan bintang dalam 7 hari terakhir
  • ebook2audiobook@DrewThomasson

    Hasilkan buku audio dari e-book, kloning suara, & 1158+ bahasa!

    20.097+34Perubahan bintang dalam 7 hari terakhir
  • VideoLingo@Huanshere

    Pemotongan, penerjemahan, penyelarasan, dan bahkan sulih suara (dubbing) subtitle tingkat Netflix - tim subtitle video AI otomatis sekali klik.

    18.339+49Perubahan bintang dalam 7 hari terakhir
  • VoiceStudio@debpalash

    VoiceStudio adalah alternatif ElevenLabs sumber terbuka yang sepenuhnya lokal — kloning suara, desain suara, sulih suara video, dikte, transkripsi, & pembuatan buku audio dalam 646 bahasa.

    14.835+2.880Perubahan bintang dalam 7 hari terakhir
  • voice-pro@abus-aikorea

    Gradio WebUI untuk kreator dan pengembang, menampilkan TTS utama (Edge-TTS, kokoro) dan Kloning Suara zero-shot (E2 & F5-TTS, CosyVoice), dengan pemrosesan audio Whisper, unduhan YouTube, isolasi vokal Demucs, dan terjemahan multibahasa.

    12.730+54Perubahan bintang dalam 7 hari terakhir
  • PaddleSpeech@PaddlePaddle

    Toolkit Speech yang mudah digunakan mencakup model Self-Supervised Learning, SOTA/Streaming ASR dengan tanda baca, Streaming TTS dengan frontend teks, Sistem Verifikasi Pembicara, End-to-End Speech Translation, dan Keyword Spotting. Pemenang Penghargaan Demo Terbaik NAACL2022.

    12.676+5Perubahan bintang dalam 7 hari terakhir
  • YuE@multimodal-art-projection

    YuE: Model Fondasi Generasi Musik Lagu Penuh Terbuka, mirip dengan Suno.ai tetapi bersifat terbuka

    6.416+8Perubahan bintang dalam 7 hari terakhir
  • YouDub-webui@liuzhao1225

    Alat lokalisasi video AI sumber terbuka: otomatis mengunduh video YouTube/Bilibili, mengenali dan menerjemahkan subtitle, kloning suara, mencampur trek audio, dan menyematkan subtitle.

    5.404+25Perubahan bintang dalam 7 hari terakhir
  • MOSS-TTS@OpenMOSS

    MOSS‑TTS Family adalah keluarga model pembuatan suara dan ucapan open‑source dari MOSI.AI dan tim OpenMOSS. Dirancang untuk skenario dunia nyata yang sangat akurat, sangat ekspresif, dan kompleks, mencakup ucapan berdurasi panjang yang stabil, dialog multi-pembicara, desain suara/karakter, efek suara lingkungan, dan TTS streaming waktu nyata.

    4.058+18Perubahan bintang dalam 7 hari terakhir
  • Applio@IAHispano

    Alat konversi suara yang sederhana dan berkualitas tinggi dengan fokus pada kemudahan penggunaan dan performa.

    3.674+14Perubahan bintang dalam 7 hari terakhir
  • MARS5-TTS@Camb-ai

    Model ucapan (TTS) MARS5 dari CAMB.AI

    2.818+1Perubahan bintang dalam 7 hari terakhir
  • audio.cpp@0xShug0

    Mesin inferensi C++ murni yang lengkap untuk model audio, didukung oleh ggml. Mendukung TTS, STT, VAD, konversi suara, pembuatan musik, dan lainnya, dengan performa yang sangat dioptimalkan. Tanpa dependensi Python.

    2.214+115Perubahan bintang dalam 7 hari terakhir
  • Genie-TTS@High-Logic

    Mesin Inferensi & Konverter Model GPT-SoVITS ONNX

    1.760+3Perubahan bintang dalam 7 hari terakhir
  • MiniMax-MCP@MiniMax-AI

    Server Model Context Protocol (MCP) resmi dari MiniMax yang memungkinkan interaksi dengan API Text to Speech, pembuatan gambar, dan pembuatan video yang canggih.

    1.573+2Perubahan bintang dalam 7 hari terakhir
  • VibeVoice-ComfyUI@Enemyx-net

    Integrasi ComfyUI yang komprehensif untuk model text-to-speech VibeVoice dari Microsoft, memungkinkan sintesis suara tunggal dan multi-pembicara berkualitas tinggi langsung di dalam alur kerja ComfyUI Anda.

    1.555+4Perubahan bintang dalam 7 hari terakhir
  • Voice-Cloning-App@voice-cloning-app

    Aplikasi Python/Pytorch untuk mensintesis suara manusia dengan mudah

    1.440+0Perubahan bintang dalam 7 hari terakhir
  • Host sendiri model TTS Chatterbox yang kuat. Server ini menawarkan Web UI yang ramah pengguna, endpoint API yang fleksibel (termasuk kompatibel dengan OpenAI), suara prasetel, kloning suara, dan pemrosesan teks skala buku audio besar. Berjalan dipercepat di NVIDIA (CUDA), AMD (ROCm), dan CPU.

    1.427+1Perubahan bintang dalam 7 hari terakhir
  • 💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya

    1.399+0Perubahan bintang dalam 7 hari terakhir
  • Twocast@panyanyany

    Generator Podcast AI untuk episode bilingual, Multi Bahasa, Alternatif untuk NotebookLLM; Generator podcast AI percakapan manusia, multi-bahasa, multi-suara

    1.289-1Perubahan bintang dalam 7 hari terakhir
  • audio-webui@gitmylo

    Antarmuka web (webui) untuk berbagai Jaringan Saraf Tiruan terkait audio

    1.246+0Perubahan bintang dalam 7 hari terakhir
  • Irodori-TTS@Aratako

    Model Text-to-Speech berbasis Flow Matching dengan Kontrol Gaya berbasis Emoji

    1.228+4Perubahan bintang dalam 7 hari terakhir
  • TTS-Audio-Suite@diodiogod

    Integrasi node kustom ComfyUI untuk Text-to-Speech dan Konversi Suara multi-mesin multi-bahasa lokal. Mendukung: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (klasik dan multilingual), F5-TTS, Higgs Audio 2, 3, dan VibeVoice dengan panjang teks tak terbatas, penentuan waktu SRT, dukungan Karakter, dan banyak alat audio

    1.187+7Perubahan bintang dalam 7 hari terakhir
  • mlx-serve@ddalcu

    Server inferensi LLM native untuk Apple Silicon. Kompatibel dengan API OpenAI + Anthropic. Tanpa Python. Termasuk aplikasi macOS MLX Core dengan obrolan, mode agen, dan pemanggilan alat.

    1.115+245Perubahan bintang dalam 7 hari terakhir
  • alexandria-audiobook@Finrandojin

    Generator buku audio multi-suara berbasis AI — anotasi skrip LLM, kloning suara, desain suara, pelatihan LoRA, kontrol gaya per baris, dan ekspor ke MP3, M4B dengan bab, atau multi-track Audacity. Dibangun di atas Qwen3-TTS.

    999+17Perubahan bintang dalam 7 hari terakhir
  • Step-Audio-EditX@stepfun-ai

    Model pengeditan audio Reinforcement Learning berbasis LLM dengan 3B parameter yang kuat, unggul dalam mengedit emosi, gaya bicara, dan paralinguistik, serta dilengkapi teks-ke-suara zero-shot yang tangguh

    972+1Perubahan bintang dalam 7 hari terakhir
  • CloneTTS@sipeter

    Engine Text-to-Speech (TTS) Android ringan dan luring yang memungkinkan kloning suara seluruh sistem yang mulus dan pembacaan teks berketepatan tinggi.

    803+2Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik