Lompat ke konten utama
buildradar
Sign in
Topik · text-to-speech

text-to-speech

Repositori open source terpantau bertanda text-to-speech, diurutkan berdasarkan bintang.

Repositori
150
Total bintang
955.097
Rata-rata bintang
6.367
Porsi
0,05%

Topik yang sering muncul berdampingan dengan text-to-speech di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda text-to-speech.

  • qwen-audio-agent@QwenAudio

    Runtime suara real-time yang menjaga Agen tetap berbicara, bekerja, dan hadir. Runtime Suara Real-time untuk Agen AI.

    2.377
  • audio.cpp@0xShug0

    Mesin inferensi C++ murni yang lengkap untuk model audio, didukung oleh ggml. Mendukung TTS, STT, VAD, konversi suara, pembuatan musik, dan lainnya, dengan performa yang sangat dioptimalkan. Tanpa dependensi Python.

    2.214
  • ai-video-editor@MartinDelophy

    Editor video sumber terbuka berbasis lokal di mana kreator dan agen AI mengedit garis waktu nyata yang sama.

    792
  • Alat penerjemah layar real-time Android sumber terbuka tanpa ROOT, cocok untuk game, novel visual, dan manga. Mendukung OCR perangkat dan cloud, LLM offline, berbagai layanan terjemahan, dan text-to-speech (TTS), dengan terjemahan yang langsung ditampilkan di layar.

    786
  • Talkify@tornikegomareli

    Dikte suara lokal yang sangat cepat, gratis, dan mengutamakan privasi untuk macOS dengan transkripsi pada perangkat

    541
  • MoneyPrinterTurbo@harry0703

    Hasilkan video pendek HD dari topik atau kata kunci dengan alur kerja AI otomatis.

    119.977+1.509Perubahan bintang dalam 7 hari terakhir
  • unsloth@unslothai

    UI lokal untuk menjalankan dan melatih LLM serta model difusi, termasuk Qwen3.8, Kimi K3, MiniMax-H3, Gemma 4, DeepSeek-V4, FLUX, dan lainnya.

    75.515+337Perubahan bintang dalam 7 hari terakhir
  • GPT-SoVITS@RVC-Boss

    Data suara 1 menit pun bisa digunakan untuk melatih model TTS yang bagus! (few-shot voice cloning)

    61.476+138Perubahan bintang dalam 7 hari terakhir
  • OpenMontage@calesthio

    Sistem produksi video berbasis agen sumber terbuka pertama di dunia. 12 alur kerja produksi, 100+ alat, 700+ keterampilan agen, dan file pengetahuan produksi. Ubah asisten pengodean AI Anda menjadi studio produksi video lengkap.

    55.719+1.707Perubahan bintang dalam 7 hari terakhir
  • TTS@coqui-ai

    🐸💬 - toolkit deep learning untuk Text-to-Speech, teruji dalam penelitian dan produksi

    45.985+18Perubahan bintang dalam 7 hari terakhir
  • ChatTTS@2noise

    Model ucapan generatif untuk dialog sehari-hari.

    39.814+9Perubahan bintang dalam 7 hari terakhir
  • OpenVoice@myshell-ai

    Kloning suara instan oleh MIT dan MyShell. Model dasar audio.

    37.419+61Perubahan bintang dalam 7 hari terakhir
  • MockingBird@babysor

    🚀 Kloning suara dalam 5 detik untuk menghasilkan ucapan arbitrer secara real-time.

    36.912+0Perubahan bintang dalam 7 hari terakhir
  • VoxCPM@OpenBMB

    VoxCPM2: TTS tanpa tokenizer untuk pembuatan ucapan multibahasa, desain suara kreatif, dan kloning suara yang realistis

    36.595+345Perubahan bintang dalam 7 hari terakhir
  • index-tts@index-tts

    Sistem Text-To-Speech Zero-Shot yang efisien dan dapat dikontrol untuk tingkat industri

    23.686+109Perubahan bintang dalam 7 hari terakhir
  • CosyVoice@QwenAudio

    Model generasi suara besar multibahasa, menyediakan kemampuan full-stack untuk inferensi, pelatihan, dan penerapan.

    23.426+359Perubahan bintang dalam 7 hari terakhir
  • dia@nari-labs

    Model TTS yang mampu menghasilkan dialog ultra-realistis dalam satu kali proses.

    19.387+2Perubahan bintang dalam 7 hari terakhir
  • pyvideotrans@jianchang512

    Menerjemahkan video dari satu bahasa ke bahasa lain serta menyematkan sulih suara dan takarir.

    18.871+38Perubahan bintang dalam 7 hari terakhir
  • leon@leon-ai

    Leon adalah asisten pribadi open source Anda.

    17.476+1Perubahan bintang dalam 7 hari terakhir
  • VoiceStudio@debpalash

    VoiceStudio adalah alternatif ElevenLabs sumber terbuka yang sepenuhnya lokal — kloning suara, desain suara, sulih suara video, dikte, transkripsi, & pembuatan buku audio dalam 646 bahasa.

    14.835+2.880Perubahan bintang dalam 7 hari terakhir
  • sherpa-onnx@k2-fsa

    Speech-to-text, text-to-speech, speaker diarization, peningkatan kualitas suara, pemisahan sumber, dan VAD menggunakan next-gen Kaldi dengan onnxruntime tanpa koneksi internet. Mendukung sistem embedded, Android, iOS, HarmonyOS, Raspberry Pi, RISC-V, RK NPU, Axera NPU, Ascend NPU, server x86_64, websocket server/client, serta mendukung 12 bahasa pemrograman.

    14.575+95Perubahan bintang dalam 7 hari terakhir
  • supertonic@supertone-inc

    TTS multibahasa yang sangat cepat dan berjalan di perangkat — dijalankan secara native melalui ONNX.

    13.757+20Perubahan bintang dalam 7 hari terakhir
  • voice-pro@abus-aikorea

    Gradio WebUI untuk kreator dan pengembang, menampilkan TTS utama (Edge-TTS, kokoro) dan Kloning Suara zero-shot (E2 & F5-TTS, CosyVoice), dengan pemrosesan audio Whisper, unduhan YouTube, isolasi vokal Demucs, dan terjemahan multibahasa.

    12.730+54Perubahan bintang dalam 7 hari terakhir
  • edge-tts@rany2

    Gunakan layanan text-to-speech daring Microsoft Edge dari Python TANPA memerlukan Microsoft Edge, Windows, atau kunci API

    11.847+29Perubahan bintang dalam 7 hari terakhir
  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) adalah toolkit untuk Pembuatan Audio, Musik, dan Ucapan. Tujuannya adalah untuk mendukung penelitian yang dapat direproduksi dan membantu para peneliti serta insinyur junior untuk memulai di bidang penelitian dan pengembangan pembuatan audio, musik, dan ucapan.

    10.276+1Perubahan bintang dalam 7 hari terakhir
  • espnet@espnet

    Toolkit Pemrosesan Suara End-to-End

    9.949+3Perubahan bintang dalam 7 hari terakhir
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: Mesin TTS Multi-Suara dan Terkontrol-Prompt

    8.522-1Perubahan bintang dalam 7 hari terakhir
  • mlx-audio@Blaizzy

    Pustaka text-to-speech (TTS), speech-to-text (STT), dan speech-to-speech (STS) yang dibangun di atas framework MLX Apple, menyediakan analisis suara yang efisien di Apple Silicon.

    7.826+23Perubahan bintang dalam 7 hari terakhir
  • MeloTTS@myshell-ai

    Pustaka text-to-speech multibahasa berkualitas tinggi oleh MyShell.ai. Mendukung bahasa Inggris, Spanyol, Prancis, Mandarin, Jepang, dan Korea.

    7.616+7Perubahan bintang dalam 7 hari terakhir
  • espeak-ng@espeak-ng

    eSpeak NG adalah penyintesis suara sumber terbuka yang mendukung lebih dari seratus bahasa dan aksen.

    6.802+13Perubahan bintang dalam 7 hari terakhir
  • argmax-oss-swift@argmaxinc

    AI Suara On-device untuk Apple Silicon

    6.353+8Perubahan bintang dalam 7 hari terakhir
  • StyleTTS2@yl4579

    StyleTTS 2: Menuju Text-to-Speech Setingkat Manusia melalui Style Diffusion dan Pelatihan Adversarial dengan Large Speech Language Models

    6.342+3Perubahan bintang dalam 7 hari terakhir
  • Awesome-Prompt-Engineering@promptslab

    Repositori ini berisi sumber daya yang dipilih secara manual untuk Prompt Engineering dengan fokus pada Generative Pre-trained Transformer (GPT), ChatGPT, PaLM, dll.

    6.306+7Perubahan bintang dalam 7 hari terakhir
  • silero-models@snakers4

    Silero Models: model text-to-speech pra-latih yang dibuat sangat sederhana

    6.084-1Perubahan bintang dalam 7 hari terakhir
  • ODS@Osmantic

    Ubah PC, Mac, atau perangkat Linux Anda menjadi server AI. Inferensi LLM, UI obrolan, suara, agen, alur kerja, RAG, dan pembuatan gambar.

    5.931+1.108Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik