Lompat ke konten utama
buildradar
Masuk
Topik · text-to-speech

text-to-speech

Repositori open source terpantau bertanda text-to-speech, diurutkan berdasarkan bintang.

150 repositori
  • RHVoice@RHVoice

    sintesis suara sumber terbuka gratis untuk bahasa Rusia dan bahasa lainnya

    1.836+0Perubahan bintang dalam 7 hari terakhir
  • Sistem Pengodean Mandiri untuk Aplikasi Anda — Alan AI SDK untuk Android

    1.807+0Perubahan bintang dalam 7 hari terakhir
  • Genie-TTS@High-Logic

    Mesin Inferensi & Konverter Model GPT-SoVITS ONNX

    1.760+0Perubahan bintang dalam 7 hari terakhir
  • Sistem pengkodean mandiri untuk aplikasi Anda — Alan AI SDK untuk Flutter

    1.756+0Perubahan bintang dalam 7 hari terakhir
  • Secara otomatis menerjemahkan teks video berdasarkan file subtitle, lalu menggunakan layanan suara AI untuk membuat trek audio sulih suara & terjemahan baru dengan ucapan yang disinkronkan menggunakan waktu subtitle.

    1.746+0Perubahan bintang dalam 7 hari terakhir
  • read-aloud@ken107

    Ekstensi peramban hebat yang membacakan konten halaman web dengan satu klik

    1.737+0Perubahan bintang dalam 7 hari terakhir
  • react-native-executorch@software-mansion

    Cara deklaratif untuk menjalankan model AI di React Native secara on-device, didukung oleh ExecuTorch.

    1.707+0Perubahan bintang dalam 7 hari terakhir
  • alan-sdk-ionic@alan-ai

    Sistem Pengodean Mandiri untuk Aplikasi Anda — Alan AI SDK untuk Ionic

    1.649+0Perubahan bintang dalam 7 hari terakhir
  • ParallelWaveGAN@kan-bayashi

    Parallel WaveGAN Tidak Resmi (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN) dengan Pytorch

    1.646+0Perubahan bintang dalam 7 hari terakhir
  • dsnote@mkiol

    Aplikasi Linux Speech Note. Mencatat, membaca, dan menerjemahkan dengan Speech to Text, Text to Speech, dan terjemahan mesin secara luring.

    1.622+0Perubahan bintang dalam 7 hari terakhir
  • video-podcast-maker@Agents365-ai

    Topik → Video bernarasi 4K untuk agen coding. v4.0: semua TTS melalui komponen mesin ttsCN (11 platform termasuk kloning suara MiniMax, sinkronisasi subtitle tingkat kata asli), Mesin Aset berbasis manifes, komposisi Remotion, pembuatan AI berbatas biaya.

    1.599+0Perubahan bintang dalam 7 hari terakhir
  • MiniMax-MCP@MiniMax-AI

    Server Model Context Protocol (MCP) resmi dari MiniMax yang memungkinkan interaksi dengan API Text to Speech, pembuatan gambar, dan pembuatan video yang canggih.

    1.573+0Perubahan bintang dalam 7 hari terakhir
  • vllm-mlx@waybarrios

    Server inferensi LLM yang kompatibel dengan OpenAI dan Anthropic berkinerja tinggi untuk Apple Silicon. Dilengkapi MLX asli, continuous batching, model multimodal, pemanggilan alat MCP, dan dukungan Claude Code.

    1.557+0Perubahan bintang dalam 7 hari terakhir
  • VibeVoice-ComfyUI@Enemyx-net

    Integrasi ComfyUI yang komprehensif untuk model text-to-speech VibeVoice dari Microsoft, memungkinkan sintesis suara tunggal dan multi-pembicara berkualitas tinggi langsung di dalam alur kerja ComfyUI Anda.

    1.555+0Perubahan bintang dalam 7 hari terakhir
  • soprano@ekwek1

    Soprano: Text-to-Speech Instan yang Sangat Realistis

    1.548+0Perubahan bintang dalam 7 hari terakhir
  • RCLI@RunanywhereAI

    Bicaralah dengan Mac Anda, kueri dokumen Anda, tidak perlu cloud. AI suara di perangkat + RAG

    1.542+0Perubahan bintang dalam 7 hari terakhir
  • TalkingHead@met4citizen

    Talking Head (3D): Kelas JavaScript untuk sinkronisasi bibir waktu nyata menggunakan avatar 3D seluruh tubuh.

    1.522+0Perubahan bintang dalam 7 hari terakhir
  • Voice-Cloning-App@voice-cloning-app

    Aplikasi Python/Pytorch untuk mensintesis suara manusia dengan mudah

    1.440+0Perubahan bintang dalam 7 hari terakhir
  • OuteTTS@edwko

    Antarmuka untuk model OuteTTS.

    1.437+0Perubahan bintang dalam 7 hari terakhir
  • Host sendiri model TTS Chatterbox yang kuat. Server ini menawarkan Web UI yang ramah pengguna, endpoint API yang fleksibel (termasuk kompatibel dengan OpenAI), suara prasetel, kloning suara, dan pemrosesan teks skala buku audio besar. Berjalan dipercepat di NVIDIA (CUDA), AMD (ROCm), dan CPU.

    1.427+0Perubahan bintang dalam 7 hari terakhir
  • Speech-AI-Forge@lenML

    🍦 Speech-AI-Forge adalah proyek yang dikembangkan di sekitar model generasi TTS, mengimplementasikan API Server dan WebUI berbasis Gradio.

    1.418+0Perubahan bintang dalam 7 hari terakhir
  • SoniTranslate@R3gm

    Terjemahan Tersinkronisasi untuk Video. Sulih suara video

    1.413+0Perubahan bintang dalam 7 hari terakhir
  • 💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya

    1.399+0Perubahan bintang dalam 7 hari terakhir
  • mlx-tune@ARahim3

    Fine-tune LLM di Mac Anda dengan Apple Silicon. SFT, DPO, GRPO, Vision, TTS, STT, Embedding, dan fine-tuning OCR — secara native di MLX. API yang kompatibel dengan Unsloth.

    1.398+0Perubahan bintang dalam 7 hari terakhir
  • Matcha-TTS@shivammehta25

    [ICASSP 2024] 🍵 Matcha-TTS: Arsitektur TTS cepat dengan pencocokan alur bersyarat

    1.353+0Perubahan bintang dalam 7 hari terakhir
  • WavTokenizer@jishengpeng

    [ICLR 2025] Model codec akustik diskret SOTA dengan 40/75 token per detik untuk pemodelan bahasa audio

    1.317+0Perubahan bintang dalam 7 hari terakhir
  • airunner@Capsize-Games

    Mesin inferensi luring untuk seni, percakapan suara waktu nyata, chatbot bertenaga LLM, dan alur kerja otomatis

    1.314+0Perubahan bintang dalam 7 hari terakhir
  • StreamSpeech@ictnlp

    StreamSpeech adalah model "All in One" yang mulus untuk pengenalan suara offline dan simultan, terjemahan suara, serta sintesis suara.

    1.288+0Perubahan bintang dalam 7 hari terakhir
  • audio-webui@gitmylo

    Antarmuka web (webui) untuk berbagai Jaringan Saraf Tiruan terkait audio

    1.246+0Perubahan bintang dalam 7 hari terakhir
  • Irodori-TTS@Aratako

    Model Text-to-Speech berbasis Flow Matching dengan Kontrol Gaya berbasis Emoji

    1.228+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik