Zum Hauptinhalt springen
buildradar
Sign in
Thema · voice-cloning

voice-cloning

Erfasste Open-Source-Repos mit dem Tag voice-cloning, sortiert nach Sternen.

41 Repos
  • vui@fluxions-ai

    Echtzeit-Sprachassistent — WebRTC-Streaming, faster-whisper ASR, lokales LLM, Vui Nano (300M) TTS. Kompatibel mit der OpenAI Realtime API. Sprachklonen, Barge-in, ca. 9-fache Echtzeit auf einer 4090. Apache 2.0.

    759+7Sterne-Änderung der letzten 7 Tage
  • MimikaStudio@BoltzmannEntropy

    MimikaStudio - Eine Local-First-Anwendung für macOS (Apple Silicon) + Agentic MCP Support

    735+4Sterne-Änderung der letzten 7 Tage
  • chatterbox-tts-api@travisvn

    Lokale, OpenAI-kompatible Text-to-Speech (TTS)-API mit Chatterbox, die es Benutzern ermöglicht, sprachgeklonten Ton überall dort zu erzeugen, wo die OpenAI-API verwendet wird (z. B. Open WebUI, AnythingLLM usw.)

    677+1Sterne-Änderung der letzten 7 Tage
  • Pandrator@lukaszliniewicz

    Konvertieren Sie PDFs und EPUBs in Hörbücher, Untertitel oder Videos in synchronisierte Videos (inklusive Übersetzung) und mehr. Kostenlos. Pandrator verwendet lokale Modelle, einschließlich Stimmklonen (sofortig, RVC-optimiert, XTTS-Feintuning) und LLM-Verarbeitung. Das Ziel ist eine benutzerfreundliche App mit GUI, Installationsprogramm und All-in-One-Paketen.

    620+3Sterne-Änderung der letzten 7 Tage
  • YouDub@liuzhao1225

    YouDub ist ein Open-Source-Tool, das die Übersetzung und Synchronisation von qualitativ hochwertigen YouTube-Videos automatisiert, um sie im chinesischen Internet zu verbreiten. Das Tool nutzt KI-Spracherkennungstechnologie, um Audio in Text umzuwandeln, übersetzt den Text anschließend mit Hilfe großer Sprachmodelle ins Chinesische und wandelt den chinesischen Text schließlich durch KI-Stimmklonen in Audio um. So lassen sich chinesisch synchronisierte Videos mit der Originalstimme des YouTubers erstellen.

    615-1Sterne-Änderung der letzten 7 Tage
  • ComfyUI-VibeVoice@wildminder

    ComfyUI-Custom-Node für VibeVoice TTS. Ausdrucksstarkes, langformatiges Konversations-Audio mit mehreren Sprechern

    596-1Sterne-Änderung der letzten 7 Tage
  • Modifizierte Version von Chatterbox, die Textdateien als Eingabe akzeptiert und keine Zeichenbeschränkungen hat. Ich verwende sie zur Erstellung von Hörbüchern, insbesondere für meine Kinder.

    575-1Sterne-Änderung der letzten 7 Tage
  • Lokale Ausführung von Qwen3-TTS Text-to-Speech auf dem Mac (M1/M2/M3/M4). Stimmenklonierung, Stimmendesign und benutzerdefinierte Stimmen. 100 % offline mittels MLX.

    561+2Sterne-Änderung der letzten 7 Tage
  • FlashLabs-Chroma@FlashLabs-AI-Corp

    Das weltweit erste Open-Source-Modell für Echtzeit-End-to-End-Sprachdialoge mit personalisiertem Voice-Cloning.

    549+0Sterne-Änderung der letzten 7 Tage
  • ComfyUI-OmniVoice-TTS@Saganaki22

    OmniVoice TTS-Knoten für ComfyUI – Zero-Shot-mehrsprachige Text-to-Speech mit Stimmklonen, Stimmdesign und Multi-Speaker-Dialogen

    544+5Sterne-Änderung der letzten 7 Tage
  • ComfyUI-VoxCPM@wildminder

    ComfyUI-Node für ausdrucksstarke Sprache und realistisches Zero-Shot Voice Cloning

    509-1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen