voice-cloning
Erfasste Open-Source-Repos mit dem Tag voice-cloning, sortiert nach Sternen.
- #31
Echtzeit-Sprachassistent — WebRTC-Streaming, faster-whisper ASR, lokales LLM, Vui Nano (300M) TTS. Kompatibel mit der OpenAI Realtime API. Sprachklonen, Barge-in, ca. 9-fache Echtzeit auf einer 4090. Apache 2.0.
★ 759+7Sterne-Änderung der letzten 7 Tage - #32
MimikaStudio - Eine Local-First-Anwendung für macOS (Apple Silicon) + Agentic MCP Support
★ 735+4Sterne-Änderung der letzten 7 Tage - #33
Lokale, OpenAI-kompatible Text-to-Speech (TTS)-API mit Chatterbox, die es Benutzern ermöglicht, sprachgeklonten Ton überall dort zu erzeugen, wo die OpenAI-API verwendet wird (z. B. Open WebUI, AnythingLLM usw.)
★ 677+1Sterne-Änderung der letzten 7 Tage - #34
Konvertieren Sie PDFs und EPUBs in Hörbücher, Untertitel oder Videos in synchronisierte Videos (inklusive Übersetzung) und mehr. Kostenlos. Pandrator verwendet lokale Modelle, einschließlich Stimmklonen (sofortig, RVC-optimiert, XTTS-Feintuning) und LLM-Verarbeitung. Das Ziel ist eine benutzerfreundliche App mit GUI, Installationsprogramm und All-in-One-Paketen.
★ 620+3Sterne-Änderung der letzten 7 Tage - #35
YouDub ist ein Open-Source-Tool, das die Übersetzung und Synchronisation von qualitativ hochwertigen YouTube-Videos automatisiert, um sie im chinesischen Internet zu verbreiten. Das Tool nutzt KI-Spracherkennungstechnologie, um Audio in Text umzuwandeln, übersetzt den Text anschließend mit Hilfe großer Sprachmodelle ins Chinesische und wandelt den chinesischen Text schließlich durch KI-Stimmklonen in Audio um. So lassen sich chinesisch synchronisierte Videos mit der Originalstimme des YouTubers erstellen.
★ 615-1Sterne-Änderung der letzten 7 Tage - #36
ComfyUI-Custom-Node für VibeVoice TTS. Ausdrucksstarkes, langformatiges Konversations-Audio mit mehreren Sprechern
★ 596-1Sterne-Änderung der letzten 7 Tage - #37
Modifizierte Version von Chatterbox, die Textdateien als Eingabe akzeptiert und keine Zeichenbeschränkungen hat. Ich verwende sie zur Erstellung von Hörbüchern, insbesondere für meine Kinder.
★ 575-1Sterne-Änderung der letzten 7 Tage - #38
Lokale Ausführung von Qwen3-TTS Text-to-Speech auf dem Mac (M1/M2/M3/M4). Stimmenklonierung, Stimmendesign und benutzerdefinierte Stimmen. 100 % offline mittels MLX.
★ 561+2Sterne-Änderung der letzten 7 Tage - #39
Das weltweit erste Open-Source-Modell für Echtzeit-End-to-End-Sprachdialoge mit personalisiertem Voice-Cloning.
★ 549+0Sterne-Änderung der letzten 7 Tage - #40
OmniVoice TTS-Knoten für ComfyUI – Zero-Shot-mehrsprachige Text-to-Speech mit Stimmklonen, Stimmdesign und Multi-Speaker-Dialogen
★ 544+5Sterne-Änderung der letzten 7 Tage - #41
ComfyUI-Node für ausdrucksstarke Sprache und realistisches Zero-Shot Voice Cloning
★ 509-1Sterne-Änderung der letzten 7 Tage