text-to-speech
Erfasste Open-Source-Repos mit dem Tag text-to-speech, sortiert nach Sternen.
- #121
Flutter Text-to-Speech-Paket
★ 753+0Sterne-Änderung der letzten 7 Tage - #122
🔊 Kokoro Web: Kostenlose KI-Sprachausgabe (Text-to-Speech), online oder selbst gehostet, OpenAI-kompatibel!
★ 733+2Sterne-Änderung der letzten 7 Tage - #123
Rapida ist eine Open-Source-End-to-End-Voice-AI-Orchestrierungsplattform zum Erstellen von Echtzeit-Sprachassistenten mit Audiostreaming, STT, TTS, VAD, Mehrkanalintegration, Agenten-Zustandsverwaltung und Observability.
★ 723+4Sterne-Änderung der letzten 7 Tage - #124★ 718-1Sterne-Änderung der letzten 7 Tage
- #125
Implementierung von Voicebox, einem neuen SOTA Text-to-Speech-Netzwerk von MetaAI, in PyTorch.
★ 703+0Sterne-Änderung der letzten 7 Tage - #126
Vollautomatischer Video-Maker, der Motion Graphics und Text-to-Speech-Synthese nutzt, um Newsletter in tägliche YouTube-Videos zu verwandeln.
★ 703+0Sterne-Änderung der letzten 7 Tage - #127
Offline-Spracherkennung mit OpenAI Whisper und TensorFlow Lite für Android
★ 689+1Sterne-Änderung der letzten 7 Tage - #128
Lokale, OpenAI-kompatible Text-to-Speech (TTS)-API mit Chatterbox, die es Benutzern ermöglicht, sprachgeklonten Ton überall dort zu erzeugen, wo die OpenAI-API verwendet wird (z. B. Open WebUI, AnythingLLM usw.)
★ 677+1Sterne-Änderung der letzten 7 Tage - #129
📚 Eine anpassbare Wörterbucherweiterung, die Doppelklick-Nachschlagen in über 20 Sprachen, mehr als 1000 Wörterbücher, Text-zu-Sprache, Übersetzung und Anki-Integration unterstützt.
★ 671+1Sterne-Änderung der letzten 7 Tage - #130
LLaSA: Skalierung von Trainings- und Inferenz-Rechenleistung für LLaMA-basierte Sprachsynthese
★ 658+1Sterne-Änderung der letzten 7 Tage - #131
Implementierung von F5-TTS in MLX
★ 644+0Sterne-Änderung der letzten 7 Tage - #132★ 626+2Sterne-Änderung der letzten 7 Tage
- #133
Konvertieren Sie PDFs und EPUBs in Hörbücher, Untertitel oder Videos in synchronisierte Videos (inklusive Übersetzung) und mehr. Kostenlos. Pandrator verwendet lokale Modelle, einschließlich Stimmklonen (sofortig, RVC-optimiert, XTTS-Feintuning) und LLM-Verarbeitung. Das Ziel ist eine benutzerfreundliche App mit GUI, Installationsprogramm und All-in-One-Paketen.
★ 620+3Sterne-Änderung der letzten 7 Tage - #134
Einfaches Python-Skript zur Interaktion mit der TikTok TTS-API
★ 611+0Sterne-Änderung der letzten 7 Tage - #135
ComfyUI-Custom-Node für VibeVoice TTS. Ausdrucksstarkes, langformatiges Konversations-Audio mit mehreren Sprechern
★ 596-1Sterne-Änderung der letzten 7 Tage - #136
Modifizierte Version von Chatterbox, die Textdateien als Eingabe akzeptiert und keine Zeichenbeschränkungen hat. Ich verwende sie zur Erstellung von Hörbüchern, insbesondere für meine Kinder.
★ 575-1Sterne-Änderung der letzten 7 Tage - #137
Das selbstkodierende System für Ihre App – Alan AI SDK für React Native.
★ 575+0Sterne-Änderung der letzten 7 Tage - #138
Lokale Ausführung von Qwen3-TTS Text-to-Speech auf dem Mac (M1/M2/M3/M4). Stimmenklonierung, Stimmendesign und benutzerdefinierte Stimmen. 100 % offline mittels MLX.
★ 561+2Sterne-Änderung der letzten 7 Tage - #139
Eine kuratierte Liste von Forschungsarbeiten zur LLM-basierten multimodalen Generierung (Bild, Video, 3D und Audio).
★ 552+0Sterne-Änderung der letzten 7 Tage - #140
Orpheus 3B lokal mit LM Studio ausführen.
★ 549+0Sterne-Änderung der letzten 7 Tage - #141
Inoffizielle vits2-TTS-Implementierung in PyTorch
★ 549+1Sterne-Änderung der letzten 7 Tage - #142
AI Plugin ist eine leistungsstarke Erweiterung für Payload CMS, die fortschrittliche KI-Funktionen zur Optimierung der Inhaltserstellung und -verwaltung integriert.
★ 547-1Sterne-Änderung der letzten 7 Tage - #143
OmniVoice TTS-Knoten für ComfyUI – Zero-Shot-mehrsprachige Text-to-Speech mit Stimmklonen, Stimmdesign und Multi-Speaker-Dialogen
★ 545+6Sterne-Änderung der letzten 7 Tage - #144
Blitzschnelle, kostenlose und lokale Sprachdiktat-Software für macOS mit On-Device-Transkription
★ 544+13Sterne-Änderung der letzten 7 Tage - #145★ 525+2Sterne-Änderung der letzten 7 Tage
- #146
Implementierung von E2-TTS, "Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS", in Pytorch.
★ 517+0Sterne-Änderung der letzten 7 Tage - #147
Ein vietnamesisches Text-to-Speech-Modell für Voice Cloning
★ 516-1Sterne-Änderung der letzten 7 Tage - #148
Open-Source, lokaler und selbst gehosteter, hochoptimierter Sprachinferenz-Server mit Unterstützung für ASR/STT, TTS und LLM über WebRTC, REST und WS.
★ 512+0Sterne-Änderung der letzten 7 Tage - #149
ComfyUI-Node für ausdrucksstarke Sprache und realistisches Zero-Shot Voice Cloning
★ 509+0Sterne-Änderung der letzten 7 Tage - #150
An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.
★ 505+4Sterne-Änderung der letzten 7 Tage