tts
Erfasste Open-Source-Repos mit dem Tag tts, sortiert nach Sternen.
- #31
Eine einfache lokale Web-Benutzeroberfläche, die ChatTTS verwendet, um Text in Sprache zu synthetisieren, und gleichzeitig die Bereitstellung externer API-Schnittstellen unterstützt.
★ 7.648+4Sterne-Änderung der letzten 7 Tage - #32
Hochwertige, mehrsprachige Text-to-Speech-Bibliothek von MyShell.ai. Unterstützt Englisch, Spanisch, Französisch, Chinesisch, Japanisch und Koreanisch.
★ 7.616+7Sterne-Änderung der letzten 7 Tage - #33
wukong-robot ist ein einfaches, flexibles und elegantes chinesisches Sprach-Chatbot- und Smart-Speaker-Projekt mit ChatGPT-Unterstützung.
★ 7.126+2Sterne-Änderung der letzten 7 Tage - #34
StyleTTS 2: Annäherung an menschliche Sprachsynthese durch Style Diffusion und adversariales Training mit großen Sprachmodellen für Sprache
★ 6.342+3Sterne-Änderung der letzten 7 Tage - #35
Auf dem Weg zu menschlich klingender Sprache
★ 6.324+5Sterne-Änderung der letzten 7 Tage - #36★ 6.103+1Sterne-Änderung der letzten 7 Tage
- #37
Silero Models: Vorab trainierte Text-to-Speech-Modelle, denkbar einfach gestaltet
★ 6.084-1Sterne-Änderung der letzten 7 Tage - #38★ 5.831+45Sterne-Änderung der letzten 7 Tage
- #39
Dockerisierter OpenAI-kompatibler Wrapper für Kokoro-82M Text-to-Speech mit Unterstützung für Multiplatform-CPU, AMD- und NVIDIA-GPU PyTorch; mehrere Sprecher, Sprachmischung, automatisches Zusammenfügen, Caption-Zeitstempel, SSML und Readalong-Web-UI
★ 5.399+19Sterne-Änderung der letzten 7 Tage - #40
Eine universelle AIGC-Video-Engine: Vom Skript zum fertigen Film in einer Pipeline – Dramen, Werbung, Produktvideos, Otome-Spiele und mehr.
★ 4.900+384Sterne-Änderung der letzten 7 Tage - #41
:DiffSinger: Gesangssynthese über flachen Diffusionsmechanismus (SVS & TTS); AAAI 2022; Offizieller Code
★ 4.855+3Sterne-Änderung der letzten 7 Tage - #42
Ein Open-Source-Text-to-Speech-System, entwickelt durch Invertieren von Whisper.
★ 4.645+3Sterne-Änderung der letzten 7 Tage - #43
Dies ist eine Android-System-TTS-App mit integrierter Microsoft-Demo-Schnittstelle, anpassbaren HTTP-Anfragen, der Möglichkeit, andere lokale TTS-Engines zu importieren, sowie Vorlesefunktionen basierend auf einfachen chinesischen Anführungszeichen für Erzählung/Dialog, automatischer Wiederholung, Backup-Konfigurationen, Textersetzung und weiteren Funktionen.
★ 4.488+5Sterne-Änderung der letzten 7 Tage - #44
MOSS-TTS-Nano ist ein Open-Source-Modell zur mehrsprachigen Miniatur-Sprachgenerierung von MOSI.AI und dem OpenMOSS-Team. Mit nur 0,1 Milliarden Parametern ist es für die Echtzeit-Sprachgenerierung konzipiert, läuft direkt auf der CPU ohne GPU und hält den Bereitstellungsstack einfach genug für lokale Demos, Web-Serving und die Integration in leichtgewichtige Produkte.
★ 4.282+11Sterne-Änderung der letzten 7 Tage - #45
Grundlegendes Modell für menschenähnliches, expressives TTS
★ 4.203-1Sterne-Änderung der letzten 7 Tage - #46
TensorFlowTTS: Echtzeit-Sprachsynthese auf dem neuesten Stand der Technik für TensorFlow 2 (unterstützt Englisch, Französisch, Koreanisch, Chinesisch, Deutsch und ist einfach für andere Sprachen anzupassen)
★ 3.996+0Sterne-Änderung der letzten 7 Tage - #47
Streamer-Sales 销冠 – Ein LLM-basiertes Verkaufs-Modul 🛒🎁, das Produkte basierend auf ihren Merkmalen und aus der Perspektive der Kaufanregung für den Nutzer präsentieren kann. 🚀⭐ Inklusive detailliertem Datengenerierungsprozess ❗ 📦 Enthält zudem LMDeploy für beschleunigte Inferenz 🚀, RAG (Retrieval-Augmented Generation) 📚, TTS (Text-to-Speech) 🔊, Avatar-Generierung 🦸, Agenten für Websuche in Echtzeit 🌐, ASR (Speech-to-Text) 🎙️, Vue-Frontend 🍍, FastAPI-Backend 🗝️ sowie Docker-Compose für das Deployment 🐋
★ 3.764+1Sterne-Änderung der letzten 7 Tage - #48
Ein einfaches, hochwertiges Sprachkonvertierungstool mit Fokus auf Benutzerfreundlichkeit und Leistung.
★ 3.674+14Sterne-Änderung der letzten 7 Tage - #49
Eine einzige Gradio + React WebUI mit Erweiterungen für ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T und Bark!
★ 3.250+5Sterne-Änderung der letzten 7 Tage - #50
[AutoArk] GPA (General Purpose Audio) kann ASR, TTS und Sprachkonvertierung mit einem einzigen kleinen Modell durchführen!
★ 3.061+164Sterne-Änderung der letzten 7 Tage - #51
openctp bietet CTP-API-kompatible Schnittstellen für verschiedene Handelskanäle wie CTP-Aktienoptionen, XTP, TORA, OST, EMT, TWS, TAP und QDP. CTP-Programme können nahtlos an verschiedene Aktien-Gateways angebunden werden. Zudem stellt openctp eine auf dem TTS-Handelssystem basierende Simulationsumgebung bereit, die neben inländischen Futures und Optionen auch A-Aktien, Fonds, Anleihen und Aktienoptionen unterstützt und als Ersatz für Simnow für quantitative Entwickler rund um die Uhr verfügbar ist.
★ 2.920+7Sterne-Änderung der letzten 7 Tage - #52★ 2.864+0Sterne-Änderung der letzten 7 Tage
- #53
aeneas ist eine Python/C-Bibliothek und eine Reihe von Werkzeugen zur automatischen Synchronisierung von Audio und Text (sogenanntes Forced Alignment)
★ 2.862+0Sterne-Änderung der letzten 7 Tage - #54
FLUX, Stable Diffusion, SDXL, SD3, LoRA, Fine Tuning, DreamBooth, Training, Automatic1111, Forge WebUI, SwarmUI, DeepFake, TTS, Animation, Text To Video, Tutorials, Guides, Vorlesungen, Kurse, ComfyUI, Google Colab, RunPod, Kaggle, NoteBooks, ControlNet, TTS, Voice Cloning, KI, KI-News, ML, ML-News, Nachrichten, Tech, Tech-News, Kohya, Midjourney, RunPod
★ 2.762-1Sterne-Änderung der letzten 7 Tage - #55
TTS mit Kokoro und ONNX Runtime
★ 2.694+8Sterne-Änderung der letzten 7 Tage - #56
Python-Bibliothek und CLI-Tool zur Schnittstellenanbindung an die Text-to-Speech-API von Google Translate
★ 2.628+0Sterne-Änderung der letzten 7 Tage - #57★ 2.586+1Sterne-Änderung der letzten 7 Tage
- #58
MARY TTS – Ein in reinem Java geschriebenes, Open-Source-basiertes und mehrsprachiges Text-to-Speech-Synthesesystem
★ 2.583+0Sterne-Änderung der letzten 7 Tage - #59
Vietnamesisches TTS mit sofortigem Voice Cloning • On-Device • Echtzeit-CPU-Inferenz • 24kHz Audioqualität • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt
★ 2.468+21Sterne-Änderung der letzten 7 Tage - #60
HiFi-GAN: Generative Adversarial Networks für effiziente und hochpräzise Sprachsynthese
★ 2.367+0Sterne-Änderung der letzten 7 Tage