Zum Hauptinhalt springen
buildradar
Sign in
Thema · tts

tts

Erfasste Open-Source-Repos mit dem Tag tts, sortiert nach Sternen.

189 Repos
  • ChatTTS-ui@jianchang512

    Eine einfache lokale Web-Benutzeroberfläche, die ChatTTS verwendet, um Text in Sprache zu synthetisieren, und gleichzeitig die Bereitstellung externer API-Schnittstellen unterstützt.

    7.648+4Sterne-Änderung der letzten 7 Tage
  • MeloTTS@myshell-ai

    Hochwertige, mehrsprachige Text-to-Speech-Bibliothek von MyShell.ai. Unterstützt Englisch, Spanisch, Französisch, Chinesisch, Japanisch und Koreanisch.

    7.616+7Sterne-Änderung der letzten 7 Tage
  • wukong-robot@wzpan

    wukong-robot ist ein einfaches, flexibles und elegantes chinesisches Sprach-Chatbot- und Smart-Speaker-Projekt mit ChatGPT-Unterstützung.

    7.126+2Sterne-Änderung der letzten 7 Tage
  • StyleTTS2@yl4579

    StyleTTS 2: Annäherung an menschliche Sprachsynthese durch Style Diffusion und adversariales Training mit großen Sprachmodellen für Sprache

    6.342+3Sterne-Änderung der letzten 7 Tage
  • Orpheus-TTS@canopyai

    Auf dem Weg zu menschlich klingender Sprache

    6.324+5Sterne-Änderung der letzten 7 Tage
  • tts-vue@LokerL

    🎤 Microsoft-Sprachsynthese-Tool, erstellt mit Electron + Vue + ElementPlus + Vite.

    6.103+1Sterne-Änderung der letzten 7 Tage
  • silero-models@snakers4

    Silero Models: Vorab trainierte Text-to-Speech-Modelle, denkbar einfach gestaltet

    6.084-1Sterne-Änderung der letzten 7 Tage
  • abogen@denizsafak

    Erstelle Hörbücher aus EPUBs, PDFs und Text mit synchronisierten Untertiteln.

    5.831+45Sterne-Änderung der letzten 7 Tage
  • Kokoro-FastAPI@remsky

    Dockerisierter OpenAI-kompatibler Wrapper für Kokoro-82M Text-to-Speech mit Unterstützung für Multiplatform-CPU, AMD- und NVIDIA-GPU PyTorch; mehrere Sprecher, Sprachmischung, automatisches Zusammenfügen, Caption-Zeitstempel, SSML und Readalong-Web-UI

    5.399+19Sterne-Änderung der letzten 7 Tage
  • dramaclaw@dramaclaw

    Eine universelle AIGC-Video-Engine: Vom Skript zum fertigen Film in einer Pipeline – Dramen, Werbung, Produktvideos, Otome-Spiele und mehr.

    4.900+384Sterne-Änderung der letzten 7 Tage
  • DiffSinger@MoonInTheRiver

    :DiffSinger: Gesangssynthese über flachen Diffusionsmechanismus (SVS & TTS); AAAI 2022; Offizieller Code

    4.855+3Sterne-Änderung der letzten 7 Tage
  • WhisperSpeech@WhisperSpeech

    Ein Open-Source-Text-to-Speech-System, entwickelt durch Invertieren von Whisper.

    4.645+3Sterne-Änderung der letzten 7 Tage
  • tts-server-android@jing332

    Dies ist eine Android-System-TTS-App mit integrierter Microsoft-Demo-Schnittstelle, anpassbaren HTTP-Anfragen, der Möglichkeit, andere lokale TTS-Engines zu importieren, sowie Vorlesefunktionen basierend auf einfachen chinesischen Anführungszeichen für Erzählung/Dialog, automatischer Wiederholung, Backup-Konfigurationen, Textersetzung und weiteren Funktionen.

    4.488+5Sterne-Änderung der letzten 7 Tage
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nano ist ein Open-Source-Modell zur mehrsprachigen Miniatur-Sprachgenerierung von MOSI.AI und dem OpenMOSS-Team. Mit nur 0,1 Milliarden Parametern ist es für die Echtzeit-Sprachgenerierung konzipiert, läuft direkt auf der CPU ohne GPU und hält den Bereitstellungsstack einfach genug für lokale Demos, Web-Serving und die Integration in leichtgewichtige Produkte.

    4.282+11Sterne-Änderung der letzten 7 Tage
  • metavoice-src@metavoiceio

    Grundlegendes Modell für menschenähnliches, expressives TTS

    4.203-1Sterne-Änderung der letzten 7 Tage
  • TensorFlowTTS@TensorSpeech

    TensorFlowTTS: Echtzeit-Sprachsynthese auf dem neuesten Stand der Technik für TensorFlow 2 (unterstützt Englisch, Französisch, Koreanisch, Chinesisch, Deutsch und ist einfach für andere Sprachen anzupassen)

    3.996+0Sterne-Änderung der letzten 7 Tage
  • Streamer-Sales@PeterH0323

    Streamer-Sales 销冠 – Ein LLM-basiertes Verkaufs-Modul 🛒🎁, das Produkte basierend auf ihren Merkmalen und aus der Perspektive der Kaufanregung für den Nutzer präsentieren kann. 🚀⭐ Inklusive detailliertem Datengenerierungsprozess ❗ 📦 Enthält zudem LMDeploy für beschleunigte Inferenz 🚀, RAG (Retrieval-Augmented Generation) 📚, TTS (Text-to-Speech) 🔊, Avatar-Generierung 🦸, Agenten für Websuche in Echtzeit 🌐, ASR (Speech-to-Text) 🎙️, Vue-Frontend 🍍, FastAPI-Backend 🗝️ sowie Docker-Compose für das Deployment 🐋

    3.764+1Sterne-Änderung der letzten 7 Tage
  • Applio@IAHispano

    Ein einfaches, hochwertiges Sprachkonvertierungstool mit Fokus auf Benutzerfreundlichkeit und Leistung.

    3.674+14Sterne-Änderung der letzten 7 Tage
  • TTS-WebUI@rsxdalv

    Eine einzige Gradio + React WebUI mit Erweiterungen für ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T und Bark!

    3.250+5Sterne-Änderung der letzten 7 Tage
  • GPA@AutoArk

    [AutoArk] GPA (General Purpose Audio) kann ASR, TTS und Sprachkonvertierung mit einem einzigen kleinen Modell durchführen!

    3.061+164Sterne-Änderung der letzten 7 Tage
  • openctp@openctp

    openctp bietet CTP-API-kompatible Schnittstellen für verschiedene Handelskanäle wie CTP-Aktienoptionen, XTP, TORA, OST, EMT, TWS, TAP und QDP. CTP-Programme können nahtlos an verschiedene Aktien-Gateways angebunden werden. Zudem stellt openctp eine auf dem TTS-Handelssystem basierende Simulationsumgebung bereit, die neben inländischen Futures und Optionen auch A-Aktien, Fonds, Anleihen und Aktienoptionen unterstützt und als Ersatz für Simnow für quantitative Entwickler rund um die Uhr verfügbar ist.

    2.920+7Sterne-Änderung der letzten 7 Tage
  • lingvo@tensorflow

    Lingvo

    2.864+0Sterne-Änderung der letzten 7 Tage
  • aeneas@readbeyond

    aeneas ist eine Python/C-Bibliothek und eine Reihe von Werkzeugen zur automatischen Synchronisierung von Audio und Text (sogenanntes Forced Alignment)

    2.862+0Sterne-Änderung der letzten 7 Tage
  • Stable-Diffusion@FurkanGozukara

    FLUX, Stable Diffusion, SDXL, SD3, LoRA, Fine Tuning, DreamBooth, Training, Automatic1111, Forge WebUI, SwarmUI, DeepFake, TTS, Animation, Text To Video, Tutorials, Guides, Vorlesungen, Kurse, ComfyUI, Google Colab, RunPod, Kaggle, NoteBooks, ControlNet, TTS, Voice Cloning, KI, KI-News, ML, ML-News, Nachrichten, Tech, Tech-News, Kohya, Midjourney, RunPod

    2.762-1Sterne-Änderung der letzten 7 Tage
  • kokoro-onnx@thewh1teagle

    TTS mit Kokoro und ONNX Runtime

    2.694+8Sterne-Änderung der letzten 7 Tage
  • gTTS@pndurette

    Python-Bibliothek und CLI-Tool zur Schnittstellenanbindung an die Text-to-Speech-API von Google Translate

    2.628+0Sterne-Änderung der letzten 7 Tage
  • polyglot@liou666

    🤖️ Plattformübergreifende KI-App zum Üben von Sprachen

    2.586+1Sterne-Änderung der letzten 7 Tage
  • marytts@marytts

    MARY TTS – Ein in reinem Java geschriebenes, Open-Source-basiertes und mehrsprachiges Text-to-Speech-Synthesesystem

    2.583+0Sterne-Änderung der letzten 7 Tage
  • VieNeu-TTS@pnnbao97

    Vietnamesisches TTS mit sofortigem Voice Cloning • On-Device • Echtzeit-CPU-Inferenz • 24kHz Audioqualität • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt

    2.468+21Sterne-Änderung der letzten 7 Tage
  • hifi-gan@jik876

    HiFi-GAN: Generative Adversarial Networks für effiziente und hochpräzise Sprachsynthese

    2.367+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen