Zum Hauptinhalt springen
buildradar
Anmelden
Thema · text-to-speech

text-to-speech

Erfasste Open-Source-Repos mit dem Tag text-to-speech, sortiert nach Sternen.

150 Repos
  • abogen@denizsafak

    Erstelle Hörbücher aus EPUBs, PDFs und Text mit synchronisierten Untertiteln.

    5.831+0Sterne-Änderung der letzten 7 Tage
  • dograh@dograh-hq

    Open-Source-Sprach-KI-Plattform. Self-Hosted-Alternative zu Vapi und Retell. On-Premise, BYOK für Speech-to-Speech oder LLM/STT/TTS, mit visuellem Workflow-Builder, MCP-nativ und Telefonie-Unterstützung.

    5.568+0Sterne-Änderung der letzten 7 Tage
  • YouDub-webui@liuzhao1225

    Open-Source-KI-Tool zur Videolokalisierung: automatischer Download von YouTube/Bilibili-Videos, Untertitelung und Übersetzung, Stimmklon-Synchronisation, Audiospur-Mischung und Untertitel-Einbettung.

    5.404+0Sterne-Änderung der letzten 7 Tage
  • Kokoro-FastAPI@remsky

    Dockerisierter OpenAI-kompatibler Wrapper für Kokoro-82M Text-to-Speech mit Unterstützung für Multiplatform-CPU, AMD- und NVIDIA-GPU PyTorch; mehrere Sprecher, Sprachmischung, automatisches Zusammenfügen, Caption-Zeitstempel, SSML und Readalong-Web-UI

    5.399+0Sterne-Änderung der letzten 7 Tage
  • DiffSinger@MoonInTheRiver

    :DiffSinger: Gesangssynthese über flachen Diffusionsmechanismus (SVS & TTS); AAAI 2022; Offizieller Code

    4.855+0Sterne-Änderung der letzten 7 Tage
  • fastrtc@gradio-app

    Die Python-Bibliothek für Echtzeitkommunikation

    4.624+0Sterne-Änderung der letzten 7 Tage
  • WhisperLive@collabora

    Eine Fast-Echtzeit-Implementierung von OpenAI Whisper.

    4.246+0Sterne-Änderung der letzten 7 Tage
  • metavoice-src@metavoiceio

    Grundlegendes Modell für menschenähnliches, expressives TTS

    4.203+0Sterne-Änderung der letzten 7 Tage
  • MOSS-TTS@OpenMOSS

    Die MOSS‑TTS-Familie ist eine Open-Source-Modellfamilie zur Sprach- und Klangerzeugung von MOSI.AI und dem OpenMOSS-Team. Sie wurde für Szenarien in der realen Welt mit hoher Wiedergabetreue, starkem Ausdruck und hoher Komplexität entwickelt und deckt stabile Langform-Sprache, Dialoge mit mehreren Sprechern, Sprach-/Charakterdesign, Umgebungs-Soundeffekte und Echtzeit-Streaming-TTS ab.

    4.058+0Sterne-Änderung der letzten 7 Tage
  • RealtimeTTS@KoljaB

    Konvertiert Text in Echtzeit in Sprache.

    4.021+0Sterne-Änderung der letzten 7 Tage
  • TensorFlowTTS@TensorSpeech

    TensorFlowTTS: Echtzeit-Sprachsynthese auf dem neuesten Stand der Technik für TensorFlow 2 (unterstützt Englisch, Französisch, Koreanisch, Chinesisch, Deutsch und ist einfach für andere Sprachen anzupassen)

    3.996+0Sterne-Änderung der letzten 7 Tage
  • Applio@IAHispano

    Ein einfaches, hochwertiges Sprachkonvertierungstool mit Fokus auf Benutzerfreundlichkeit und Leistung.

    3.674+0Sterne-Änderung der letzten 7 Tage
  • TTS-WebUI@rsxdalv

    Eine einzige Gradio + React WebUI mit Erweiterungen für ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T und Bark!

    3.250+0Sterne-Änderung der letzten 7 Tage
  • elevenlabs-python@elevenlabs

    Das offizielle Python SDK für die ElevenLabs API.

    3.083+0Sterne-Änderung der letzten 7 Tage
  • GPA@AutoArk

    [AutoArk] GPA (General Purpose Audio) kann ASR, TTS und Sprachkonvertierung mit einem einzigen kleinen Modell durchführen!

    3.061+0Sterne-Änderung der letzten 7 Tage
  • aeneas@readbeyond

    aeneas ist eine Python/C-Bibliothek und eine Reihe von Werkzeugen zur automatischen Synchronisierung von Audio und Text (sogenanntes Forced Alignment)

    2.862+0Sterne-Änderung der letzten 7 Tage
  • MARS5-TTS@Camb-ai

    MARS5-Sprachmodell (TTS) von CAMB.AI

    2.818+0Sterne-Änderung der letzten 7 Tage
  • gTTS@pndurette

    Python-Bibliothek und CLI-Tool zur Schnittstellenanbindung an die Text-to-Speech-API von Google Translate

    2.628+0Sterne-Änderung der letzten 7 Tage
  • ChatTTS_colab@6drf21e

    🚀 Ein-Klick-Bereitstellung (inklusive Offline-Integrationspaket)! Basierend auf ChatTTS, unterstützt Streaming-Ausgabe, Timbre-Gacha, Generierung langer Audiodateien und Vorlesen mit verteilten Rollen. Einfach zu bedienen, keine komplexe Installation erforderlich.

    2.593+0Sterne-Änderung der letzten 7 Tage
  • marytts@marytts

    MARY TTS – Ein in reinem Java geschriebenes, Open-Source-basiertes und mehrsprachiges Text-to-Speech-Synthesesystem

    2.583+0Sterne-Änderung der letzten 7 Tage
  • pyttsx3@nateshmbhat

    Offline-Text-to-Speech-Synthese für Python

    2.530+0Sterne-Änderung der letzten 7 Tage
  • VieNeu-TTS@pnnbao97

    Vietnamesisches TTS mit sofortigem Voice Cloning • On-Device • Echtzeit-CPU-Inferenz • 24kHz Audioqualität • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt

    2.468+0Sterne-Änderung der letzten 7 Tage
  • qwen-audio-agent@QwenAudio

    Eine Echtzeit-Sprachlaufzeitumgebung für KI-Agenten, die sie im Gespräch und aktiv hält.

    2.379+58Sterne-Änderung der letzten 7 Tage
  • hifi-gan@jik876

    HiFi-GAN: Generative Adversarial Networks für effiziente und hochpräzise Sprachsynthese

    2.367+0Sterne-Änderung der letzten 7 Tage
  • vall-e@lifeiteng

    PyTorch-Implementierung von VALL-E (Zero-Shot Text-to-Speech), reproduzierte Demo https://lifeiteng.github.io/valle/index.html

    2.215+0Sterne-Änderung der letzten 7 Tage
  • audio.cpp@0xShug0

    Eine All-in-One-Inferenz-Engine in reinem C++ für Audiomodelle, angetrieben von ggml. Unterstützt TTS, STT, VAD, Sprachkonvertierung, Musikgenerierung und mehr bei hochoptimierter Leistung. Keine Python-Abhängigkeit.

    2.214+0Sterne-Änderung der letzten 7 Tage
  • IMS-Toucan@DigitalPhonetics

    Steuerbare und schnelle Text-to-Speech-Technologie für über 7000 Sprachen!

    2.207+0Sterne-Änderung der letzten 7 Tage
  • openai-edge-tts@travisvn

    Kostenloser, hochwertiger Text-to-Speech-API-Endpunkt als Ersatz für OpenAI, Azure oder ElevenLabs

    2.075+0Sterne-Änderung der letzten 7 Tage
  • parlor@fikrikarim

    On-Device, multimodale Echtzeit-KI mit ähnlichen Funktionen wie GPT-Live

    2.048+0Sterne-Änderung der letzten 7 Tage
  • claude-code-video-toolkit@digitalsamba

    AI-natives VideoProduktions-Toolkit für Claude Code

    2.036+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen