Zum Hauptinhalt springen
buildradar
Anmelden
Thema · text-to-speech

text-to-speech

Erfasste Open-Source-Repos mit dem Tag text-to-speech, sortiert nach Sternen.

150 Repos
  • flutter_tts@dlutton

    Flutter Text-to-Speech-Paket

    753+0Sterne-Änderung der letzten 7 Tage
  • kokoro-web@eduardolat

    🔊 Kokoro Web: Kostenlose KI-Sprachausgabe (Text-to-Speech), online oder selbst gehostet, OpenAI-kompatibel!

    733+2Sterne-Änderung der letzten 7 Tage
  • voice-ai@rapidaai

    Rapida ist eine Open-Source-End-to-End-Voice-AI-Orchestrierungsplattform zum Erstellen von Echtzeit-Sprachassistenten mit Audiostreaming, STT, TTS, VAD, Mehrkanalintegration, Agenten-Zustandsverwaltung und Observability.

    723+4Sterne-Änderung der letzten 7 Tage
  • curses@mmpneo

    Sprach-zu-Text- und KB-Eingabe-Untertitel für OBS, VRChat, Twitch-Chat und Discord

    718-1Sterne-Änderung der letzten 7 Tage
  • voicebox-pytorch@lucidrains

    Implementierung von Voicebox, einem neuen SOTA Text-to-Speech-Netzwerk von MetaAI, in PyTorch.

    703+0Sterne-Änderung der letzten 7 Tage
  • podcast-maker@FelippeChemello

    Vollautomatischer Video-Maker, der Motion Graphics und Text-to-Speech-Synthese nutzt, um Newsletter in tägliche YouTube-Videos zu verwandeln.

    703+0Sterne-Änderung der letzten 7 Tage
  • Offline-Spracherkennung mit OpenAI Whisper und TensorFlow Lite für Android

    689+1Sterne-Änderung der letzten 7 Tage
  • chatterbox-tts-api@travisvn

    Lokale, OpenAI-kompatible Text-to-Speech (TTS)-API mit Chatterbox, die es Benutzern ermöglicht, sprachgeklonten Ton überall dort zu erzeugen, wo die OpenAI-API verwendet wird (z. B. Open WebUI, AnythingLLM usw.)

    677+1Sterne-Änderung der letzten 7 Tage
  • dictionariez@pnlpal

    📚 Eine anpassbare Wörterbucherweiterung, die Doppelklick-Nachschlagen in über 20 Sprachen, mehr als 1000 Wörterbücher, Text-zu-Sprache, Übersetzung und Anki-Integration unterstützt.

    671+1Sterne-Änderung der letzten 7 Tage
  • LLaSA_training@zhenye234

    LLaSA: Skalierung von Trainings- und Inferenz-Rechenleistung für LLaMA-basierte Sprachsynthese

    658+1Sterne-Änderung der letzten 7 Tage
  • f5-tts-mlx@lucasnewman

    Implementierung von F5-TTS in MLX

    644+0Sterne-Änderung der letzten 7 Tage
  • examples@elevenlabs
    626+2Sterne-Änderung der letzten 7 Tage
  • Pandrator@lukaszliniewicz

    Konvertieren Sie PDFs und EPUBs in Hörbücher, Untertitel oder Videos in synchronisierte Videos (inklusive Übersetzung) und mehr. Kostenlos. Pandrator verwendet lokale Modelle, einschließlich Stimmklonen (sofortig, RVC-optimiert, XTTS-Feintuning) und LLM-Verarbeitung. Das Ziel ist eine benutzerfreundliche App mit GUI, Installationsprogramm und All-in-One-Paketen.

    620+3Sterne-Änderung der letzten 7 Tage
  • tiktok-voice@oscie57

    Einfaches Python-Skript zur Interaktion mit der TikTok TTS-API

    611+0Sterne-Änderung der letzten 7 Tage
  • ComfyUI-VibeVoice@wildminder

    ComfyUI-Custom-Node für VibeVoice TTS. Ausdrucksstarkes, langformatiges Konversations-Audio mit mehreren Sprechern

    596-1Sterne-Änderung der letzten 7 Tage
  • Modifizierte Version von Chatterbox, die Textdateien als Eingabe akzeptiert und keine Zeichenbeschränkungen hat. Ich verwende sie zur Erstellung von Hörbüchern, insbesondere für meine Kinder.

    575-1Sterne-Änderung der letzten 7 Tage
  • Das selbstkodierende System für Ihre App – Alan AI SDK für React Native.

    575+0Sterne-Änderung der letzten 7 Tage
  • Lokale Ausführung von Qwen3-TTS Text-to-Speech auf dem Mac (M1/M2/M3/M4). Stimmenklonierung, Stimmendesign und benutzerdefinierte Stimmen. 100 % offline mittels MLX.

    561+2Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Forschungsarbeiten zur LLM-basierten multimodalen Generierung (Bild, Video, 3D und Audio).

    552+0Sterne-Änderung der letzten 7 Tage
  • orpheus-tts-local@isaiahbjork

    Orpheus 3B lokal mit LM Studio ausführen.

    549+0Sterne-Änderung der letzten 7 Tage
  • vits2_pytorch@p0p4k

    Inoffizielle vits2-TTS-Implementierung in PyTorch

    549+1Sterne-Änderung der letzten 7 Tage
  • payload-ai@ashbuilds

    AI Plugin ist eine leistungsstarke Erweiterung für Payload CMS, die fortschrittliche KI-Funktionen zur Optimierung der Inhaltserstellung und -verwaltung integriert.

    547-1Sterne-Änderung der letzten 7 Tage
  • ComfyUI-OmniVoice-TTS@Saganaki22

    OmniVoice TTS-Knoten für ComfyUI – Zero-Shot-mehrsprachige Text-to-Speech mit Stimmklonen, Stimmdesign und Multi-Speaker-Dialogen

    545+6Sterne-Änderung der letzten 7 Tage
  • Talkify@tornikegomareli

    Blitzschnelle, kostenlose und lokale Sprachdiktat-Software für macOS mit On-Device-Transkription

    544+13Sterne-Änderung der letzten 7 Tage
  • EDDI@EDCD

    Begleit-App für Elite Dangerous.

    525+2Sterne-Änderung der letzten 7 Tage
  • e2-tts-pytorch@lucidrains

    Implementierung von E2-TTS, "Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS", in Pytorch.

    517+0Sterne-Änderung der letzten 7 Tage
  • vixtts-demo@thinhlpg

    Ein vietnamesisches Text-to-Speech-Modell für Voice Cloning

    516-1Sterne-Änderung der letzten 7 Tage
  • Open-Source, lokaler und selbst gehosteter, hochoptimierter Sprachinferenz-Server mit Unterstützung für ASR/STT, TTS und LLM über WebRTC, REST und WS.

    512+0Sterne-Änderung der letzten 7 Tage
  • ComfyUI-VoxCPM@wildminder

    ComfyUI-Node für ausdrucksstarke Sprache und realistisches Zero-Shot Voice Cloning

    509+0Sterne-Änderung der letzten 7 Tage
  • openreader@richardr1126

    An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.

    505+4Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen