Zum Hauptinhalt springen
buildradar
Anmelden
Thema · text-to-speech

text-to-speech

Erfasste Open-Source-Repos mit dem Tag text-to-speech, sortiert nach Sternen.

150 Repos
  • TTS-Audio-Suite@diodiogod

    Eine ComfyUI-Custom-Node-Integration für lokales Multi-Engine- und Multi-Language-Text-to-Speech sowie Voice Conversion. Unterstützt: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (klassisch und multilingual), F5-TTS, Higgs Audio 2, 3 und VibeVoice mit unbegrenzter Textlänge, SRT-Timing, Charakter-Unterstützung und vielen Audiowerkzeugen

    1.187+0Sterne-Änderung der letzten 7 Tage
  • Ein praktisches Labor zum Erstellen, Testen und Evaluieren von Apps mit dem Foundation Models-Framework von Apple.

    1.178+0Sterne-Änderung der letzten 7 Tage
  • dia2@nari-labs

    TTS-Modell, das in der Lage ist, Konversations-Audio in Echtzeit zu streamen.

    1.173+0Sterne-Änderung der letzten 7 Tage
  • speech-swift@soniqo

    KI-Sprach-Toolkit für Apple Silicon – ASR, TTS, Speech-to-Speech, VAD und Diarisierung, angetrieben durch MLX und CoreML

    1.161+0Sterne-Änderung der letzten 7 Tage
  • Das Self-Coding-System für Ihre App — Alan AI SDK für Cordova

    1.132+0Sterne-Änderung der letzten 7 Tage
  • Uncensored-Local-Studio@techjarves

    Unzensiertes lokales KI-Studio für Windows, Linux und macOS. Installationsfreie GUI für Bildgenerierung, GGUF-LLMs, Text-to-Speech & Speech-to-Text

    1.118+13Sterne-Änderung der letzten 7 Tage
  • sglang-omni@sgl-project

    SGLang-Omni ermöglicht hochleistungsfähiges Serving für TTS-, ASR-, Sprach- und Omni-Modelle.

    1.118+56Sterne-Änderung der letzten 7 Tage
  • Patter@PatterAI

    Open-Source-Voice-KI-SDK. Die Vapi/Retell-Alternative für Entwickler, die den Stack selbst kontrollieren möchten. Verleihen Sie Ihrem KI-Agenten in 4 Zeilen eine Telefonnummer — Python und TypeScript, unter MIT-Lizenz, Twilio, Telnyx und Plivo.

    1.051+7Sterne-Änderung der letzten 7 Tage
  • Cognitive-Speech-TTS@Azure-Samples

    Microsoft Text-to-Speech API-Beispielcode in mehreren Sprachen, Teil von Cognitive Services.

    1.014+1Sterne-Änderung der letzten 7 Tage
  • alexandria-audiobook@Finrandojin

    KI-gestützter Multistimmen-Hörbuchgenerator – LLM-Skriptannotation, Klonen von Stimmen, Stimmen-Design, LoRA-Training, zeilenbasierte Stilsteuerung und Export nach MP3, M4B mit Kapiteln oder als Audacity-Mehrspurprojekt. Basiert auf Qwen3-TTS.

    1.000+10Sterne-Änderung der letzten 7 Tage
  • Step-Audio-EditX@stepfun-ai

    Ein leistungsstarkes 3B-Parameter-LLM-basiertes Reinforcement-Learning-Audiobearbeitungsmodell, das sich hervorragend für die Bearbeitung von Emotionen, Sprechstil und Paralinguistik eignet und robuste Zero-Shot-Text-to-Speech bietet

    973+1Sterne-Änderung der letzten 7 Tage
  • NISQA@gabrielmittag

    NISQA – Nicht-intrusive Bewertung der Sprachqualität und TTS-Natürlichkeit

    972+4Sterne-Änderung der letzten 7 Tage
  • botium-speech-processing@codeforequity-at

    Botium Sprachverarbeitung

    943+0Sterne-Änderung der letzten 7 Tage
  • Macht natürliche Azure-TTS-Stimmen für jede SAPI-5-kompatible Anwendung zugänglich.

    934+7Sterne-Änderung der letzten 7 Tage
  • Vonage-REST-API-Client für PHP. API-Unterstützung für SMS, Voice, Text-to-Speech, Nummern, Verify (2FA) und mehr.

    931-1Sterne-Änderung der letzten 7 Tage
  • FireRedTTS@FireRedTeam

    Ein Open-Source-LLM-basiertes TTS-Fundamentalsystem

    919-1Sterne-Änderung der letzten 7 Tage
  • EDDiscovery@EDDiscovery

    Captain's Log und 3D-Sternenkarte für Elite Dangerous

    900+4Sterne-Änderung der letzten 7 Tage
  • diffwave@lmnt-com

    DiffWave ist ein schneller, hochqualitativer neuronaler Vocoder und Wellenformsynthesizer.

    884-1Sterne-Änderung der letzten 7 Tage
  • bark.cpp@PABannier

    Das Bark-Modell von Suno AI in C/C++ für eine schnelle Text-to-Speech-Generierung

    868+2Sterne-Änderung der letzten 7 Tage
  • lobe-tts@lobehub

    🎤 Lobe TTS – Eine hochwertige und zuverlässige TTS/STT-Bibliothek für Server und Browser

    805-1Sterne-Änderung der letzten 7 Tage
  • lue@paulilaaso

    Terminal-E-Book-Reader mit Text-to-Speech in Hörbuch-Qualität – unterstützt EPUB, PDF, DOCX, HTML, RTF, TXT und MD.

    805+1Sterne-Änderung der letzten 7 Tage
  • CloneTTS@sipeter

    Eine leichte, offlinefähige Android-Text-to-Speech-Engine (TTS) für nahtloses, systemweites Stimmklonen und hochpräzises Vorlesen.

    804+5Sterne-Änderung der letzten 7 Tage
  • Sprache zu Text zu Sprache. Song wird jetzt abgespielt. Sendet Text als OSC-Nachrichten an VRChat zur Anzeige auf dem Avatar. (STTTS) (Sprache zu TTS) (VRC-STT-System) (VTuber-TTS)

    804+5Sterne-Änderung der letzten 7 Tage
  • ai-video-editor@MartinDelophy

    Open-Source-Videoeditor mit Local-First-Ansatz, bei dem Creator und KI-Agenten an derselben Timeline arbeiten.

    798+82Sterne-Änderung der letzten 7 Tage
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: Eine mehrsprachige und sprachübergreifende Zero-Shot-TTS-Engine

    794+6Sterne-Änderung der letzten 7 Tage
  • Open-Source-Tool für Android ohne Root-Zugriff zur Echtzeit-Bildschirmübersetzung, geeignet für Spiele, Visual Novels und Mangas. Unterstützt On-Device- und Cloud-OCR, Offline-LLMs, verschiedene Übersetzungsdienste sowie Text-to-Speech (TTS), wobei Übersetzungen direkt auf dem Bildschirm angezeigt werden.

    794+73Sterne-Änderung der letzten 7 Tage
  • june@mezbaul-h

    Lokaler Sprach-Chatbot für ansprechende Konversationen, basierend auf Ollama, Hugging Face Transformers und dem Coqui TTS Toolkit

    788+1Sterne-Änderung der letzten 7 Tage
  • mlx-audio-swift@Blaizzy

    Ein modulares Swift-SDK zur Audioverarbeitung mit MLX auf Apple Silicon

    774+5Sterne-Änderung der letzten 7 Tage
  • vui@fluxions-ai

    Echtzeit-Sprachassistent — WebRTC-Streaming, faster-whisper ASR, lokales LLM, Vui Nano (300M) TTS. Kompatibel mit der OpenAI Realtime API. Sprachklonen, Barge-in, ca. 9-fache Echtzeit auf einer 4090. Apache 2.0.

    759+7Sterne-Änderung der letzten 7 Tage
  • cboard@cboard-org

    System für Unterstützte Kommunikation (AAC) mit Sprachsynthese für den Browser

    756+9Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen