tts
Erfasste Open-Source-Repos mit dem Tag tts, sortiert nach Sternen.
- #121
KI-gestützter Multistimmen-Hörbuchgenerator – LLM-Skriptannotation, Klonen von Stimmen, Stimmen-Design, LoRA-Training, zeilenbasierte Stilsteuerung und Export nach MP3, M4B mit Kapiteln oder als Audacity-Mehrspurprojekt. Basiert auf Qwen3-TTS.
★ 999+17Sterne-Änderung der letzten 7 Tage - #122
🧸 Lobe Vidol - Virtuelle Idole für jeden zugänglich machen
★ 986+1Sterne-Änderung der letzten 7 Tage - #123
Ein leistungsstarkes 3B-Parameter-LLM-basiertes Reinforcement-Learning-Audiobearbeitungsmodell, das sich hervorragend für die Bearbeitung von Emotionen, Sprechstil und Paralinguistik eignet und robuste Zero-Shot-Text-to-Speech bietet
★ 972+1Sterne-Änderung der letzten 7 Tage - #124★ 971+2Sterne-Änderung der letzten 7 Tage
- #125★ 955-1Sterne-Änderung der letzten 7 Tage
- #126
Das Zentrum für Audio-KI-Forschung: Arbeiten, offene Modelle, Benchmarks und Datensätze über Audio-LLMs, Spracherkennung, TTS, Musik und Audiogenerierung.
★ 953+3Sterne-Änderung der letzten 7 Tage - #127
Macht natürliche Azure-TTS-Stimmen für jede SAPI-5-kompatible Anwendung zugänglich.
★ 934+12Sterne-Änderung der letzten 7 Tage - #128
Ein Open-Source-LLM-basiertes TTS-Fundamentalsystem
★ 920+1Sterne-Änderung der letzten 7 Tage - #129
🔥🔥🔥 Kostenlose Offline-KI-Algorithmen-Toolbox für Java mit Unterstützung für Gesichtserkennung, Liveness-Erkennung, Gesichtsausdruckserkennung, Objekterkennung, Instanzsegmentierung, Fußgängererkennung, OCR-Texterkennung, Nummernschilderkennung, Tabellenerkennung, ASR+TTS, maschinelle Übersetzung und mehr. Einfach über Maven einbinden. Unterstützt PyTorch, TensorFlow und integriert gängige Modelle wie Mtcnn, InsightFace, SeetaFace6, YOLOv8~v12, PaddleOCR (PPOCRv5), Whisper usw.
★ 909+3Sterne-Änderung der letzten 7 Tage - #130
Ein Hochleistungs-Framework für die Bereitstellung von ML-Modellen mit dynamischem Batching und CPU/GPU-Pipelines zur vollständigen Ausnutzung Ihrer Rechenmaschine
★ 902+0Sterne-Änderung der letzten 7 Tage - #131
Webinterface zur Verwendung von XTTS und zum Fine-Tuning
★ 896+0Sterne-Änderung der letzten 7 Tage - #132
DiffWave ist ein schneller, hochqualitativer neuronaler Vocoder und Wellenformsynthesizer.
★ 885+0Sterne-Änderung der letzten 7 Tage - #133
Transformiere PDFs in KI-Podcasts für fesselnde Audio-Inhalte unterwegs.
★ 874+1Sterne-Änderung der letzten 7 Tage - #134
Ein benutzerfreundliches Toolkit für Spracherkennung, -transkription, -konvertierung usw.
★ 873+0Sterne-Änderung der letzten 7 Tage - #135
Das Bark-Modell von Suno AI in C/C++ für eine schnelle Text-to-Speech-Generierung
★ 867+1Sterne-Änderung der letzten 7 Tage - #136
Die einfachste und kostengünstigste KI-Integrationslösung. Wenn Ihnen dieses Projekt gefällt, geben Sie ihm bitte einen Stern~
★ 856+2Sterne-Änderung der letzten 7 Tage - #137
SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.
★ 829+15Sterne-Änderung der letzten 7 Tage - #138
Voxtral ASR & TTS läuft nativ und im Browser. Eine Rust-Implementierung von Mistrals Voxtral mini Echtzeit-ASR / TTS unter Verwendung des Burn ML Frameworks
★ 819+2Sterne-Änderung der letzten 7 Tage - #139
Kokoro in Rust. https://huggingface.co/hexgrad/Kokoro-82M Unglaublich schneller Echtzeit-TTS von höchster Qualität.
★ 818+1Sterne-Änderung der letzten 7 Tage - #140
Konvertiert jedes Git-Repository in einen fesselnden Podcast
★ 814-1Sterne-Änderung der letzten 7 Tage - #141
Terminal-E-Book-Reader mit Text-to-Speech in Hörbuch-Qualität – unterstützt EPUB, PDF, DOCX, HTML, RTF, TXT und MD.
★ 806+2Sterne-Änderung der letzten 7 Tage - #142
🎤 Lobe TTS – Eine hochwertige und zuverlässige TTS/STT-Bibliothek für Server und Browser
★ 805+1Sterne-Änderung der letzten 7 Tage - #143
Eine leichte, offlinefähige Android-Text-to-Speech-Engine (TTS) für nahtloses, systemweites Stimmklonen und hochpräzises Vorlesen.
★ 803+2Sterne-Änderung der letzten 7 Tage - #144
Sprache zu Text zu Sprache. Song wird jetzt abgespielt. Sendet Text als OSC-Nachrichten an VRChat zur Anzeige auf dem Avatar. (STTTS) (Sprache zu TTS) (VRC-STT-System) (VTuber-TTS)
★ 803+4Sterne-Änderung der letzten 7 Tage - #145
KI-VTuber mit LLM, ASR, TTS, OCR, CV und weiteren Technologien zum Livestreaming oder um mit dir Minecraft zu spielen.
★ 803+5Sterne-Änderung der letzten 7 Tage - #146
Confucius4-TTS: Eine mehrsprachige und sprachübergreifende Zero-Shot-TTS-Engine
★ 794+10Sterne-Änderung der letzten 7 Tage - #147
Open-Source-Tool für Android ohne Root-Zugriff zur Echtzeit-Bildschirmübersetzung, geeignet für Spiele, Visual Novels und Mangas. Unterstützt On-Device- und Cloud-OCR, Offline-LLMs, verschiedene Übersetzungsdienste sowie Text-to-Speech (TTS), wobei Übersetzungen direkt auf dem Bildschirm angezeigt werden.
★ 786+82Sterne-Änderung der letzten 7 Tage - #148
Ein modulares Swift-SDK zur Audioverarbeitung mit MLX auf Apple Silicon
★ 772+6Sterne-Änderung der letzten 7 Tage - #149★ 762+1Sterne-Änderung der letzten 7 Tage
- #150
Echtzeit-Sprachassistent — WebRTC-Streaming, faster-whisper ASR, lokales LLM, Vui Nano (300M) TTS. Kompatibel mit der OpenAI Realtime API. Sprachklonen, Barge-in, ca. 9-fache Echtzeit auf einer 4090. Apache 2.0.
★ 757+10Sterne-Änderung der letzten 7 Tage