speech-synthesis
Erfasste Open-Source-Repos mit dem Tag speech-synthesis, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit speech-synthesis am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit speech-synthesis getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
🐸💬 - ein Deep-Learning-Toolkit für Text‑zu‑Sprache, erprobt in Forschung und Produktion
★ 45.985+18Sterne-Änderung der letzten 7 Tage - #2
File Browser bietet eine Datei‑Verwaltungs‑Schnittstelle in einem angegebenen Verzeichnis und ermöglicht das Hochladen, Löschen, Vorschauen und Bearbeiten von Dateien.
★ 36.595+345Sterne-Änderung der letzten 7 Tage - #3
Ein skalierbares generatives KI-Framework für Forscher und Entwickler, die an Large Language Models, Multimodalität und Speech AI (automatische Spracherkennung und Sprachsynthese) arbeiten
★ 18.379+21Sterne-Änderung der letzten 7 Tage - #4★ 17.476+1Sterne-Änderung der letzten 7 Tage
- #5
Modernste Deep-Learning-Skripte, organisiert nach Modellen – einfach zu trainieren und bereitzustellen mit reproduzierbarer Genauigkeit und Leistung auf Infrastruktur für den Unternehmenseinsatz.
★ 14.846+4Sterne-Änderung der letzten 7 Tage - #6
Blitzschnelles, gerätebasiertes, mehrsprachiges TTS — läuft nativ über ONNX.
★ 13.757+20Sterne-Änderung der letzten 7 Tage - #7
Erstellen Sie Sprachagenten mit Open-Source-Modellen
★ 13.015+82Sterne-Änderung der letzten 7 Tage - #8
Gradio WebUI für Creator und Entwickler mit wichtigen TTS-Funktionen (Edge-TTS, kokoro) und Zero-Shot Voice Cloning (E2 & F5-TTS, CosyVoice), inklusive Whisper-Audioverarbeitung, YouTube-Download, Demucs-Gesangsisolierung und mehrsprachiger Übersetzung.
★ 12.730+54Sterne-Änderung der letzten 7 Tage - #9
Benutzerfreundliches Speech Toolkit mit selbstüberwachtem Lernmodell, SOTA/Streaming-ASR mit Interpunktion, Streaming-TTS mit Text-Frontend, Sprecherverifizierungssystem, End-to-End-Sprachübersetzung und Keyword-Spotting. Gewinner des NAACL2022 Best Demo Award.
★ 12.676+5Sterne-Änderung der letzten 7 Tage - #10
Nutze den Online-Text-to-Speech-Dienst von Microsoft Edge aus Python, OHNE Microsoft Edge, Windows oder einen API-Key zu benötigen
★ 11.847+29Sterne-Änderung der letzten 7 Tage - #11
Amphion (/æmˈfaɪən/) ist ein Toolkit zur Audio-, Musik- und Sprachgenerierung. Sein Zweck ist es, reproduzierbare Forschung zu unterstützen und jüngeren Forschern sowie Ingenieuren den Einstieg in die Forschung und Entwicklung zur Audio-, Musik- und Sprachgenerierung zu erleichtern.
★ 10.276+1Sterne-Änderung der letzten 7 Tage - #12★ 9.949+3Sterne-Änderung der letzten 7 Tage
- #13
so-vits-svc Fork mit Echtzeitunterstützung, verbesserter Benutzeroberfläche und weiteren Funktionen.
★ 9.329+3Sterne-Änderung der letzten 7 Tage - #14
EmotiVoice 😊: Eine Multi-Voice- und Prompt-gesteuerte TTS-Engine
★ 8.522-1Sterne-Änderung der letzten 7 Tage - #15
Eine auf Apples MLX-Framework basierende Text-to-Speech (TTS)-, Speech-to-Text (STT)- und Speech-to-Speech (STS)-Bibliothek für effiziente Sprachanalyse auf Apple Silicon.
★ 7.826+23Sterne-Änderung der letzten 7 Tage - #16
eSpeak NG ist ein Open-Source-Sprachsynthesizer, der mehr als hundert Sprachen und Akzente unterstützt.
★ 6.802+13Sterne-Änderung der letzten 7 Tage - #17
StyleTTS 2: Annäherung an menschliche Sprachsynthese durch Style Diffusion und adversariales Training mit großen Sprachmodellen für Sprache
★ 6.342+3Sterne-Änderung der letzten 7 Tage - #18
Silero Models: Vorab trainierte Text-to-Speech-Modelle, denkbar einfach gestaltet
★ 6.084-1Sterne-Änderung der letzten 7 Tage - #19★ 5.831+45Sterne-Änderung der letzten 7 Tage
- #20
:DiffSinger: Gesangssynthese über flachen Diffusionsmechanismus (SVS & TTS); AAAI 2022; Offizieller Code
★ 4.855+3Sterne-Änderung der letzten 7 Tage - #21
Ein Open-Source-Text-to-Speech-System, entwickelt durch Invertieren von Whisper.
★ 4.645+3Sterne-Änderung der letzten 7 Tage - #22★ 4.258+18Sterne-Änderung der letzten 7 Tage
- #23
Grundlegendes Modell für menschenähnliches, expressives TTS
★ 4.203-1Sterne-Änderung der letzten 7 Tage - #24
Konvertiert Text in Echtzeit in Sprache.
★ 4.021+2Sterne-Änderung der letzten 7 Tage - #25
TensorFlowTTS: Echtzeit-Sprachsynthese auf dem neuesten Stand der Technik für TensorFlow 2 (unterstützt Englisch, Französisch, Koreanisch, Chinesisch, Deutsch und ist einfach für andere Sprachen anzupassen)
★ 3.996+0Sterne-Änderung der letzten 7 Tage - #26★ 2.864+0Sterne-Änderung der letzten 7 Tage
- #27★ 2.818+1Sterne-Änderung der letzten 7 Tage
- #28
MARY TTS – Ein in reinem Java geschriebenes, Open-Source-basiertes und mehrsprachiges Text-to-Speech-Synthesesystem
★ 2.583+0Sterne-Änderung der letzten 7 Tage - #29
Vietnamesisches TTS mit sofortigem Voice Cloning • On-Device • Echtzeit-CPU-Inferenz • 24kHz Audioqualität • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt
★ 2.468+21Sterne-Änderung der letzten 7 Tage - #30
HiFi-GAN: Generative Adversarial Networks für effiziente und hochpräzise Sprachsynthese
★ 2.367+0Sterne-Änderung der letzten 7 Tage