Zum Hauptinhalt springen
buildradar
Sign in

OpenMOSS/MOSS-TTSD

@OpenMOSS

MOSS-TTSD is ein Modell zur Generierung gesprochener Dialoge, das für die ausdrucksstarke Synthese mehrerer Sprecher entwickelt wurde. Es bietet Long-Context-Modellierung, flexible Sprechersteuerung und mehrsprachige Unterstützung und ermöglicht gleichzeitig Zero-Shot-Stimmenklonen aus kurzen Audio-Referenzen.

Sterne
1.394
Forks
136
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 1 Woche
Pythonlarge-language-modelsstreamingsglangfinetunespeech-dialogue-generationtext-to-speeh

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.