Aller au contenu principal
buildradar
Sign in

OpenMOSS/MOSS-TTSD

@OpenMOSS

MOSS-TTSD est un modèle de génération de dialogue parlé conçu pour la synthèse expressive multi-locuteur. Il propose une modélisation de contexte long, un contrôle flexible du locuteur et un support multilingue, tout en permettant le clonage vocal zero-shot à partir de courtes références audio.

Étoiles
1 394
Bifurcations
136
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 1 semaine
Pythonlarge-language-modelsstreamingsglangfinetunespeech-dialogue-generationtext-to-speeh

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.