Pular para o conteúdo principal
buildradar
Sign in

OpenMOSS/MOSS-TTSD

@OpenMOSS

MOSS-TTSD é um modelo de geração de diálogo falado projetado para síntese expressiva de múltiplos falantes. Ele apresenta modelagem de contexto longo, controle flexível de falante e suporte multilíngue, permitindo clonagem de voz zero-shot a partir de referências de áudio curtas.

Estrelas
1.394
Bifurcações
136
Linguagem
Python
Licença
Apache-2.0
Último push
há 1 semana
Pythonlarge-language-modelsstreamingsglangfinetunespeech-dialogue-generationtext-to-speeh

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.