OpenMOSS/MOSS-TTSD
@OpenMOSSMOSS-TTSD é um modelo de geração de diálogo falado projetado para síntese expressiva de múltiplos falantes. Ele apresenta modelagem de contexto longo, controle flexível de falante e suporte multilíngue, permitindo clonagem de voz zero-shot a partir de referências de áudio curtas.
Estrelas
1.394
Bifurcações
136
Linguagem
Python
Licença
Apache-2.0
Último push
há 1 semana
Intel relacionado (0)
Ainda não há intel relacionado
Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.