Proprietário · kyutai-labs
kyutai-labs
Repositórios de código aberto acompanhados de kyutai-labs, ordenados por estrelas.
5 repositórios
- #1
Moshi é um modelo fundamental de fala para texto e um framework de diálogo falado full-duplex. Ele usa Mimi, um codec de áudio neural de streaming de última geração.
★ 11.002+0Variação de estrelas nos últimos 7 dias - #2
Um TTS que cabe na sua CPU (e no seu bolso).
★ 9.335+0Variação de estrelas nos últimos 7 dias - #3
Modelos de Speech-To-Text e Text-To-Speech da Kyutai baseados no framework Delayed Streams Modeling.
★ 3.021+0Variação de estrelas nos últimos 7 dias - #4
Hibiki é um modelo para tradução de fala em streaming (também conhecida como tradução simultânea). Ao contrário da tradução offline — onde se espera o fim da fala de origem para começar a traduzir — o Hibiki adapta seu fluxo para acumular contexto suficiente para produzir uma tradução correta em tempo real, bloco por bloco.
★ 1.512+0Variação de estrelas nos últimos 7 dias - #5★ 1.508+0Variação de estrelas nos últimos 7 dias