Propriétaire · kyutai-labs
kyutai-labs
Dépôts open source suivis de kyutai-labs, triés par étoiles.
5 dépôts
- #1
Moshi est un modèle de fondation parole-texte et un framework de dialogue parlé en duplex intégral. Il utilise Mimi, un codec audio neuronal en streaming de pointe.
★ 11 002+0Évolution des étoiles sur les 7 derniers jours - #2
Un TTS qui tient dans votre CPU (et dans votre poche)
★ 9 335+0Évolution des étoiles sur les 7 derniers jours - #3
Modèles de synthèse et de reconnaissance vocale de Kyutai basés sur le framework Delayed Streams Modeling.
★ 3 021+0Évolution des étoiles sur les 7 derniers jours - #4
Hibiki est un modèle de traduction vocale en continu (traduction simultanée). Contrairement à la traduction hors ligne, Hibiki adapte son flux pour accumuler suffisamment de contexte afin de produire une traduction correcte en temps réel, segment par segment.
★ 1 512+0Évolution des étoiles sur les 7 derniers jours - #5★ 1 508+0Évolution des étoiles sur les 7 derniers jours