Pular para o conteúdo principal
buildradar
Entrar
Proprietário · kyutai-labs

kyutai-labs

Repositórios de código aberto acompanhados de kyutai-labs, ordenados por estrelas.

5 repositórios
  • moshi@kyutai-labs

    Moshi é um modelo fundamental de fala para texto e um framework de diálogo falado full-duplex. Ele usa Mimi, um codec de áudio neural de streaming de última geração.

    11.002+0Variação de estrelas nos últimos 7 dias
  • pocket-tts@kyutai-labs

    Um TTS que cabe na sua CPU (e no seu bolso).

    9.335+0Variação de estrelas nos últimos 7 dias
  • delayed-streams-modeling@kyutai-labs

    Modelos de Speech-To-Text e Text-To-Speech da Kyutai baseados no framework Delayed Streams Modeling.

    3.021+0Variação de estrelas nos últimos 7 dias
  • hibiki@kyutai-labs

    Hibiki é um modelo para tradução de fala em streaming (também conhecida como tradução simultânea). Ao contrário da tradução offline — onde se espera o fim da fala de origem para começar a traduzir — o Hibiki adapta seu fluxo para acumular contexto suficiente para produzir uma tradução correta em tempo real, bloco por bloco.

    1.512+0Variação de estrelas nos últimos 7 dias
  • unmute@kyutai-labs

    Faça LLMs de texto ouvirem e falarem

    1.508+0Variação de estrelas nos últimos 7 dias
← Voltar para o ranking de proprietários