본문으로 건너뛰기
buildradar
로그인
소유자 · kyutai-labs

kyutai-labs

kyutai-labs의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 5개
  • moshi@kyutai-labs

    Moshi는 음성-텍스트 기반 모델이자 전이중 음성 대화 프레임워크입니다. 최첨단 스트리밍 신경망 오디오 코덱인 Mimi를 사용합니다.

    11,002+0최근 7일 스타 변화
  • pocket-tts@kyutai-labs

    CPU(와 주머니)에 쏙 들어가는 TTS

    9,335+0최근 7일 스타 변화
  • delayed-streams-modeling@kyutai-labs

    Delayed Streams Modeling 프레임워크 기반의 Kyutai 음성 인식(STT) 및 음성 합성(TTS) 모델

    3,021+0최근 7일 스타 변화
  • hibiki@kyutai-labs

    Hibiki는 스트리밍 음성 번역(동시 통역이라고도 함)을 위한 모델입니다. 소스 발화가 끝날 때까지 기다렸다가 번역을 시작하는 오프라인 번역과 달리, Hibiki는 실시간으로 정확한 번역을 생성하는 데 필요한 만큼의 문맥을 수집하도록 흐름을 조절합니다.

    1,512+0최근 7일 스타 변화
  • unmute@kyutai-labs

    텍스트 LLM이 듣고 말할 수 있도록 만듭니다.

    1,508+0최근 7일 스타 변화
← 소유자 랭킹으로