聞いて、考えながら話すことができるオープンソースのマルチモーダル大規模言語モデル。リアルタイムのエンドツーエンド音声入力およびストリーミング音声出力による会話機能を備えています。
このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。