一个开源的多模态大型语言模型,能听、说、思考。具备实时端到端语音输入与串流音讯输出对话功能。
radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。