跳到主要内容
buildradar
Sign in
所有者 · OpenMOSS

OpenMOSS

OpenMOSS 收录中的开源项目,按星标数排序。

共 10 个项目
  • MOSS@OpenMOSS

    一个来自复旦大学的开源工具增强对话语言模型

    12,239+5近 7 天星标变化
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nano 是 MOSI.AI 和 OpenMOSS 团队的开源多语言小型语音生成模型。仅 0.1B 参数,旨在实现实时语音生成,可直接在 CPU 上运行,无需 GPU,部署堆栈保持简单,适合本地演示、Web 服务和轻量级产品集成。

    4,282+11近 7 天星标变化
  • MOSS-TTS@OpenMOSS

    MOSS‑TTS Family 是 MOSI.AI 与 OpenMOSS 团队开源的语音与声音生成模型族,设计用于高保真度、高表现力与复杂实际场景,涵盖稳定长篇语音、多说话者对话、声音/角色设计、环境音效与实时串流 TTS

    4,058+18近 7 天星标变化
  • MOSS-Transcribe-Diarize 0.9B 是一个开源的 SOTA 端到端语音理解模型,支持长时长多发言人转录、发言人 diarization、时间戳与声学事件感知。

    1,805+64近 7 天星标变化
  • MOSS-TTSD@OpenMOSS

    MOSS-TTSD 是一个专为具表现力的多说话人合成而设计的语音对话生成模型。具备长上下文建模、灵活的说话人控制与多语言支持,同时可通过短语音参考实现零样本语音克隆。

    1,394+4近 7 天星标变化
  • Awesome-WAM@OpenMOSS

    具身智能(embodied AI)中世界动作模型(WAMs)的精选、持续更新阅读清单、论文博客与资源

    1,369+20近 7 天星标变化
  • MOVA@OpenMOSS

    MOVA:迈向可扩展且同步的音视频生成

    1,110+5近 7 天星标变化
  • AnyGPT@OpenMOSS

    “AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling”的代码

    881-1近 7 天星标变化
  • MOSS-Audio@OpenMOSS

    MOSS-Audio 是一个用于统一音频理解的开源基础模型,在真实世界场景中支持语音、声音、音乐、标题生成、问答与推理。

    656+5近 7 天星标变化
  • MOSS-VL@OpenMOSS

    An open-weight 11B model series for long-form and real-time video understanding

    606近 7 天星标变化
← 返回所有者排行