メインコンテンツへスキップ
buildradar
Sign in
オーナー · OpenMOSS

OpenMOSS

OpenMOSS の追跡中のオープンソースリポジトリを、スター数順に表示します。

9 件のリポジトリ
  • MOSS@OpenMOSS

    Fudan Universityによるオープンソースのツール拡張型対話型言語モデル

    12,234+11直近 7 日のスター増減
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nanoは、MOSI.AIとOpenMOSSチームによるオープンソースの多言語軽量音声生成モデルです。わずか0.1Bのパラメータで、リアルタイム音声生成向けに設計されており、GPUなしでCPU単体で動作可能であり、ローカルデモ、Webサービス、軽量な製品統合に適したシンプルなデプロイメントスタックを維持しています。

    4,279+51直近 7 日のスター増減
  • MOSS-TTS@OpenMOSS

    MOSS‑TTSファミリーは、MOSI.AIとOpenMOSSチームによるオープンソースの音声・音響生成モデルファミリーです。高忠実度、高表現力、複雑な実世界シナリオ向けに設計されており、安定した長尺音声、マルチスピーカー対話、ボイス/キャラクターデザイン、環境音エフェクト、リアルタイムストリーミングTTSを網羅しています。

    4,056+24直近 7 日のスター増減
  • MOSS-Transcribe-Diarize 0.9B は、長時間のマルチスピーカー書き起こし、話者分離、タイムスタンプ、音響イベント認識のためのオープンソースかつ SOTA なエンドツーエンド音声理解モデルです。

    1,778+158直近 7 日のスター増減
  • MOSS-TTSD@OpenMOSS

    MOSS-TTSD は、表現豊かなマルチ話者合成向けに設計された音声対話生成モデルです。コンテキストの長期モデリング、柔軟な話者制御、多言語サポートを備え、短い音声参照からのゼロショット音声クローンを実現します。

    1,394+0直近 7 日のスター増減
  • Awesome-WAM@OpenMOSS

    embodied AIにおけるWorld Action Models (WAMs)の厳選された継続的に更新される読書リスト、論文ブログ、リソース。

    1,358+47直近 7 日のスター増減
  • MOVA@OpenMOSS

    MOVA: スケーラブルで同期されたビデオ・オーディオ生成に向けて

    1,106+5直近 7 日のスター増減
  • AnyGPT@OpenMOSS

    「AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling」のコード

    882+0直近 7 日のスター増減
  • MOSS-Audio@OpenMOSS

    MOSS-Audio は、統合された音声理解のためのオープンソース基盤モデルであり、現実世界のシナリオにおける音声、サウンド、音楽、キャプション生成、QA、推論を可能にします。

    654+8直近 7 日のスター増減
← オーナーランキングに戻る