オーナー · OpenMOSS
OpenMOSS
OpenMOSS の追跡中のオープンソースリポジトリを、スター数順に表示します。
9 件のリポジトリ
- #1★ 12,234+11直近 7 日のスター増減
- #2
MOSS-TTS-Nanoは、MOSI.AIとOpenMOSSチームによるオープンソースの多言語軽量音声生成モデルです。わずか0.1Bのパラメータで、リアルタイム音声生成向けに設計されており、GPUなしでCPU単体で動作可能であり、ローカルデモ、Webサービス、軽量な製品統合に適したシンプルなデプロイメントスタックを維持しています。
★ 4,279+51直近 7 日のスター増減 - #3
MOSS‑TTSファミリーは、MOSI.AIとOpenMOSSチームによるオープンソースの音声・音響生成モデルファミリーです。高忠実度、高表現力、複雑な実世界シナリオ向けに設計されており、安定した長尺音声、マルチスピーカー対話、ボイス/キャラクターデザイン、環境音エフェクト、リアルタイムストリーミングTTSを網羅しています。
★ 4,056+24直近 7 日のスター増減 - #4
MOSS-Transcribe-Diarize 0.9B は、長時間のマルチスピーカー書き起こし、話者分離、タイムスタンプ、音響イベント認識のためのオープンソースかつ SOTA なエンドツーエンド音声理解モデルです。
★ 1,778+158直近 7 日のスター増減 - #5
MOSS-TTSD は、表現豊かなマルチ話者合成向けに設計された音声対話生成モデルです。コンテキストの長期モデリング、柔軟な話者制御、多言語サポートを備え、短い音声参照からのゼロショット音声クローンを実現します。
★ 1,394+0直近 7 日のスター増減 - #6
embodied AIにおけるWorld Action Models (WAMs)の厳選された継続的に更新される読書リスト、論文ブログ、リソース。
★ 1,358+47直近 7 日のスター増減 - #7★ 1,106+5直近 7 日のスター増減
- #8★ 882+0直近 7 日のスター増減
- #9
MOSS-Audio は、統合された音声理解のためのオープンソース基盤モデルであり、現実世界のシナリオにおける音声、サウンド、音楽、キャプション生成、QA、推論を可能にします。
★ 654+8直近 7 日のスター増減