Text-to-Audio/AudioLCM
@Text-to-AudioAudioLCM (ACM-MM'24) の PyTorch 実装:潜在整合性モデル(latent consistency model)を使用した、効率的かつ高品質なテキスト音声生成。
スター
1,164
フォーク
158
言語
Python
ライセンス
—
最終プッシュ
1 年前
関連 Intel(0)
関連 Intel はまだありません
このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。