メインコンテンツへスキップ
buildradar
Sign in

Text-to-Audio/AudioLCM

@Text-to-Audio

AudioLCM (ACM-MM'24) の PyTorch 実装:潜在整合性モデル(latent consistency model)を使用した、効率的かつ高品質なテキスト音声生成。

スター
1,164
フォーク
158
言語
Python
ライセンス
最終プッシュ
1 年前
Python

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。