メインコンテンツへスキップ
buildradar
Sign in

QwenAudio/ThinkSound

@QwenAudio

[NeurIPS 2025] Chain-of-Thought (CoT) 推論に誘導され、あらゆるモダリティから音声を生成する統合フレームワーク [ThinkSound] の PyTorch 実装

スター
1,378
フォーク
82
言語
Python
ライセンス
最終プッシュ
5 か月前
Pythontext-to-audiofoley-sound-synthesisvideo-to-audiottaaigc-audiotext-video-to-audio

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。