diffusion-models
diffusion-models がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #61
拡散モデルのスケーラブルかつメモリ最適化されたトレーニング
★ 1,359+1直近 7 日のスター増減 - #62
[ICASSP 2024] 🍵 Matcha-TTS: 条件付きフローマッチングを用いた高速なTTSアーキテクチャ
★ 1,353+4直近 7 日のスター増減 - #63★ 1,351+2直近 7 日のスター増減
- #64
FireRed-Image-Editは、正確な指示追従、高忠実度の生成、優れたアイデンティティの一貫性、シームレスなマルチ要素融合により、オープンソースの最先端パフォーマンスを実現する強力な画像編集基盤モデルです。
★ 1,350+6直近 7 日のスター増減 - #65
[AAAI 2025] 👔IMAGDressing👔:バーチャル試着のためのインタラクティブなモジュール型アパレル生成。柔軟な衣服、ポーズ、シーン制御によりカスタマイズ可能な人物画像生成を可能にし、バーチャル試着における高い忠実度と衣服の一貫性を保証します。
★ 1,343+0直近 7 日のスター増減 - #66★ 1,337-1直近 7 日のスター増減
- #67
WindowsでHunyuan3D 2.0/2.1を実行するためのポータブルパッケージ。| 混元 3D 2.0/2.1 整合包
★ 1,326+5直近 7 日のスター増減 - #68★ 1,274+2直近 7 日のスター増減
- #69
[CVPR 2025 Oral & Best Paper Finalist] Difix3D+: 単一ステップ Diffusion Model による 3D 再構築の改善
★ 1,267+0直近 7 日のスター増減 - #70
[CVPR2024, Highlight] DragDiffusion の公式コード
★ 1,259+0直近 7 日のスター増減 - #71★ 1,238-1直近 7 日のスター増減
- #72
絵文字駆動型スタイル制御を備えたFlow Matchingベースの音声合成モデル
★ 1,228+8直近 7 日のスター増減 - #73
HunyuanCustom: カスタム動画生成のためのマルチモーダル駆動型アーキテクチャ
★ 1,228+1直近 7 日のスター増減 - #74★ 1,196+0直近 7 日のスター増減
- #75
Wunjo CE:顔の差し替え、リップシンク、オブジェクト・テキスト・背景の削除、スタイル変更、音源分離、音声クローン、動画生成。オープンソース、ローカル実行可能、無料。
★ 1,170+1直近 7 日のスター増減 - #76
[ICLR24] 論文「MagicDrive: Street View Generation with Diverse 3D Geometry Control」の公式実装
★ 1,167+1直近 7 日のスター増減 - #77
テキストフロンティア画像拡散モデルによる制御可能な生成に関するリソースのコレクション
★ 1,110+0直近 7 日のスター増減 - #78★ 1,108+4直近 7 日のスター増減
- #79
PyTorch でスクラッチから実装された Stable Diffusion
★ 1,078-1直近 7 日のスター増減 - #80
[ICLR'24 spotlight] 中国語と英語のマルチモーダル大規模モデルシリーズ(チャットおよびペイント)| CPM基盤モデルに基づく中英バイリンガルマルチモーダル大モデルシリーズ
★ 1,061+0直近 7 日のスター増減 - #81
[ECCV 2024 Oral] MotionDirector: Text-to-Video Diffusionモデルのモーションカスタマイズ。
★ 1,053+3直近 7 日のスター増減 - #82
[ICLR 2025 Oral] 「Diffusion-Based Planning for Autonomous Driving with Flexible Guidance」の公式実装
★ 1,050+5直近 7 日のスター増減 - #83
[CVPR 2025 Highlight] 3DTopia-XL: プリミティブ拡散による高品質3D PBRアセット生成
★ 1,046+1直近 7 日のスター増減 - #84
[ICLR 2024 Spotlight] SyncDreamer: 単一ビュー画像からマルチビュー整合性のある画像を生成する
★ 1,044+0直近 7 日のスター増減 - #85
論文の公式実装:「FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models」
★ 1,013-1直近 7 日のスター増減 - #86★ 986+24直近 7 日のスター増減
- #87
[CVPR 2024] PIA、パーソナライズされた画像アニメーター。テキストプロンプトで画像をアニメーション化し、Dreamboothと組み合わせることで素晴らしい動画を実現します。
★ 975+0直近 7 日のスター増減 - #88★ 970+0直近 7 日のスター増減
- #89★ 969+0直近 7 日のスター増減
- #90
[ICLR 2026] 長編ストーリーの視覚化に向けたトレーニング不要の反復型フレームワーク。
★ 959+1直近 7 日のスター増減