メインコンテンツへスキップ
buildradar
Sign in
トピック · diffusion-models

diffusion-models

diffusion-models がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

163 件のリポジトリ
  • MOFA-Video@MyNiuuu

    [ECCV 2024] MOFA-Video: 固定された Image-to-Video 拡散モデルにおける生成的モーションフィールド適応を通じた制御可能な画像アニメーション。

    766+0直近 7 日のスター増減
  • テキストからの画像生成に関する素晴らしい研究のコレクション。

    765+0直近 7 日のスター増減
  • PMRF@ohayonguy

    [ICLR 2025] Posterior-Mean Rectified Flow の公式実装: 最小 MSE 写真リアスティック画像復元に向けて

    754+0直近 7 日のスター増減
  • MagicDrive-V2@flymin

    [ICCV 2025] 論文「MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control」の公式実装。

    729+1直近 7 日のスター増減
  • distrifuser@mit-han-lab

    [CVPR 2024 Highlight] DistriFusion: 高解像度Diffusion Models向けの分散並列推論

    728+1直近 7 日のスター増減
  • nano-world-model@simchowitzlabpublic

    ワールドモデル科学の発展を目的とした、ミニマリストで機能が充実したリポジトリ。

    725+4直近 7 日のスター増減
  • DL4Proteins-notebooks@Graylab

    生体分子の構造予測とデザインのためのディープラーニングツールを網羅したColabノートブック

    724+2直近 7 日のスター増減
  • 平均回帰確率微分方程式を用いた画像復元 (ICML 2023)。NTIRE 2023 画像影除去チャレンジの優勝ソリューション。

    722+0直近 7 日のスター増減
  • mdlm@kuleshov-group

    [NeurIPS 2024] シンプルかつ効果的なマスク拡散言語モデル

    711+1直近 7 日のスター増減
  • [ICML 2025] 「History-Guided Video Diffusion」の公式 PyTorch 実装

    709+1直近 7 日のスター増減
  • AR Diffusionを活用したAwesome Video World Modelsのキュレーションリスト:アルゴリズム、アプリケーション、インフラストラクチャを網羅し、研究者、実務者、愛好家向けの包括的なリソースとなることを目指しています。

    701+4直近 7 日のスター増減
  • CRM@thu-ml

    [ECCV 2024] 畳み込み再構成モデルを使用して、1枚の画像から10秒で3Dテクスチャ付きメッシュを生成する。

    696+1直近 7 日のスター増減
  • Flow-Factory@X-GenGroup

    Flow-Matching モデルでの強化学習を容易にする統合フレームワーク

    690+6直近 7 日のスター増減
  • CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC 関連の論文とコードのコレクション

    677+0直近 7 日のスター増減
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: 高解像度(2K)テキストから画像への生成を行う効率的な拡散モデル

    675+0直近 7 日のスター増減
  • Make-An-Audio@Text-to-Audio

    テキスト音声生成モデルを使用したMake-An-Audio(ICML'23)のPyTorch実装

    668+0直近 7 日のスター増減
  • OneDiffusion@lehduong

    OneDiffusion 論文 (CVPR 2025) の公式実装

    665+0直近 7 日のスター増減
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter:リアルで同期したサウンドでサイレント動画に生命を吹き込む。無声動画に生き生きとした同期音声を追加するAIフォーリーツール 😝

    663+0直近 7 日のスター増減
  • flash-diffusion@gojasper

    Flash Diffusion — 条件付き拡散モデルの高速化(AAAI 2025 Oral)

    663+1直近 7 日のスター増減
  • NOVA@baaivision

    [ICLR 2025] ベクトル量子化を使用しない自己回帰型動画生成

    660-1直近 7 日のスター増減
  • DFloat11@LeanModels

    DFloat11 [NeurIPS '25]: GPU推論の効率化に向けたLLMおよびDiTのロスレス圧縮

    654+0直近 7 日のスター増減
  • Open-dLLM@pengzhangzhi

    コード生成のためのオープンな拡散言語モデル — 事前学習、評価、推論、チェックポイントを公開

    652+1直近 7 日のスター増減
  • blended-latent-diffusion@omriav

    「Blended Latent Diffusion」の公式実装 [SIGGRAPH 2023]

    632+0直近 7 日のスター増減
  • OpenMusic@ivcylc

    OpenMusic: SOTA Text-to-Music (TTM) 生成

    631+1直近 7 日のスター増減
  • Ditto@EzioBy

    [CVPR'26 Highlight] Ditto: 高品質な合成データセットを用いた指示ベースの動画編集のスケーリング

    626+3直近 7 日のスター増減
  • radial-attention@mit-han-lab

    [NeurIPS 2025] Radial Attention: 長尺動画生成のためのエネルギー減衰を伴う O(nlogn) スパースアテンション

    607-1直近 7 日のスター増減
  • BrushEdit@TencentARC

    [TPAMI] 論文「BrushEdit: All-In-One Image Inpainting and Editing」の公式実装

    590+0直近 7 日のスター増減
  • semantic-draw@ironjr

    CVPR 2025 の論文「SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models」の公式コード

    588-1直近 7 日のスター増減
  • VEnhancer@Vchitect

    VEnhancer(動画生成のための生成型時空間拡張)の公式コード

    579+0直近 7 日のスター増減
  • EDGE@Stanford-TML

    EDGE (CVPR 2023) の公式 PyTorch 実装

    577+2直近 7 日のスター増減
← トピック一覧に戻る