メインコンテンツへスキップ
buildradar
Sign in
トピック · diffusion-models

diffusion-models

diffusion-models がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

163 件のリポジトリ
  • サブ領域ごとに分類された拡散モデルの論文コレクション

    2,224+0直近 7 日のスター増減
  • score_sde_pytorch@yang-song

    確率微分方程式を用いたスコアベース生成モデリングの PyTorch 実装(ICLR 2021 Oral)

    2,130+0直近 7 日のスター増減
  • Helios@PKU-YuanGroup

    Helios: 真のリアルタイム長尺動画生成モデル

    2,129+18直近 7 日のスター増減
  • 医用画像における拡散モデル(Medical Image Analysis 誌に掲載)

    2,110+2直近 7 日のスター増減
  • ICEdit@River-Zhang

    [NeurIPS 2025] 画像編集は 1 つの LoRA で十分!わずか 0.1% のトレーニングデータで素晴らしい画像編集を実現!ID の維持において GPT-4o を凌駕〜MoE チェックポイントを公開!わずか 4GB の VRAM で実行可能!

    2,104+1直近 7 日のスター増減
  • diamond@eloialonso

    DIAMOND (DIffusion As a Model Of eNvironment Dreams) は、拡散ワールドモデルでトレーニングされた強化学習エージェントです。NeurIPS 2024 Spotlight。

    2,100+1直近 7 日のスター増減
  • zero123plus@SUDO-AI-3D

    Zero123++(単一画像から一貫性のある多視点を生成する拡散ベースモデル)のコードリポジトリ。

    2,096+0直近 7 日のスター増減
  • Awesome-LM-SSP@CryptoAILab

    大規模モデルの安全性、セキュリティ、プライバシーに関するリーディングリスト(Awesome LLM Security や Safety などを含む)

    2,070+0直近 7 日のスター増減
  • custom-diffusion@adobe-research

    Custom Diffusion: テキストから画像への拡散モデルにおけるマルチコンセプトのカスタマイズ(CVPR 2023)

    1,977-1直近 7 日のスター増減
  • Show-o@showlab

    [ICLR & NeurIPS 2025] マルチモーダルな理解と生成を統合する単一のTransformer、Show-oシリーズのリポジトリ。

    1,975+1直近 7 日のスター増減
  • LlamaGen@FoundationVision

    自己回帰モデルが Diffusion を凌駕:スケーラブルな画像生成のための 🦙 Llama

    1,966+0直近 7 日のスター増減
  • onediff@siliconflow

    OneDiff: diffusion models 向けのすぐに使える高速化ライブラリ。

    1,964+0直近 7 日のスター増減
  • Make-It-3D@junshutang

    [ICCV 2023] Make-It-3D: Diffusion Prior を用いた単一画像からの高精度な 3D 生成

    1,891+0直近 7 日のスター増減
  • dpm-solver@LuChengTHU

    「DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps」 (Neurips 2022 Oral) の公式コード

    1,852+0直近 7 日のスター増減
  • HunyuanVideo-I2V@Tencent-Hunyuan

    HunyuanVideo-I2V: HunyuanVideo をベースにしたカスタマイズ可能な Image-to-Video モデル

    1,840+0直近 7 日のスター増減
  • CatVTON@Zheng-Chong

    [ICLR 2025] CatVTONは、1) 軽量ネットワーク(総パラメータ数899.06M)、2) パラメータ効率の高い学習(学習可能パラメータ数49.57M)、3) 簡素化された推論(1024x768解像度でVRAM 8G未満)を備えた、シンプルで効率的なバーチャル試着用拡散モデルです。

    1,831+2直近 7 日のスター増減
  • FlashVSR@OpenImagingLab

    [CVPR 2026] リアルタイム拡散ベース・ストリーミング動画超解像に向けて — 局所制約付きスパースアテンションと軽量な条件付きデコーダを備えた、ストリーミングVSR向けの効率的な1ステップ拡散フレームワーク

    1,815+11直近 7 日のスター増減
  • RAG-Survey@hymie122

    AIGC向けRAGの素晴らしい論文集。論文「Retrieval-Augmented Generation for AI-Generated Content: A Survey」にて、RAGの基礎、拡張、応用の分類群を提案しています。

    1,789-1直近 7 日のスター増減
  • BrushNet@TencentARC

    [ECCV 2024] 論文「BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion」の公式実装

    1,744-1直近 7 日のスター増減
  • REPA@sihyun-yu

    [ICLR'25 Oral] 生成のための表現アライメント:Diffusion Transformers の学習は想像以上に簡単

    1,706+2直近 7 日のスター増減
  • ImageReward@zai-org

    [NeurIPS 2023] ImageReward:テキストから画像への生成における人間の好みの学習と評価

    1,703+1直近 7 日のスター増減
  • MMaDA@Gen-Verse

    MMaDA - オープンソースのマルチモーダル大規模拡散言語モデル(ブロック拡散、mixed-CoT、統合RLを搭載したdLLM)

    1,671+1直近 7 日のスター増減
  • 強化学習(RL)における拡散モデルのリソースに関するキュレーションリスト(随時更新)

    1,635+2直近 7 日のスター増減
  • fantasy-talking@Fantasy-AMAP

    [ACM MM 2025] FantasyTalking: 整合されたモーション合成によるリアルなトーキングポートレート生成

    1,628+0直近 7 日のスター増減
  • Magic123@guochengqian

    [ICLR'24] Magic123 の公式 PyTorch 実装:2D および 3D の拡散事前分布を使用した、1枚の画像から高品質な 3D オブジェクトを生成する手法

    1,622-1直近 7 日のスター増減
  • MIMO@menyifang

    「MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling」の公式実装

    1,579+1直近 7 日のスター増減
  • DiffDock@gcorso

    DiffDock の実装:分子ドッキングのための拡散ステップ、ツイスト、およびターン

    1,570-1直近 7 日のスター増減
  • Generative_Deep_Learning_2nd_Edition@davidADSP

    O'Reilly の書籍『Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play』第 2 版の公式コードリポジトリ

    1,553+3直近 7 日のスター増減
  • LanPaint@scraed

    あらゆるStable Diffusionモデルに対応する、高品質かつトレーニング不要のインペイント。ComfyUIをサポート

    1,372+4直近 7 日のスター増減
  • TeaCache@ali-vilab

    Timestep Embedding が告げること: Video Diffusion Model におけるキャッシュのタイミング

    1,371+2直近 7 日のスター増減
← トピック一覧に戻る