跳到主要内容
buildradar
Sign in
主题 · diffusion-models

diffusion-models

标记 diffusion-models 主题、收录中的开源项目,按星标数排序。

共 163 个项目
  • story-iter@UCSC-VLAA

    [ICLR 2026] 用于长篇故事可视化的免训练迭代框架。

    957+0近 7 天星标变化
  • Skyfall-GS@jayin92

    [ECCV 2026] Skyfall-GS:从卫星影像合成沉浸式 3D 城市场景

    955+4近 7 天星标变化
  • 基于扩散模型的图像处理总结,包含修复、增强、编码与质量评估

    954-1近 7 天星标变化
  • Causal-Forcing@thu-ml

    [ICML 2026]“Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation”与 Causal Forcing++ 的官方代码库

    950+10近 7 天星标变化
  • ODISE@NVlabs

    ODISE 的官方 PyTorch 实现:基于 Text-to-Image Diffusion Models 的开放词汇全景分割 [CVPR 2023 Highlight]

    943+0近 7 天星标变化
  • MindAct@candle-org

    MindSpore + 🤗Huggingface:在 MindSpore 上运行任何 Transformers/Diffusers 模型,具备无缝兼容性与加速功能。

    920+0近 7 天星标变化
  • 关于扩散模型的关键论文与博客总结,以便学习该主题。包含所有已发布扩散机器人论文的详细清单。

    920+1近 7 天星标变化
  • 展示多个使用 Diffusers 的实时扩散模型管线的应用程序

    916-1近 7 天星标变化
  • UniPic@SkyworkAI

    开源的 SOTA 多图编辑模型

    874+1近 7 天星标变化
  • MiniGPT-5@UCSB-AI

    论文「MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens」的官方实现

    869+0近 7 天星标变化
  • OpenWorldLib@OpenDCAI

    先进世界模型的统一代码库

    866+2近 7 天星标变化
  • Open-DiffusionGS@caiyuanhao1998

    将 Gaussian Splatting 烘焙至 Diffusion Denoiser 中,以实现快速且可扩展的单阶段 Image-to-3D 生成与重建 (ICCV 2025)

    861+1近 7 天星标变化
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] 基于频率分解的保持身份文本转视频生成

    857+1近 7 天星标变化
  • instruct-nerf2nerf@ayaanzhaque

    Instruct-NeRF2NeRF:通过指令编辑 3D 场景 (ICCV 2023)

    852-1近 7 天星标变化
  • 近期 AI 会议与期刊中关于神经网络量化的论文清单。

    851+6近 7 天星标变化
  • DiffuSeq@Shark-NLP

    [ICLR'23] DiffuSeq:使用扩散模型的序列到序列文本生成

    838+0近 7 天星标变化
  • MeshDiffusion@lzzcd001

    “MeshDiffusion: Score-based Generative 3D Mesh Modeling”(ICLR 2023 Spotlight)的官方实现

    832+0近 7 天星标变化
  • GaussianDreamer@hustvl

    [CVPR 2024] GaussianDreamer:通过串接 2D 与 3D 扩散模型从文本快速生成 3D 高斯模型

    829-1近 7 天星标变化
  • “RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers”(ICML 2025)、UltraViCo (ICLR 2026) 与 UltraImage 的官方实现

    827+2近 7 天星标变化
  • 受 awesome-computer-vision 启发,精选大模型(即 LLM/VLM)时代下与机器人领域相关的 3D 视觉论文清单,包含论文、代码及相关网站

    821+1近 7 天星标变化
  • daclip-uir@Algolzw

    [ICLR 2024] 控制视觉语言模型以实现通用图像修复。荣获 NTIRE 2024 野外通用图像修复挑战赛(Restore Any Image Model in the Wild Challenge)第五名。

    817+1近 7 天星标变化
  • Paint3D@OpenTexture

    [CVPR 2024] Paint3D:使用无光照纹理扩散模型彩绘任何 3D 物件,这是一个无光照烘焙纹理生成模型

    808-1近 7 天星标变化
  • deepinv@deepinv

    DeepInverse:一个使用深度学习来解决图像反演问题的 PyTorch 库

    803+5近 7 天星标变化
  • audio-diffusion@teticio

    使用新的 Hugging Face diffusers 套件应用 diffusion 模型来合成音乐而非图像。

    795+1近 7 天星标变化
  • smalldiffusion@yuanchenyang

    用于训练扩散模型并从中进行采样的简单且易读的代码

    785+2近 7 天星标变化
  • 精选的视频生成研究集合。

    782+0近 7 天星标变化
  • LLM、MLLM 及其他领域的模型合并:方法、理论、应用与机会。ACM Computing Surveys, 2026。

    779+1近 7 天星标变化
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (也称 MagicDance):具备身份感知能力的 Diffusion 实现真实人类姿态与面部表情重定向

    776+0近 7 天星标变化
  • dift@Tsingularity

    [NeurIPS'23] 来自 Image Diffusion 的涌现对应

    775+0近 7 天星标变化
  • Attend-and-Excite@yuval-alaluf

    「Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models」的官方实现 (SIGGRAPH 2023)

    770+0近 7 天星标变化
← 返回主题列表