跳到主要内容
buildradar
Sign in
主题 · diffusion-models

diffusion-models

标记 diffusion-models 主题、收录中的开源项目,按星标数排序。

共 163 个项目
  • MOFA-Video@MyNiuuu

    [ECCV 2024] MOFA-Video:通过冻结的 Image-to-Video 扩散模型中的生成式运动场域适应(Motion Field Adaptations)来实现可控图像动画。

    766+0近 7 天星标变化
  • 精选的文生图生成研究集合。

    765+0近 7 天星标变化
  • PMRF@ohayonguy

    [ICLR 2025] Posterior-Mean Rectified Flow 官方实现:迈向最小 MSE 的写实图像修复

    754+0近 7 天星标变化
  • MagicDrive-V2@flymin

    [ICCV 2025] 论文「MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control」的官方实现。

    729+1近 7 天星标变化
  • distrifuser@mit-han-lab

    [CVPR 2024 Highlight] DistriFusion:高分辨率扩散模型的分布式并行推理

    728+0近 7 天星标变化
  • nano-world-model@simchowitzlabpublic

    一个极简、功能齐全的存储库,用于推进世界模型科学。

    725+6近 7 天星标变化
  • DL4Proteins-notebooks@Graylab

    涵盖生物分子结构预测与设计之深度学习工具的 Colab 笔记本

    724+1近 7 天星标变化
  • 使用均值回归随机微分方程进行图像修复,ICML 2023。NTIRE 2023 图像去阴影竞赛夺冠方案。

    722+0近 7 天星标变化
  • mdlm@kuleshov-group

    [NeurIPS 2024] 简单且有效的掩码扩散语言模型

    711+2近 7 天星标变化
  • [ICML 2025] 「History-Guided Video Diffusion」的官方 PyTorch 实现

    709+1近 7 天星标变化
  • AR Diffusion 视频世界模型精选列表:涵盖算法、应用与基础设施,旨在为研究人员、从业者与爱好者提供全面资源。

    701+5近 7 天星标变化
  • CRM@thu-ml

    [ECCV 2024] 使用卷积重建模型,在 10 秒内将单张图像转换为 3D 纹理网格。

    696+0近 7 天星标变化
  • Flow-Factory@X-GenGroup

    用于在 Flow-Matching 模型中轻松进行强化学习的统一框架

    690+7近 7 天星标变化
  • CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC 论文与代码集合

    677+1近 7 天星标变化
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1:用于高分辨率 (2K) 文字转图像生成的高效扩散模型

    675+0近 7 天星标变化
  • Make-An-Audio@Text-to-Audio

    Make-An-Audio (ICML'23) 文本转音频生成模型的 PyTorch 实现

    668+0近 7 天星标变化
  • OneDiffusion@lehduong

    OneDiffusion 论文 (CVPR 2025) 的官方实现

    665+0近 7 天星标变化
  • flash-diffusion@gojasper

    Flash Diffusion — 加速条件式扩散模型(AAAI 2025 Oral)

    663+1近 7 天星标变化
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter:为无声视频赋予生动且同步的音效。AI 拟音大师,给你的无声视频添加生动而且同步的音效 😝

    663+0近 7 天星标变化
  • NOVA@baaivision

    [ICLR 2025] 无向量量化的自回归视频生成

    660-1近 7 天星标变化
  • DFloat11@LeanModels

    DFloat11 [NeurIPS '25]:LLMs 与 DiTs 的无损压缩,实现高效的 GPU 推理

    654-1近 7 天星标变化
  • Open-dLLM@pengzhangzhi

    用于代码生成的开放扩散语言模型 — 发布预训练、评估、推理与检查点。

    652+3近 7 天星标变化
  • blended-latent-diffusion@omriav

    「Blended Latent Diffusion」[SIGGRAPH 2023] 的官方实现

    632+0近 7 天星标变化
  • OpenMusic@ivcylc

    OpenMusic:SOTA 文本转音乐(TTM)生成

    631+1近 7 天星标变化
  • Ditto@EzioBy

    [CVPR'26 Highlight] Ditto:利用高质量合成数据集扩展基于指令的视频编辑

    626+2近 7 天星标变化
  • radial-attention@mit-han-lab

    [NeurIPS 2025] 径向注意力:用于长视频生成、具能量衰减机制的 O(nlogn) 稀疏注意力机制

    607-1近 7 天星标变化
  • BrushEdit@TencentARC

    [TPAMI] 论文「BrushEdit: All-In-One Image Inpainting and Editing」的官方实现

    590+0近 7 天星标变化
  • semantic-draw@ironjr

    CVPR 2025 论文“SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models”官方代码。

    588-1近 7 天星标变化
  • VEnhancer@Vchitect

    VEnhancer 官方代码:用于视频生成的生成式时空增强技术。

    579+0近 7 天星标变化
  • EDGE@Stanford-TML

    EDGE (CVPR 2023) 的官方 PyTorch 实现

    577+2近 7 天星标变化
← 返回主题列表