跳到主要内容
buildradar
Sign in
主题 · diffusion

diffusion

标记 diffusion 主题、收录中的开源项目,按星标数排序。

共 76 个项目
  • Helios@PKU-YuanGroup

    Helios:真正的实时长视频生成模型

    2,129+18近 7 天星标变化
  • 医学影像中的扩散模型(发表于 Medical Image Analysis 期刊)

    2,110+2近 7 天星标变化
  • ICEdit@River-Zhang

    [NeurIPS 2025] 图像编辑只需要一个 LoRA!用 0.1% 的训练数据就能进行神奇的图像编辑!在 ID 保持能力上超越 GPT-4o~MoE 检查点已发布!只需 4GB VRAM 即可运行!

    2,104+1近 7 天星标变化
  • LlamaGen@FoundationVision

    自回归模型打败 Diffusion:用于可扩展图像生成的 🦙 Llama

    1,966+0近 7 天星标变化
  • BrushNet@TencentARC

    [ECCV 2024] 论文“BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion”官方实现

    1,744-1近 7 天星标变化
  • REPA@sihyun-yu

    [ICLR'25 Oral] 生成的表征对齐:训练 Diffusion Transformers 比想象中更容易

    1,706+2近 7 天星标变化
  • fantasy-talking@Fantasy-AMAP

    [ACM MM 2025] FantasyTalking:通过一致性动作合成生成逼真的对话肖像

    1,628+0近 7 天星标变化
  • AngelSlim@Tencent

    为提升易用性、完整性与效率而设计的模型压缩工具包。

    1,619+58近 7 天星标变化
  • Pallaidium@tin2tin

    PALLAIDIUM — 集成至 Blender Video Editor (VSE) 的生成式 AI 电影工作室,支持从剧本到画面及后期的端到端制作。

    1,523+0近 7 天星标变化
  • UNO@bytedance

    [ICCV 2025] 🔥🔥 UNO:支持单一与多主体条件设置的通用定制化方法

    1,362+0近 7 天星标变化
  • finetrainers@huggingface

    可扩展且内存优化的扩散模型训练

    1,359+0近 7 天星标变化
  • Inpaint Anything 扩展使用 Segment Anything 的遮罩,在浏览器 UI 中执行 stable diffusion 图像修复。

    1,298+0近 7 天星标变化
  • tango@declare-lab

    用于文本转语音生成的扩散模型系列。

    1,238-1近 7 天星标变化
  • MixGRPO@Tencent-Hunyuan

    [ECCV 2026] MixGRPO:通过混合 ODE-SDE 解锁基于 Flow 的 GRPO 效率

    1,177+0近 7 天星标变化
  • mlx-serve@ddalcu

    适用于 Apple Silicon 的原生 LLM 推理服务器。兼容 OpenAI + Anthropic API。无 Python。包含带聊天、agent 模式和工具调用功能的 MLX Core macOS 应用。

    1,115+245近 7 天星标变化
  • dial-mpc@LeCAR-Lab

    论文“Full-Order Sampling-Based MPC for Torque-Level Locomotion Control via Diffusion-Style Annealing”的官方实现。DIAL-MPC 是一个新颖的基于采样的 MPC 框架,用于四足机器人全阶扭矩级控制,兼具精确性与敏捷性且无需训练。

    997+1近 7 天星标变化
  • 使用生成式 AI 与深度学习进行分子与材料设计的列表。

    952+1近 7 天星标变化
  • Causal-Forcing@thu-ml

    [ICML 2026]“Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation”与 Causal Forcing++ 的官方代码库

    948+10近 7 天星标变化
  • FireRedTTS@FireRedTeam

    一个由 LLM 驱动的开源基础 TTS 系统

    921+2近 7 天星标变化
  • UniWorld@PKU-YuanGroup

    UniWorld:用于统一视觉理解与生成的高分辨率语义编码器

    890+0近 7 天星标变化
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] 基于频率分解的保持身份文本转视频生成

    856+1近 7 天星标变化
  • LION@nv-tlabs

    用于 3D 形状生成的潜在点扩散模型

    835+0近 7 天星标变化
  • “RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers”(ICML 2025)、UltraViCo (ICLR 2026) 与 UltraImage 的官方实现

    827+2近 7 天星标变化
  • Adan@sail-sg

    Adan:用于加速优化深度模型的自适应 Nesterov 动量算法

    822+0近 7 天星标变化
  • kandinsky-5@kandinskylab

    Kandinsky 5.0:用于视频与图像生成的扩散模型系列

    819+3近 7 天星标变化
  • [TMLR 2025🔥] 视觉自回归模型综述。

    808+1近 7 天星标变化
  • daam@castorini

    用于解释 Stable Diffusion 的扩散注意力归因图。

    802+0近 7 天星标变化
  • rcm@NVlabs

    rCM 与 Causal-rCM:大规模双向/自回归视频扩散蒸馏的领先与统一算法/基础设施

    800+6近 7 天星标变化
  • smalldiffusion@yuanchenyang

    用于训练扩散模型并从中进行采样的简单且易读的代码

    785+2近 7 天星标变化
  • FRESCO@williamyang1991

    [CVPR 2024] FRESCO:用于零样本视频翻译的时空对应

    782-1近 7 天星标变化
← 返回主题列表