跳到主要内容
buildradar
Sign in
主题 · diffusion-models

diffusion-models

标记 diffusion-models 主题、收录中的开源项目,按星标数排序。

共 163 个项目
  • finetrainers@huggingface

    可扩展且内存优化的扩散模型训练

    1,359+0近 7 天星标变化
  • Matcha-TTS@shivammehta25

    [ICASSP 2024] 🍵 Matcha-TTS:具备条件式流匹配(Conditional Flow Matching)的高效 TTS 架构

    1,353+3近 7 天星标变化
  • DDNM@wyhuai

    [ICLR 2023 Oral] 使用去噪扩散零空间模型的零样本图像修复

    1,351+2近 7 天星标变化
  • FireRed-Image-Edit@FireRedTeam

    FireRed-Image-Edit 是一个强大的图像编辑基础模型,达到开源的 SOTA 性能,具备精确的指令遵循、高保真生成、优异的身份一致性以及无缝的多元素融合。

    1,350+3近 7 天星标变化
  • IMAGDressing@muzishen

    [AAAI 2025]👔IMAGDressing👔:虚拟穿搭的交互式模块化服饰生成。它支持具有灵活服饰、姿势和场景控制的可定制人像生成,确保虚拟穿搭的高保真度与服饰一致性。

    1,343+0近 7 天星标变化
  • MagicTime@PKU-YuanGroup

    [TPAMI 2025🔥] MagicTime:作为变形模拟器的时移视频生成模型

    1,337-1近 7 天星标变化
  • Hunyuan3D-2-WinPortable@YanWenKun

    📦 在 Windows 上运行 Hunyuan3D 2.0/2.1 的便携包。

    1,326+4近 7 天星标变化
  • pruna@PrunaAI

    Pruna 是一个为开发者打造的模型优化框架,能让你以极低的额外开销交付更快、更高效的模型。

    1,274+1近 7 天星标变化
  • Difix3D@nv-tlabs

    [CVPR 2025 Oral & Best Paper Finalist] Difix3D+: 利用单步 Diffusion Models 改善 3D 重建

    1,267+1近 7 天星标变化
  • DragDiffusion@Yujun-Shi

    [CVPR2024, Highlight] DragDiffusion 的官方代码

    1,259+0近 7 天星标变化
  • tango@declare-lab

    用于文本转语音生成的扩散模型系列。

    1,238-1近 7 天星标变化
  • HunyuanCustom@Tencent-Hunyuan

    HunyuanCustom:用于定制视频生成的多模态驱动架构

    1,228-1近 7 天星标变化
  • Irodori-TTS@Aratako

    基于 Flow Matching 且支持 Emoji 驱动风格控制的文本转语音模型

    1,228+4近 7 天星标变化
  • MeanFlow@haidog-yaqub

    MeanFlow 与 iMF(单步生成式建模)的 PyTorch 实现。

    1,196-1近 7 天星标变化
  • wunjo.wladradchenko.ru@wladradchenko

    Wunjo CE:面部交换、对嘴、控制移除对象与文字及背景、风格重塑、音频分离、语音复制、视频生成。开源、本地运行且免费。

    1,170+1近 7 天星标变化
  • MagicDrive@cure-lab

    [ICLR24] 论文“MagicDrive: Street View Generation with Diverse 3D Geometry Control”的官方实现

    1,167+1近 7 天星标变化
  • 文字转图片 diffusion models 可控生成资源收集。

    1,110+0近 7 天星标变化
  • MOVA@OpenMOSS

    MOVA:迈向可扩展且同步的音视频生成

    1,108+3近 7 天星标变化
  • pytorch-stable-diffusion@hkproj

    在 PyTorch 中从头实现的 Stable Diffusion

    1,078+0近 7 天星标变化
  • VisCPM@OpenBMB

    [ICLR'24 spotlight] 中英双语多模态大模型系列(对话与绘图)| 基于 CPM 基础模型的中英双语多模态大模型系列

    1,061-1近 7 天星标变化
  • MotionDirector@showlab

    [ECCV 2024 Oral] MotionDirector:文本到视频扩散模型的动作定制。

    1,053+2近 7 天星标变化
  • Diffusion-Planner@ZhengYinan-AIR

    [ICLR 2025 Oral]「具备弹性指引的自主驾驶扩散式规划」官方实现。

    1,050+4近 7 天星标变化
  • 3DTopia-XL@3DTopia

    [CVPR 2025 Highlight] 3DTopia-XL:通过 Primitive Diffusion 进行高质量 3D PBR 资产生成

    1,046+0近 7 天星标变化
  • SyncDreamer@liuyuan-pal

    [ICLR 2024 Spotlight] SyncDreamer:从单一视角图像生成多视角一致的图像

    1,044-1近 7 天星标变化
  • FlowEdit@fallenshock

    论文官方实现:“FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models”

    1,013-1近 7 天星标变化
  • FastGen@NVlabs

    NVIDIA FastGen:来自 Diffusion 模型的快速生成

    986+22近 7 天星标变化
  • PIA@open-mmlab

    [CVPR 2024] PIA,你的个性化图像动画生成器。通过文本提示词结合 Dreambooth 来让图片动起来,实现令人惊艳的视频效果。PIA,你的个性化图像动画生成器,利用文本提示将图像变为奇妙的动画。

    975+0近 7 天星标变化
  • DeepCache@horseee

    [CVPR 2024] DeepCache:免费加速 Diffusion Models。

    970-1近 7 天星标变化
  • diffae@konpatp

    Diffusion Autoencoders 的官方实现

    969+0近 7 天星标变化
  • story-iter@UCSC-VLAA

    [ICLR 2026] 用于长篇故事可视化的免训练迭代框架。

    959+0近 7 天星标变化
← 返回主题列表