diffusion-models
标记 diffusion-models 主题、收录中的开源项目,按星标数排序。
- #61
可扩展且内存优化的扩散模型训练
★ 1,359+0近 7 天星标变化 - #62
[ICASSP 2024] 🍵 Matcha-TTS:具备条件式流匹配(Conditional Flow Matching)的高效 TTS 架构
★ 1,353+3近 7 天星标变化 - #63★ 1,351+2近 7 天星标变化
- #64
FireRed-Image-Edit 是一个强大的图像编辑基础模型,达到开源的 SOTA 性能,具备精确的指令遵循、高保真生成、优异的身份一致性以及无缝的多元素融合。
★ 1,350+3近 7 天星标变化 - #65
[AAAI 2025]👔IMAGDressing👔:虚拟穿搭的交互式模块化服饰生成。它支持具有灵活服饰、姿势和场景控制的可定制人像生成,确保虚拟穿搭的高保真度与服饰一致性。
★ 1,343+0近 7 天星标变化 - #66★ 1,337-1近 7 天星标变化
- #67
📦 在 Windows 上运行 Hunyuan3D 2.0/2.1 的便携包。
★ 1,326+4近 7 天星标变化 - #68★ 1,274+1近 7 天星标变化
- #69★ 1,267+1近 7 天星标变化
- #70
[CVPR2024, Highlight] DragDiffusion 的官方代码
★ 1,259+0近 7 天星标变化 - #71★ 1,238-1近 7 天星标变化
- #72
HunyuanCustom:用于定制视频生成的多模态驱动架构
★ 1,228-1近 7 天星标变化 - #73
基于 Flow Matching 且支持 Emoji 驱动风格控制的文本转语音模型
★ 1,228+4近 7 天星标变化 - #74★ 1,196-1近 7 天星标变化
- #75
Wunjo CE:面部交换、对嘴、控制移除对象与文字及背景、风格重塑、音频分离、语音复制、视频生成。开源、本地运行且免费。
★ 1,170+1近 7 天星标变化 - #76
[ICLR24] 论文“MagicDrive: Street View Generation with Diverse 3D Geometry Control”的官方实现
★ 1,167+1近 7 天星标变化 - #77
文字转图片 diffusion models 可控生成资源收集。
★ 1,110+0近 7 天星标变化 - #78★ 1,108+3近 7 天星标变化
- #79
在 PyTorch 中从头实现的 Stable Diffusion
★ 1,078+0近 7 天星标变化 - #80★ 1,061-1近 7 天星标变化
- #81
[ECCV 2024 Oral] MotionDirector:文本到视频扩散模型的动作定制。
★ 1,053+2近 7 天星标变化 - #82
[ICLR 2025 Oral]「具备弹性指引的自主驾驶扩散式规划」官方实现。
★ 1,050+4近 7 天星标变化 - #83
[CVPR 2025 Highlight] 3DTopia-XL:通过 Primitive Diffusion 进行高质量 3D PBR 资产生成
★ 1,046+0近 7 天星标变化 - #84
[ICLR 2024 Spotlight] SyncDreamer:从单一视角图像生成多视角一致的图像
★ 1,044-1近 7 天星标变化 - #85
论文官方实现:“FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models”
★ 1,013-1近 7 天星标变化 - #86★ 986+22近 7 天星标变化
- #87
[CVPR 2024] PIA,你的个性化图像动画生成器。通过文本提示词结合 Dreambooth 来让图片动起来,实现令人惊艳的视频效果。PIA,你的个性化图像动画生成器,利用文本提示将图像变为奇妙的动画。
★ 975+0近 7 天星标变化 - #88★ 970-1近 7 天星标变化
- #89★ 969+0近 7 天星标变化
- #90
[ICLR 2026] 用于长篇故事可视化的免训练迭代框架。
★ 959+0近 7 天星标变化