diffusion-models
標記 diffusion-models 主題、收錄中的開源專案,依星數排序。
- #61
可擴展且記憶體最佳化的擴散模型訓練
★ 1,359+1近 7 天星數變化 - #62
[ICASSP 2024] 🍵 Matcha-TTS:具備條件式流匹配(Conditional Flow Matching)的高效 TTS 架構
★ 1,353+4近 7 天星數變化 - #63★ 1,351+2近 7 天星數變化
- #64
FireRed-Image-Edit 是一個強大的影像編輯基礎模型,達到開源的 SOTA 效能,具備精確的指令遵循、高傳真生成、優異的身份一致性以及無縫的多元素融合。
★ 1,350+6近 7 天星數變化 - #65
[AAAI 2025]👔IMAGDressing👔:虛擬穿搭的互動式模組化服飾生成。它支援具有靈活服飾、姿勢和場景控制的可自訂人像生成,確保虛擬穿搭的高傳真度與服飾一致性。
★ 1,343+0近 7 天星數變化 - #66★ 1,337-1近 7 天星數變化
- #67
📦 在 Windows 上執行 Hunyuan3D 2.0/2.1 的免安裝可攜包。
★ 1,326+5近 7 天星數變化 - #68★ 1,274+2近 7 天星數變化
- #69★ 1,267+0近 7 天星數變化
- #70
[CVPR2024, Highlight] DragDiffusion 的官方程式碼
★ 1,259+0近 7 天星數變化 - #71★ 1,238-1近 7 天星數變化
- #72
基於 Flow Matching 且支援 Emoji 驅動風格控制的文字轉語音模型
★ 1,228+8近 7 天星數變化 - #73
HunyuanCustom:用於自訂影片生成的多模態驅動架構
★ 1,228+1近 7 天星數變化 - #74★ 1,196+0近 7 天星數變化
- #75
Wunjo CE:臉部交換、對嘴、控制移除物件與文字及背景、風格重塑、音訊分離、語音複製、影片生成。開源、本機執行且免費。
★ 1,170+1近 7 天星數變化 - #76
[ICLR24] 論文「MagicDrive: Street View Generation with Diverse 3D Geometry Control」的官方實作
★ 1,167+1近 7 天星數變化 - #77
文字轉圖片 diffusion models 可控生成資源收集。
★ 1,110+0近 7 天星數變化 - #78★ 1,108+4近 7 天星數變化
- #79
在 PyTorch 中從頭實現的 Stable Diffusion
★ 1,078-1近 7 天星數變化 - #80★ 1,061+0近 7 天星數變化
- #81
[ECCV 2024 Oral] MotionDirector:文字轉影片擴散模型的動作客製化。
★ 1,053+3近 7 天星數變化 - #82
[ICLR 2025 Oral]「具備彈性指引的自主駕駛擴散式規劃」官方實作。
★ 1,050+5近 7 天星數變化 - #83
[CVPR 2025 Highlight] 3DTopia-XL:透過 Primitive Diffusion 進行高品質 3D PBR 資產生成
★ 1,046+1近 7 天星數變化 - #84
[ICLR 2024 Spotlight] SyncDreamer:從單一視角影像生成多視角一致的影像
★ 1,044+0近 7 天星數變化 - #85
論文官方實作:「FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models」
★ 1,013-1近 7 天星數變化 - #86★ 986+24近 7 天星數變化
- #87
[CVPR 2024] PIA,你的個人化影像動畫生成器。透過文字提示詞結合 Dreambooth 來讓圖片動起來,實現令人驚豔的影片效果。PIA,你的個性化圖像動畫生成器,利用文本提示將圖像變為奇妙的動畫。
★ 975+0近 7 天星數變化 - #88★ 970+0近 7 天星數變化
- #89★ 969+0近 7 天星數變化
- #90
[ICLR 2026] 用於長篇故事視覺化的免訓練迭代框架。
★ 959+1近 7 天星數變化