跳到主要內容
buildradar
Sign in
主題 · diffusion-models

diffusion-models

標記 diffusion-models 主題、收錄中的開源專案,依星數排序。

共 163 個專案
  • finetrainers@huggingface

    可擴展且記憶體最佳化的擴散模型訓練

    1,359+1近 7 天星數變化
  • Matcha-TTS@shivammehta25

    [ICASSP 2024] 🍵 Matcha-TTS:具備條件式流匹配(Conditional Flow Matching)的高效 TTS 架構

    1,353+4近 7 天星數變化
  • DDNM@wyhuai

    [ICLR 2023 Oral] 使用去噪擴散零空間模型的零樣本影像修復

    1,351+2近 7 天星數變化
  • FireRed-Image-Edit@FireRedTeam

    FireRed-Image-Edit 是一個強大的影像編輯基礎模型,達到開源的 SOTA 效能,具備精確的指令遵循、高傳真生成、優異的身份一致性以及無縫的多元素融合。

    1,350+6近 7 天星數變化
  • IMAGDressing@muzishen

    [AAAI 2025]👔IMAGDressing👔:虛擬穿搭的互動式模組化服飾生成。它支援具有靈活服飾、姿勢和場景控制的可自訂人像生成,確保虛擬穿搭的高傳真度與服飾一致性。

    1,343+0近 7 天星數變化
  • MagicTime@PKU-YuanGroup

    [TPAMI 2025🔥] MagicTime:作為變形模擬器的縮時影片生成模型

    1,337-1近 7 天星數變化
  • Hunyuan3D-2-WinPortable@YanWenKun

    📦 在 Windows 上執行 Hunyuan3D 2.0/2.1 的免安裝可攜包。

    1,326+5近 7 天星數變化
  • pruna@PrunaAI

    Pruna 是一個為開發者打造的模型優化框架,讓你能以極低的額外開銷交付更快、更高效的模型。

    1,274+2近 7 天星數變化
  • Difix3D@nv-tlabs

    [CVPR 2025 Oral & Best Paper Finalist] Difix3D+: 利用單步 Diffusion Models 改善 3D 重建

    1,267+0近 7 天星數變化
  • DragDiffusion@Yujun-Shi

    [CVPR2024, Highlight] DragDiffusion 的官方程式碼

    1,259+0近 7 天星數變化
  • tango@declare-lab

    用於文字轉語音生成的擴散模型系列。

    1,238-1近 7 天星數變化
  • Irodori-TTS@Aratako

    基於 Flow Matching 且支援 Emoji 驅動風格控制的文字轉語音模型

    1,228+8近 7 天星數變化
  • HunyuanCustom@Tencent-Hunyuan

    HunyuanCustom:用於自訂影片生成的多模態驅動架構

    1,228+1近 7 天星數變化
  • MeanFlow@haidog-yaqub

    MeanFlow 與 iMF(單步生成式建模)的 PyTorch 實作。

    1,196+0近 7 天星數變化
  • wunjo.wladradchenko.ru@wladradchenko

    Wunjo CE:臉部交換、對嘴、控制移除物件與文字及背景、風格重塑、音訊分離、語音複製、影片生成。開源、本機執行且免費。

    1,170+1近 7 天星數變化
  • MagicDrive@cure-lab

    [ICLR24] 論文「MagicDrive: Street View Generation with Diverse 3D Geometry Control」的官方實作

    1,167+1近 7 天星數變化
  • 文字轉圖片 diffusion models 可控生成資源收集。

    1,110+0近 7 天星數變化
  • MOVA@OpenMOSS

    MOVA:邁向可擴充且同步的視訊-音訊生成

    1,108+4近 7 天星數變化
  • pytorch-stable-diffusion@hkproj

    在 PyTorch 中從頭實現的 Stable Diffusion

    1,078-1近 7 天星數變化
  • VisCPM@OpenBMB

    [ICLR'24 spotlight] 中英雙語多模態大模型系列(對話與繪圖)| 基於 CPM 基礎模型的中英雙語多模態大模型系列

    1,061+0近 7 天星數變化
  • MotionDirector@showlab

    [ECCV 2024 Oral] MotionDirector:文字轉影片擴散模型的動作客製化。

    1,053+3近 7 天星數變化
  • Diffusion-Planner@ZhengYinan-AIR

    [ICLR 2025 Oral]「具備彈性指引的自主駕駛擴散式規劃」官方實作。

    1,050+5近 7 天星數變化
  • 3DTopia-XL@3DTopia

    [CVPR 2025 Highlight] 3DTopia-XL:透過 Primitive Diffusion 進行高品質 3D PBR 資產生成

    1,046+1近 7 天星數變化
  • SyncDreamer@liuyuan-pal

    [ICLR 2024 Spotlight] SyncDreamer:從單一視角影像生成多視角一致的影像

    1,044+0近 7 天星數變化
  • FlowEdit@fallenshock

    論文官方實作:「FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models」

    1,013-1近 7 天星數變化
  • FastGen@NVlabs

    NVIDIA FastGen:來自 Diffusion 模型的快速生成

    986+24近 7 天星數變化
  • PIA@open-mmlab

    [CVPR 2024] PIA,你的個人化影像動畫生成器。透過文字提示詞結合 Dreambooth 來讓圖片動起來,實現令人驚豔的影片效果。PIA,你的個性化圖像動畫生成器,利用文本提示將圖像變為奇妙的動畫。

    975+0近 7 天星數變化
  • DeepCache@horseee

    [CVPR 2024] DeepCache:免費加速 Diffusion Models。

    970+0近 7 天星數變化
  • diffae@konpatp

    Diffusion Autoencoders 的官方實現

    969+0近 7 天星數變化
  • story-iter@UCSC-VLAA

    [ICLR 2026] 用於長篇故事視覺化的免訓練迭代框架。

    959+1近 7 天星數變化
← 返回主題列表