跳到主要內容
buildradar
Sign in
主題 · diffusion-models

diffusion-models

標記 diffusion-models 主題、收錄中的開源專案,依星數排序。

共 163 個專案
  • verl-omni@verl-project

    針對擴散與全能模型的多模態 RL 訓練框架

    955+60近 7 天星數變化
  • 基於擴散模型的影像處理總結,包含修復、增強、編碼與品質評估

    954-1近 7 天星數變化
  • Skyfall-GS@jayin92

    [ECCV 2026] Skyfall-GS:從衛星影像合成沉浸式 3D 都市場景

    953+4近 7 天星數變化
  • Causal-Forcing@thu-ml

    [ICML 2026]「Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation」與 Causal Forciiing++ 的官方程式碼庫

    948+10近 7 天星數變化
  • ODISE@NVlabs

    ODISE 的官方 PyTorch 實作:基於 Text-to-Image Diffusion Models 的開放詞彙全景分割 [CVPR 2023 Highlight]

    943+0近 7 天星數變化
  • 關於擴散模型的關鍵論文與部落格總結,以便學習該主題。包含所有已發布擴散機器人論文的詳細清單。

    920+1近 7 天星數變化
  • MindAct@candle-org

    MindSpore + 🤗Huggingface:在 MindSpore 上執行任何 Transformers/Diffusers 模型,具備無縫相容性與加速功能。

    920+0近 7 天星數變化
  • 展示多個使用 Diffusers 的即時擴散模型管線的應用程式

    916-1近 7 天星數變化
  • UniPic@SkyworkAI

    開源的 SOTA 多圖編輯模型

    874+1近 7 天星數變化
  • MiniGPT-5@UCSB-AI

    論文「MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens」的官方實作

    869+0近 7 天星數變化
  • OpenWorldLib@OpenDCAI

    先進世界模型的統一程式碼庫

    866+2近 7 天星數變化
  • Open-DiffusionGS@caiyuanhao1998

    將 Gaussian Splatting 烘焙至 Diffusion Denoiser 中,以實現快速且可擴展的單階段 Image-to-3D 生成與重建 (ICCV 2025)

    861+1近 7 天星數變化
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] 基於頻率分解的保持身份文字轉視訊生成

    856+1近 7 天星數變化
  • instruct-nerf2nerf@ayaanzhaque

    Instruct-NeRF2NeRF:透過指令編輯 3D 場景 (ICCV 2023)

    852-1近 7 天星數變化
  • 近期 AI 會議與期刊中關於類神經網路量化的論文清單。

    851+6近 7 天星數變化
  • DiffuSeq@Shark-NLP

    [ICLR'23] DiffuSeq:使用擴散模型的序列到序列文字生成

    838+0近 7 天星數變化
  • MeshDiffusion@lzzcd001

    「MeshDiffusion: Score-based Generative 3D Mesh Modeling」(ICLR 2023 Spotlight)的官方實作

    832+0近 7 天星數變化
  • GaussianDreamer@hustvl

    [CVPR 2024] GaussianDreamer:透過串接 2D 與 3D 擴散模型從文字快速生成 3D 高斯模型

    829-1近 7 天星數變化
  • 「RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers」(ICML 2025)、UltraViCo (ICLR 2026) 與 UltraImage 的官方實作

    827+2近 7 天星數變化
  • 受 awesome-computer-vision 啟發,精選大模型(即 LLM/VLM)時代下與機器人領域相關的 3D 視覺論文清單,包含論文、程式碼及相關網站

    820+1近 7 天星數變化
  • daclip-uir@Algolzw

    [ICLR 2024] 控制視覺語言模型以實現通用影像修復。榮獲 NTIRE 2024 野外通用影像修復挑戰賽(Restore Any Image Model in the Wild Challenge)第五名。

    817+1近 7 天星數變化
  • Paint3D@OpenTexture

    [CVPR 2024] Paint3D:使用無光照紋理擴散模型彩繪任何 3D 物件,這是一個無光照烘焙紋理生成模型

    808-1近 7 天星數變化
  • deepinv@deepinv

    DeepInverse:一個使用深度學習來解決影像反演問題的 PyTorch 圖書館

    802+5近 7 天星數變化
  • audio-diffusion@teticio

    使用新的 Hugging Face diffusers 套件應用 diffusion 模型來合成音樂而非圖像。

    795+1近 7 天星數變化
  • smalldiffusion@yuanchenyang

    用於訓練擴散模型並從中進行取樣的簡單且易讀的程式碼

    785+2近 7 天星數變化
  • 精選的影片生成研究集合。

    782+0近 7 天星數變化
  • LLM、MLLM 及其他領域的模型合併:方法、理論、應用與機會。ACM Computing Surveys, 2026。

    779+1近 7 天星數變化
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (又稱 MagicDance):具備身分識別感知的 Diffusion 實現真實人類姿態與面部表情重定向

    776+0近 7 天星數變化
  • dift@Tsingularity

    [NeurIPS'23] 來自 Image Diffusion 的突現對應

    775+0近 7 天星數變化
  • Attend-and-Excite@yuval-alaluf

    「Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models」的官方實作 (SIGGRAPH 2023)

    770+0近 7 天星數變化
← 返回主題列表