跳到主要內容
buildradar
Sign in
主題 · diffusion-models

diffusion-models

標記 diffusion-models 主題、收錄中的開源專案,依星數排序。

共 163 個專案
  • MOFA-Video@MyNiuuu

    [ECCV 2024] MOFA-Video:透過凍結的 Image-to-Video 擴散模型中的生成式運動場域適應(Motion Field Adaptations)來實現可控圖像動畫。

    766+0近 7 天星數變化
  • 精選的文字轉圖片生成研究集合。

    765+0近 7 天星數變化
  • PMRF@ohayonguy

    [ICLR 2025] Posterior-Mean Rectified Flow 官方實作:邁向最小 MSE 的寫實影像修復

    754+0近 7 天星數變化
  • MagicDrive-V2@flymin

    [ICCV 2025] 論文「MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control」的官方實作。

    729+1近 7 天星數變化
  • distrifuser@mit-han-lab

    [CVPR 2024 Highlight] DistriFusion:高解析度擴散模型的分散式平行推論

    728+1近 7 天星數變化
  • nano-world-model@simchowitzlabpublic

    一個極簡、功能齊全的儲存庫,用於推進世界模型科學。

    725+4近 7 天星數變化
  • DL4Proteins-notebooks@Graylab

    涵蓋生物分子結構預測與設計之深度學習工具的 Colab 筆記本

    724+2近 7 天星數變化
  • 使用均值迴歸隨機微分方程式進行影像修復,ICML 2023。NTIRE 2023 影像去陰影競賽奪冠方案。

    722+0近 7 天星數變化
  • mdlm@kuleshov-group

    [NeurIPS 2024] 簡單且有效的遮罩擴散語言模型

    711+1近 7 天星數變化
  • [ICML 2025] 「History-Guided Video Diffusion」的官方 PyTorch 實作

    709+1近 7 天星數變化
  • AR Diffusion 影片世界模型精選列表:涵蓋演算法、應用與基礎設施,旨在為研究人員、從業者與愛好者提供全面資源。

    701+4近 7 天星數變化
  • CRM@thu-ml

    [ECCV 2024] 使用卷積重建模型,在 10 秒內將單張影像轉換為 3D 紋理網格。

    696+1近 7 天星數變化
  • Flow-Factory@X-GenGroup

    用於在 Flow-Matching 模型中輕鬆進行強化學習的統一框架

    690+6近 7 天星數變化
  • CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC 論文與程式碼集合

    677+0近 7 天星數變化
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1:用於高解析度 (2K) 文字轉圖像生成的高效擴散模型

    675+0近 7 天星數變化
  • Make-An-Audio@Text-to-Audio

    Make-An-Audio (ICML'23) 文字轉語音生成模型的 PyTorch 實作

    668+0近 7 天星數變化
  • OneDiffusion@lehduong

    OneDiffusion 論文 (CVPR 2025) 的官方實作

    665+0近 7 天星數變化
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter:為無聲影片賦予生動且同步的音效。AI 擬音大師,給你的無聲影片添加生動而且同步的音效 😝

    663+0近 7 天星數變化
  • flash-diffusion@gojasper

    Flash Diffusion — 加速條件式擴散模型(AAAI 2025 Oral)

    663+1近 7 天星數變化
  • NOVA@baaivision

    [ICLR 2025] 無向量量化的自迴歸視訊生成

    660-1近 7 天星數變化
  • DFloat11@LeanModels

    DFloat11 [NeurIPS '25]:LLMs 與 DiTs 的無損壓縮,實現高效的 GPU 推論

    654+0近 7 天星數變化
  • Open-dLLM@pengzhangzhi

    用於程式碼產生的開放擴散語言模型 — 發布預訓練、評估、推論與檢查點。

    652+1近 7 天星數變化
  • blended-latent-diffusion@omriav

    「Blended Latent Diffusion」[SIGGRAPH 2023] 的官方實作

    632+0近 7 天星數變化
  • OpenMusic@ivcylc

    OpenMusic:SOTA 文字轉音樂(TTM)生成

    631+1近 7 天星數變化
  • Ditto@EzioBy

    [CVPR'26 Highlight] Ditto:利用高品質合成資料集擴展基於指令的影片編輯

    626+3近 7 天星數變化
  • radial-attention@mit-han-lab

    [NeurIPS 2025] 徑向注意力:用於長影片生成、具能量衰減機制的 O(nlogn) 稀疏注意力機制

    607-1近 7 天星數變化
  • BrushEdit@TencentARC

    [TPAMI] 論文「BrushEdit: All-In-One Image Inpainting and Editing」的官方實作

    590+0近 7 天星數變化
  • semantic-draw@ironjr

    CVPR 2025 論文「SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models」官方程式碼。

    588-1近 7 天星數變化
  • VEnhancer@Vchitect

    VEnhancer 官方程式碼:用於影片生成的生成式時空增強技術。

    579+0近 7 天星數變化
  • EDGE@Stanford-TML

    EDGE (CVPR 2023) 的官方 PyTorch 實作

    577+2近 7 天星數變化
← 返回主題列表