跳到主要內容
buildradar
Sign in
主題 · diffusion

diffusion

標記 diffusion 主題、收錄中的開源專案,依星數排序。

共 76 個專案
  • Helios@PKU-YuanGroup

    Helios:真正的即時長影片生成模型

    2,129+18近 7 天星數變化
  • 醫學影像中的擴散模型(發表於 Medical Image Analysis 期刊)

    2,110+2近 7 天星數變化
  • ICEdit@River-Zhang

    [NeurIPS 2025] 影像編輯只需要一個 LoRA!用 0.1% 的訓練資料就能進行神奇的影像編輯!在 ID 保持能力上超越 GPT-4o~MoE 檢查點已釋出!只需 4GB VRAM 即可執行!

    2,104+1近 7 天星數變化
  • LlamaGen@FoundationVision

    自迴歸模型打敗 Diffusion:用於可擴展影像生成的 🦙 Llama

    1,966+0近 7 天星數變化
  • BrushNet@TencentARC

    [ECCV 2024] 論文「BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion」官方實作

    1,744-1近 7 天星數變化
  • REPA@sihyun-yu

    [ICLR'25 Oral] 世代的表徵對齊:訓練 Diffusion Transformers 比想像中更容易

    1,706+2近 7 天星數變化
  • fantasy-talking@Fantasy-AMAP

    [ACM MM 2025] FantasyTalking:透過一致性動作合成生成逼真的對話肖像

    1,628+0近 7 天星數變化
  • AngelSlim@Tencent

    為提升易用性、完整性與效率而設計的模型壓縮工具包。

    1,619+58近 7 天星數變化
  • Pallaidium@tin2tin

    PALLAIDIUM — 整合至 Blender Video Editor (VSE) 的生成式 AI 電影工作室,支援從劇本到畫面及後製的端到端製作。

    1,523+0近 7 天星數變化
  • UNO@bytedance

    [ICCV 2025] 🔥🔥 UNO:支援單一與多主體條件設定的通用客製化方法

    1,362+0近 7 天星數變化
  • finetrainers@huggingface

    可擴展且記憶體最佳化的擴散模型訓練

    1,359+0近 7 天星數變化
  • Inpaint Anything 擴充功能使用 Segment Anything 的遮罩,在瀏覽器介面中執行 stable diffusion 內填。

    1,298+0近 7 天星數變化
  • tango@declare-lab

    用於文字轉語音生成的擴散模型系列。

    1,238-1近 7 天星數變化
  • MixGRPO@Tencent-Hunyuan

    [ECCV 2026] MixGRPO:透過混合 ODE-SDE 解鎖基於 Flow 的 GRPO 效率

    1,177+0近 7 天星數變化
  • mlx-serve@ddalcu

    適用於 Apple Silicon 的原生 LLM 推論伺服器。相容 OpenAI + Anthropic API。無須 Python。包含具備聊天、agent 模式與工具呼叫功能的 MLX Core macOS 應用程式。

    1,115+245近 7 天星數變化
  • dial-mpc@LeCAR-Lab

    論文「Full-Order Sampling-Based MPC for Torque-Level Locomotion Control via Diffusion-Style Annealing」的官方實作。DIAL-MPC 是一個新穎的基於採樣的 MPC 框架,用於四足機器人全階扭矩級控制,兼具精確性與敏捷性且無需訓練。

    997+1近 7 天星數變化
  • 使用生成式 AI 與深度學習進行分子與材料設計的列表。

    952+1近 7 天星數變化
  • Causal-Forcing@thu-ml

    [ICML 2026]「Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation」與 Causal Forciiing++ 的官方程式碼庫

    950+12近 7 天星數變化
  • FireRedTTS@FireRedTeam

    一個由 LLM 驅動的開源基礎 TTS 系統

    920+1近 7 天星數變化
  • UniWorld@PKU-YuanGroup

    UniWorld:用於統一視覺理解與生成的高解析度語意編碼器

    890+0近 7 天星數變化
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] 基於頻率分解的保持身份文字轉視訊生成

    857+2近 7 天星數變化
  • LION@nv-tlabs

    用於 3D 形狀生成的潛在點擴散模型

    835+0近 7 天星數變化
  • 「RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers」(ICML 2025)、UltraViCo (ICLR 2026) 與 UltraImage 的官方實作

    827+2近 7 天星數變化
  • Adan@sail-sg

    Adan:用於加速優化深度模型的自適應 Nesterov 動量演算法

    822+0近 7 天星數變化
  • kandinsky-5@kandinskylab

    Kandinsky 5.0:用於影片與圖片生成的擴散模型系列

    820+4近 7 天星數變化
  • [TMLR 2025🔥] 視覺自迴歸模型總覽。

    808+1近 7 天星數變化
  • daam@castorini

    用於解釋 Stable Diffusion 的擴散注意力歸因圖。

    802+0近 7 天星數變化
  • rcm@NVlabs

    rCM 與 Causal-rCM:大規模雙向/自迴歸影片擴散蒸餾的領先與統一演算法/基礎設施

    800+6近 7 天星數變化
  • smalldiffusion@yuanchenyang

    用於訓練擴散模型並從中進行取樣的簡單且易讀的程式碼

    785+2近 7 天星數變化
  • FRESCO@williamyang1991

    [CVPR 2024] FRESCO:用於零樣本影片翻譯的時空對應

    782-1近 7 天星數變化
← 返回主題列表