跳到主要內容
buildradar
登入
主題 · image-generation

image-generation

標記 image-generation 主題、收錄中的開源專案,依星數排序。

共 135 個專案
  • [TMLR 2025🔥] 視覺自迴歸模型總覽。

    808+0近 7 天星數變化
  • open-webui-tools@Haervwe

    Open‑WebUI Tools 是一個模組化工具包,旨在擴充並豐富您的 Open WebUI 實例,將其轉化為強大的 AI 工作站。專案內含超過 15 種專門工具、函式管線與過濾器,支援學術研究、代理自主性、多模態創造力、工作流程等功能。

    808+5近 7 天星數變化
  • ima2-gen@lidge-jun

    針對人類與 coding agents 的 Local-first 視覺化生成執行環境與工作室,在多個供應商之間提供可重現的圖片與影片工作流程。

    756+21近 7 天星數變化
  • 一個原始碼可取得的 Codex 技能,用於將照片提煉成稀疏的編輯抽象。

    748+25近 7 天星數變化
  • 文字轉影片生成/合成技術綜述。

    744+3近 7 天星數變化
  • 1,400+ 個來自 X 的精選熱門 AI 圖像提示詞,依參與度排序。適用於 NanoBanana、GPT Image 2、Midjourney

    732+2近 7 天星數變化
  • comfyui-mcp@artokun

    本地優先、Agent 原生的 ComfyUI 控制平面——內含 MCP 伺服器與側邊欄 Agent,可使用任何 LLM(Claude、ChatGPT、Gemini、離線 Ollama 或任何託管模型)以自然語言生成圖片、影片與音訊,編寫並執行工作流程,以及編輯即時圖表。具備 178 種工具、36 種 AI 技能、55 種安裝套件。支援本機、區域網路、VPS 或 Comfy Cloud。

    732+21近 7 天星數變化
  • focal-frequency-loss@EndlessSora

    [ICCV 2021] 用於影像重建與合成的焦點頻率損失函數

    714+0近 7 天星數變化
  • ISP-Guide@mikeroyal

    影像訊號處理 (ISP) 指南。透過專用類型的媒體處理器,執行降噪、濾波、自動曝光、自動對焦、HDR 矯正與影像銳化等任務,深入了解將圖片/影片轉換為數位形式的過程。

    706+4近 7 天星數變化
  • ChronoEdit@nv-tlabs

    [ICLR 2026] ChronoEdit:邁向影像編輯與世界模擬的時間推理

    706+2近 7 天星數變化
  • OMG@kongzhecn

    [ECCV 2024] OMG:擴散模型中對遮擋友善的個人化多概念生成

    702+1近 7 天星數變化
  • ilab-conjure@kadevin

    面向 GPT-image-2 的 AI 圖片生成 WebUI 工作台,支援 Codex Responses 與 OpenAI 相容 API 接入,內建公用圖庫、多類型 Chip 快捷引用、提示詞範本、多任務併發和本地佇列管理。

    698+9近 7 天星數變化
  • Flow-Factory@X-GenGroup

    用於在 Flow-Matching 模型中輕鬆進行強化學習的統一框架

    693+5近 7 天星數變化
  • CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC 論文與程式碼集合

    677+0近 7 天星數變化
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1:用於高解析度 (2K) 文字轉圖像生成的高效擴散模型

    674-1近 7 天星數變化
  • NOVA@baaivision

    [ICLR 2025] 無向量量化的自迴歸視訊生成

    660+0近 7 天星數變化
  • CVPR2023/2022 中關於低階視覺(low level vision)的論文與程式碼集合

    660+0近 7 天星數變化
  • 此儲存庫包含多個離線 AI 模型(例如 StableDiffusion 1.5 與 XL、ControlNet、Midas、HED 和 OpenPose)的純 C++ ONNX 實作。

    633+0近 7 天星數變化
  • blended-latent-diffusion@omriav

    「Blended Latent Diffusion」[SIGGRAPH 2023] 的官方實作

    632+0近 7 天星數變化
  • 角色選擇獨立應用程式,支援 AI 提示詞及 ComfyUI/WebUI API,適用於 waiIllustriousSDXL、waiANIMA 等模型

    614+2近 7 天星數變化
  • GameFactory-3A@OpenDCAI

    A comprehensive open-source 3A game-generation skill and asset framework.

    607近 7 天星數變化
  • 另一個 PyTorch 版的 Stable Diffusion 實作(可能較易於閱讀)。

    594+0近 7 天星數變化
  • 精選的可重複使用 JSON AI 繪圖提示詞模板與風格參考,每日更新。

    592+6近 7 天星數變化
  • semantic-draw@ironjr

    CVPR 2025 論文「SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models」官方程式碼。

    588+0近 7 天星數變化
  • 📚 GPT4o 提示詞字典 | 精選 AI 圖像生成提示詞集

    584-2近 7 天星數變化
  • Vibe-Workflow@SamurAIGPT

    Weavy AI、Krea Nodes、Freepik Spaces 與 FloraFauna AI 的免費開源替代方案 — 用於生成式影像與影片管線的節點式 AI 工作流建構器。

    577+6近 7 天星數變化
  • One-DM@dailenson

    ECCV 2024 論文官方程式碼 — 用於手寫文字生成的 One-Shot Diffusion Mimicker。

    562+0近 7 天星數變化
  • FontDiffuser@yeungchenwa

    [AAAI2024] FontDiffuser:透過多尺度內容聚合與風格對比學習的去噪擴散模型,實現一次性字體生成

    561+3近 7 天星數變化
  • genblaze@backblaze-labs

    Genblaze 是一個開源 Python SDK,用於編排跨影片、音訊與影像供應商的生成式 AI 媒體管線,並為每個輸出提供內建的來源追蹤。

    559+2近 7 天星數變化
  • photo-revival@dacnay816y62-hub

    Codex skill for turning everyday photos into poetic white-paper hand-drawn illustrations.

    558+23近 7 天星數變化
← 返回主題列表