跳到主要内容
buildradar
登录
主题 · image-generation

image-generation

标记 image-generation 主题、收录中的开源项目,按星标数排序。

共 136 个项目
  • UniPic@SkyworkAI

    开源的 SOTA 多图编辑模型

    875+1近 7 天星标变化
  • open-webui-tools@Haervwe

    Open‑WebUI Tools 是一个模块化工具包,旨在扩充并丰富您的 Open WebUI 实例,将其转化为强大的 AI 工作站。项目内含超过 15 种专门工具、函数管线与过滤器,支持学术研究、代理自主性、多模态创造力、工作流程等功能。

    808+5近 7 天星标变化
  • [TMLR 2025🔥] 视觉自回归模型综述。

    808+0近 7 天星标变化
  • ima2-gen@lidge-jun

    针对人类与 coding agents 的 Local-first 可视化生成运行时与工作室,在多个供应商之间提供可重现的图片与视频工作流程。

    759+21近 7 天星标变化
  • 一个源码可获取的 Codex 技能,用于将照片提炼成稀疏的编辑抽象。

    753+25近 7 天星标变化
  • 文本转视频生成/合成技术综述。

    744+3近 7 天星标变化
  • comfyui-mcp@artokun

    本地优先、Agent 原生的 ComfyUI 控制平面——内含 MCP 服务器与侧边栏 Agent,可使用任何 LLM(Claude、ChatGPT、Gemini、离线 Ollama 或任何托管模型)以自然语言生成图片、视频与音频,编写并执行工作流程,以及编辑实时图表。具备 178 种工具、36 种 AI 技能、55 种安装套件。支持本地、局域网、VPS 或 Comfy Cloud。

    739+21近 7 天星标变化
  • 1,400+ 个来自 X 的精选热门 AI 图像提示词,依参与度排序。适用于 NanoBanana、GPT Image 2、Midjourney

    733+2近 7 天星标变化
  • focal-frequency-loss@EndlessSora

    [ICCV 2021] 用于图像重建与合成的焦点频率损失函数

    714+0近 7 天星标变化
  • ChronoEdit@nv-tlabs

    [ICLR 2026] ChronoEdit:迈向图像编辑与世界模拟的时间推理

    706+2近 7 天星标变化
  • ISP-Guide@mikeroyal

    图像信号处理 (ISP) 指南。通过专用类型的媒体处理器,执行降噪、滤波、自动曝光、自动对焦、HDR 矫正与图像锐化等任务,深入了解将图片/视频转换为数字形式的过程。

    706+5近 7 天星标变化
  • OMG@kongzhecn

    [ECCV 2024] OMG:扩散模型中对遮挡友好的个性化多概念生成

    702+1近 7 天星标变化
  • ilab-conjure@kadevin

    面向 GPT-image-2 的 AI 图片生成 WebUI 工作台,支持 Codex Responses 与 OpenAI 兼容 API 接入,内置公用图库、多类型 Chip 快捷引用、提示词模板、多任务并发和本地队列管理。

    698+12近 7 天星标变化
  • Flow-Factory@X-GenGroup

    用于在 Flow-Matching 模型中轻松进行强化学习的统一框架

    695+6近 7 天星标变化
  • CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC 论文与代码集合

    677+0近 7 天星标变化
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1:用于高分辨率 (2K) 文字转图像生成的高效扩散模型

    674-1近 7 天星标变化
  • CVPR2023/2022 中关于低阶视觉(low level vision)的论文与代码集合

    660+0近 7 天星标变化
  • NOVA@baaivision

    [ICLR 2025] 无向量量化的自回归视频生成

    660+0近 7 天星标变化
  • 此仓库包含多个离线 AI 模型(例如 StableDiffusion 1.5 与 XL、ControlNet、Midas、HED 和 OpenPose)的纯 C++ ONNX 实现。

    633+0近 7 天星标变化
  • blended-latent-diffusion@omriav

    「Blended Latent Diffusion」[SIGGRAPH 2023] 的官方实现

    632+0近 7 天星标变化
  • GameFactory-3A@OpenDCAI

    A comprehensive open-source 3A game-generation skill and asset framework.

    628近 7 天星标变化
  • 角色选择独立应用程序,支持 AI 提示词及 ComfyUI/WebUI API,适用于 waiIllustriousSDXL、waiANIMA 等模型

    615+4近 7 天星标变化
  • 另一个 PyTorch 版的 Stable Diffusion 实现(可能较易于阅读)。

    594+0近 7 天星标变化
  • 精选的可重复使用 JSON AI 绘图提示词模板与风格参考,每日更新。

    593+5近 7 天星标变化
  • semantic-draw@ironjr

    CVPR 2025 论文“SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models”官方代码。

    589+0近 7 天星标变化
  • 📚 GPT4o 提示词字典 | 精选 AI 图像生成提示词集

    584-2近 7 天星标变化
  • Vibe-Workflow@SamurAIGPT

    Weavy AI、Krea Nodes、Freepik Spaces 与 FloraFauna AI 的免费开源替代方案 — 用于生成式图像与视频管线的节点式 AI 工作流构建器。

    578+7近 7 天星标变化
  • One-DM@dailenson

    ECCV 2024 论文官方代码 — 用于手写文字生成的 One-Shot Diffusion Mimicker。

    562+0近 7 天星标变化
  • FontDiffuser@yeungchenwa

    [AAAI2024] FontDiffuser:通过多尺度内容聚合与风格对比学习的去噪扩散模型,实现一次性字体生成

    562+4近 7 天星标变化
  • genblaze@backblaze-labs

    Genblaze 是一个开源 Python SDK,用于编排跨视频、音频与图像供应商的生成式 AI 媒体流水线,并为每个输出提供内置的来源追踪。

    559+2近 7 天星标变化
← 返回主题列表