跳到主要内容
buildradar
登录
主题 · image-generation

image-generation

标记 image-generation 主题、收录中的开源项目,按星标数排序。

共 135 个项目
  • 一个简单的独立查看器,用于在 webui 之外读取 Stable Diffusion 生成图片中的 prompt

    1,340+0近 7 天星标变化
  • Lance@bytedance

    具备 3B 活跃参数的原生统一多模态模型,支持图像与视频的理解、生成及编辑。

    1,334+0近 7 天星标变化
  • WebAI2API@foxhui

    WebAI2API:基于 Camoufox 的网页 AI 转 API 工具,支持 LMArena/Gemini 等,具备多窗口并发与账号隔离功能。

    1,315+0近 7 天星标变化
  • airunner@Capsize-Games

    用于艺术、实时语音对话、LLM 驱动的聊天机器人与自动化工作流程的离线推理引擎

    1,314+0近 7 天星标变化
  • data-efficient-gans@mit-han-lab

    [NeurIPS 2020] 用于提升数据效率的 GAN 训练之可微分数据增强技术

    1,308+0近 7 天星标变化
  • Bernini@bytedance

    Bernini 是一个用于视频生成与编辑的统一框架,结合了基于 MLLM 的语义规划器与基于 DiT 的渲染器。

    1,300+0近 7 天星标变化
  • Inpaint Anything 扩展使用 Segment Anything 的遮罩,在浏览器 UI 中执行 stable diffusion 图像修复。

    1,298+0近 7 天星标变化
  • MV-Adapter@huanngzh

    [ICCV 2025]“MV-Adapter: Multi-view Consistent Image Generation Made Easy”官方实现

    1,289+0近 7 天星标变化
  • 通过使用 webkit 转换 html,在 Symfony 中轻松创建 PDF 和图片

    1,247+0近 7 天星标变化
  • 从终端使用 OpenAI 的 ChatGPT 与 DALL-E 的简单 shell 脚本。不需要 Python 或 JS。

    1,241+0近 7 天星标变化
  • 图像到图像转换(image-to-image translation)精选资源列表。

    1,239+0近 7 天星标变化
  • cleanvision@cleanlab

    自动寻找图片数据集中的问题,并实践以数据为中心的计算机视觉。

    1,199+0近 7 天星标变化
  • clean-fid@GaParmar

    PyTorch - 具备适当图像缩放与量化步骤的 FID 计算 [CVPR 2022]

    1,167+0近 7 天星标变化
  • MagicDrive@cure-lab

    [ICLR24] 论文“MagicDrive: Street View Generation with Diverse 3D Geometry Control”的官方实现

    1,167+0近 7 天星标变化
  • VITON-HD@shadow2496

    「VITON-HD: High-Resolution Virtual Try-On via Misalignment-Aware Normalization」官方 PyTorch 实现(CVPR 2021)

    1,161+0近 7 天星标变化
  • 归藏的材质插画 skill:生成带字解释图、图表美化和参考辅助配图。

    1,120+23近 7 天星标变化
  • Uncensored-Local-Studio@techjarves

    适用于 Windows、Linux 与 macOS 的无审查本地 AI 工作室。零设置图形界面,支持图像生成、GGUF LLM、文本转语音与语音转文本

    1,118+13近 7 天星标变化
  • mlx-serve@ddalcu

    适用于 Apple Silicon 的原生 LLM 推理服务器。兼容 OpenAI + Anthropic API。无 Python。包含带聊天、agent 模式和工具调用功能的 MLX Core macOS 应用。

    1,115+39近 7 天星标变化
  • image-extender@boona13

    利用 AI 向任意方向无缝扩展图像。开源 Web 应用,通过 OpenRouter 由 Gemini 驱动,具备 Poisson 融合接缝与三选一变体选择器。

    1,103+3近 7 天星标变化
  • CogView4@zai-org

    CogView4、CogView3-Plus 与 CogView3 (ECCV 2024)

    1,101+0近 7 天星标变化
  • awesome-agent-apis@Anil-matcha

    OpenClaw 资源、工具、技能、教程与文章的精选列表。OpenClaw(前称 Moltbot / Clawdbot)— 适用于 WhatsApp、Telegram、Discord 及 50 多种集成的开源自托管 AI agent。

    1,005+8近 7 天星标变化
  • 🎬 通过 3D 交互控制从任何摄像机视角生成图像。在 3D 空间中拖拽摄像机或使用滑块设置方位角/仰角/距离后进行生成。基于 Three.js + Gradio 构建,支持中英双语界面。

    982+161近 7 天星标变化
  • :fire: :fire: :fire: 近期计算机视觉 (CV) 相关论文列表

    973+1近 7 天星标变化
  • story-iter@UCSC-VLAA

    [ICLR 2026] 用于长篇故事可视化的免训练迭代框架。

    957-3近 7 天星标变化
  • HR-VITON@sangyun884

    论文 High-Resolution Virtual Try-On with Misalignment and Occlusion-Handled Conditions (ECCV 2022) 之官方 PyTorch 实现。

    917+0近 7 天星标变化
  • AMC-WebUI@yeahhe365

    面向 Gemini 的 Local-First AI 工作流 WebUI,集成多模态聊天、Canvas、文件处理、实时搜索、代码执行与高级推理。

    899+4近 7 天星标变化
  • AnyGPT@OpenMOSS

    “AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling”的代码

    881-1近 7 天星标变化
  • codex-slides@nexu-io

    🎨 Codex 内建的开源 AI 演示工作室:原生影像演示,每一张投影片都是完整的视觉画布。⚡ 约 4-5 分钟即可产出 10 张以上高质量投影片 — 快速模式可平行渲染每一页。🔍 即时观看完整流程:研究 → 大纲 → 风格 → 渲染 → 编辑 → 演示 → 导出 PDF/PPTX。🖥️ 以浏览器为优先 · 无需 API 金钥 · 项目持久保存。

    881+22近 7 天星标变化
  • UniPic@SkyworkAI

    开源的 SOTA 多图编辑模型

    875+1近 7 天星标变化
  • flatkey-cli@flatkey-ai

    用于图像、视频、音频、文字、制作名单与模型探索的 Flatkey 媒体生成 CLI

    873+144近 7 天星标变化
← 返回主题列表