跳到主要內容
buildradar
登入
主題 · image-generation

image-generation

標記 image-generation 主題、收錄中的開源專案,依星數排序。

共 135 個專案
  • 一個簡單的獨立檢視器,用於在 webui 之外讀取 Stable Diffusion 生成圖片中的 prompt

    1,340+0近 7 天星數變化
  • Lance@bytedance

    具備 3B 活躍參數的原生統一多模態模型,支援影像與影片的理解、生成及編輯。

    1,334+0近 7 天星數變化
  • WebAI2API@foxhui

    WebAI2API:基於 Camoufox 的網頁 AI 轉 API 工具,支援 LMArena/Gemini 等,具備多視窗併發與帳號隔離功能。

    1,315+0近 7 天星數變化
  • airunner@Capsize-Games

    用於藝術、即時語音對話、LLM 驅動的聊天機器人與自動化工作流程的離線推論引擎

    1,314+0近 7 天星數變化
  • data-efficient-gans@mit-han-lab

    [NeurIPS 2020] 用於提升資料效率的 GAN 訓練之可微分資料增強技術

    1,308+0近 7 天星數變化
  • Bernini@bytedance

    Bernini 是一個用於影片生成與編輯的統一框架,結合了基於 MLLM 的語意規劃器與基於 DiT 的渲染器。

    1,300+0近 7 天星數變化
  • Inpaint Anything 擴充功能使用 Segment Anything 的遮罩,在瀏覽器介面中執行 stable diffusion 內填。

    1,298+0近 7 天星數變化
  • MV-Adapter@huanngzh

    [ICCV 2025]「MV-Adapter: Multi-view Consistent Image Generation Made Easy」官方實作

    1,289+0近 7 天星數變化
  • 透過使用 webkit 轉換 html,在 Symfony 中輕鬆建立 PDF 與圖片

    1,247+0近 7 天星數變化
  • 從終端機使用 OpenAI 的 ChatGPT 與 DALL-E 的簡單 shell 指令碼。不需要 Python 或 JS。

    1,241+0近 7 天星數變化
  • 影像對影像轉換(image-to-image translation)精選資源列表。

    1,239+0近 7 天星數變化
  • cleanvision@cleanlab

    自動尋找圖片資料集中的問題,並實踐以資料為中心的電腦視覺。

    1,199+0近 7 天星數變化
  • clean-fid@GaParmar

    PyTorch - 具備適當影像縮放與量化步驟的 FID 計算 [CVPR 2022]

    1,167+0近 7 天星數變化
  • MagicDrive@cure-lab

    [ICLR24] 論文「MagicDrive: Street View Generation with Diverse 3D Geometry Control」的官方實作

    1,167+0近 7 天星數變化
  • VITON-HD@shadow2496

    「VITON-HD: High-Resolution Virtual Try-On via Misalignment-Aware Normalization」官方 PyTorch 實作(CVPR 2021)

    1,161+0近 7 天星數變化
  • 歸藏的材質插畫 skill:生成帶字解釋圖、圖表美化和參考輔助配圖。

    1,120+23近 7 天星數變化
  • Uncensored-Local-Studio@techjarves

    適用於 Windows、Linux 與 macOS 的無審查本地 AI 工作室。零設定圖形介面,支援圖像生成、GGUF LLM、文字轉語音與語音轉文字

    1,118+13近 7 天星數變化
  • mlx-serve@ddalcu

    適用於 Apple Silicon 的原生 LLM 推論伺服器。相容 OpenAI + Anthropic API。無須 Python。包含具備聊天、agent 模式與工具呼叫功能的 MLX Core macOS 應用程式。

    1,115+39近 7 天星數變化
  • image-extender@boona13

    利用 AI 向任意方向無縫擴展圖像。開源 Web 應用,透過 OpenRouter 由 Gemini 驅動,具備 Poisson 融合接縫與三選一變體選擇器。

    1,103+3近 7 天星數變化
  • CogView4@zai-org

    CogView4、CogView3-Plus 與 CogView3 (ECCV 2024)

    1,101+0近 7 天星數變化
  • awesome-agent-apis@Anil-matcha

    OpenClaw 資源、工具、技能、教學與文章的精選列表。OpenClaw(前稱 Moltbot / Clawdbot)— 適用於 WhatsApp、Telegram、Discord 及 50 多種整合的開源自託管 AI agent。

    1,005+8近 7 天星數變化
  • 🎬 透過 3D 互動控制從任何攝影機視角生成影像。在 3D 空間中拖曳攝影機或使用滑桿設定方位角/仰角/距離後進行生成。基於 Three.js + Gradio 建構,支援中英雙語介面。

    982+161近 7 天星數變化
  • :fire: :fire: :fire: 近期電腦視覺 (CV) 相關論文清單

    973+1近 7 天星數變化
  • story-iter@UCSC-VLAA

    [ICLR 2026] 用於長篇故事視覺化的免訓練迭代框架。

    957-3近 7 天星數變化
  • HR-VITON@sangyun884

    論文 High-Resolution Virtual Try-On with Misalignment and Occlusion-Handled Conditions (ECCV 2022) 之官方 PyTorch 實作。

    917+0近 7 天星數變化
  • AMC-WebUI@yeahhe365

    面向 Gemini 的 Local-First AI 工作流 WebUI,整合多模態聊天、Canvas、檔案處理、即時搜尋、程式碼執行與進階推理。

    899+4近 7 天星數變化
  • codex-slides@nexu-io

    🎨 Codex 內建的開源 AI 簡報工作室:原生影像簡報,每一張投影片都是完整的視覺畫布。⚡ 約 4-5 分鐘即可產出 10 張以上高品質投影片 — 快速模式可平行渲染每一頁。🔍 即時觀看完整流程:研究 → 大綱 → 風格 → 渲染 → 編輯 → 簡報 → 匯出 PDF/PPTX。🖥️ 以瀏覽器為優先 · 無需 API 金鑰 · 專案持久保存。

    881+22近 7 天星數變化
  • AnyGPT@OpenMOSS

    「AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling」的程式碼

    881-1近 7 天星數變化
  • UniPic@SkyworkAI

    開源的 SOTA 多圖編輯模型

    875+1近 7 天星數變化
  • flatkey-cli@flatkey-ai

    用於圖像、影片、音訊、文字、製作名單與模型探索的 Flatkey 媒體生成 CLI

    873+144近 7 天星數變化
← 返回主題列表