跳到主要内容
buildradar
登录
主题 · text-to-image

text-to-image

标记 text-to-image 主题、收录中的开源项目,按星标数排序。

共 62 个项目
  • WebAI2API@foxhui

    WebAI2API:基于 Camoufox 的网页 AI 转 API 工具,支持 LMArena/Gemini 等,具备多窗口并发与账号隔离功能。

    1,315+0近 7 天星标变化
  • airunner@Capsize-Games

    用于艺术、实时语音对话、LLM 驱动的聊天机器人与自动化工作流程的离线推理引擎

    1,314+0近 7 天星标变化
  • 文字转图片 diffusion models 可控生成资源收集。

    1,110+0近 7 天星标变化
  • CogView4@zai-org

    CogView4、CogView3-Plus 与 CogView3 (ECCV 2024)

    1,101+0近 7 天星标变化
  • awesome-agent-apis@Anil-matcha

    OpenClaw 资源、工具、技能、教程与文章的精选列表。OpenClaw(前称 Moltbot / Clawdbot)— 适用于 WhatsApp、Telegram、Discord 及 50 多种集成的开源自托管 AI agent。

    1,005+8近 7 天星标变化
  • unfake.js@jenissimo

    直接在浏览器中修复 AI 像素艺术与矢量图像

    919+6近 7 天星标变化
  • muse-maskgit-pytorch@lucidrains

    在 Pytorch 中实现 Muse:通过遮罩生成式 Transformer 的文本转图片生成

    918+0近 7 天星标变化
  • Lora-for-Diffusers@haofanwang

    为 AI 生成研究人员设计的 diffusers 框架内使用 LoRA (Low-Rank Adaptation) 最易懂的教程🔥

    822+0近 7 天星标变化
  • TF-ICON@Shilin-LU

    [ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition"(官方实现)

    814+0近 7 天星标变化
  • [TMLR 2025🔥] 视觉自回归模型综述。

    808+0近 7 天星标变化
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = 文字转图像/视频

    789+0近 7 天星标变化
  • Attend-and-Excite@yuval-alaluf

    「Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models」的官方实现 (SIGGRAPH 2023)

    770+0近 7 天星标变化
  • 精选的文生图生成研究集合。

    764+0近 7 天星标变化
  • 文本转视频生成/合成技术综述。

    744+3近 7 天星标变化
  • PaddleMIX@PaddlePaddle

    Paddle 多模态整合与探索,支持主流多模态任务,包含端到端大型多模态预训练模型与扩散模型工具箱。具备高性能与灵活性。

    723-1近 7 天星标变化
  • NanoBananaEditor@markfulton

    最先进的 Nano Banana 图像生成与编辑应用程序。您进行 AI 图像生成与修改的中央枢纽。直观的 UI 提供参考图像、使用图像遮罩编辑、版本历史记录等功能。由 Gemini 2.5 Flash 图像 API 提供支持。

    710+0近 7 天星标变化
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1:用于高分辨率 (2K) 文字转图像生成的高效扩散模型

    674-1近 7 天星标变化
  • OneDiffusion@lehduong

    OneDiffusion 论文 (CVPR 2025) 的官方实现

    665+0近 7 天星标变化
  • flash-diffusion@gojasper

    Flash Diffusion — 加速条件式扩散模型(AAAI 2025 Oral)

    665+2近 7 天星标变化
  • face-to-sticker

    641+0近 7 天星标变化
  • Liquid@FoundationVision

    (IJCV 接受) Liquid:具备可扩展性与统一性的多模态语言模型生成器

    640+0近 7 天星标变化
  • blended-latent-diffusion@omriav

    「Blended Latent Diffusion」[SIGGRAPH 2023] 的官方实现

    632+0近 7 天星标变化
  • MIGC@limuloo

    [CVPR 2024 Highlight] MIGC 与 [TPAMI 2024] MIGC++(官方实现)

    614+0近 7 天星标变化
  • 精选的可重复使用 JSON AI 绘图提示词模板与风格参考,每日更新。

    593+5近 7 天星标变化
  • semantic-draw@ironjr

    CVPR 2025 论文“SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models”官方代码。

    589+0近 7 天星标变化
  • blended-diffusion@omriav

    “Blended Diffusion for Text-driven Editing of Natural Images” 官方实现 [CVPR 2022]

    588-1近 7 天星标变化
  • 精选基于 LLM 的多模态生成(图像、视频、3D 与音频)论文列表。

    552+0近 7 天星标变化
  • payload-ai@ashbuilds

    AI Plugin 是 Payload CMS 的强大扩展功能,整合先进 AI 能力以增强内容创建与管理。

    548-1近 7 天星标变化
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] 用于视觉生成与理解的统一 Tokenizer

    529-1近 7 天星标变化
  • Google-Colab_Notebooks@Isi-dev

    各类项目的 Google Colab Notebook 集合

    522+1近 7 天星标变化
← 返回主题列表