text-to-image
标记 text-to-image 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 text-to-image 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 text-to-image 主题的项目。
近 90 天内还没有新项目标记这个主题。
- #1
无限制的 AI 视频平台开源替代方案——具备 500+ 种模型的免费 AI 图像与视频生成工作室(Flux、Midjourney、Kling、Sora、Veo)。无内容过滤。自行托管,采用 MIT 授权。
★ 27,600+0近 7 天星标变化 - #2
GPT-Image-2 API and Prompts
★ 17,062+0近 7 天星标变化 - #3
使用 PyTorch 实现的 DALL·E 2,OpenAI 更新的文字生成图像神经网络
★ 11,301+0近 7 天星标变化 - #4
在 Pytorch 中实现 Google 的文字到图像神经网络 Imagen
★ 8,425+0近 7 天星标变化 - #5
由 GPT-4o 与 gpt-image-1 生成的图像和提示的精选集合。探索 ChatGPT 与 Sora 生成的 AI 视觉,展示 OpenAI 的先进图像生成能力
★ 8,138+0近 7 天星标变化 - #6
本仓库包含手工挑选的 Prompt Engineering 资源,重点关注 Generative Pre-trained Transformer (GPT)、ChatGPT、PaLM 等
★ 6,306+0近 7 天星标变化 - #7
在 Pytorch 中实现 / 复制 DALL‑E,OpenAI 的文字转图像 Transformer。
★ 5,626+0近 7 天星标变化 - #8★ 5,502+0近 7 天星标变化
- #9
GPT Image 2 提示库、图像提示库、代理技能与 OpenAI 图像生成/编辑的 CLI
★ 5,058+0近 7 天星标变化 - #10
AI 代理的多模态生成媒体技能(Claude Code、Cursor、Gemini CLI)。由 muapi.ai 提供高质量图像、视频和音频生成
★ 4,205+0近 7 天星标变化 - #11
LTX-Video 支援 ComfyUI
★ 4,113+0近 7 天星标变化 - #12
[CVPR 2026] PromptEnhancer 是一个提示重写工具,将提示精炼为更清晰、结构化的版本,以提升图像生成效果
★ 3,766+0近 7 天星标变化 - #13
精选的生成式 AI 工具、作品、模型与参考资料清单
★ 3,531+0近 7 天星标变化 - #14★ 3,494+0近 7 天星标变化
- #15
扩散模型论文、调查与分类法
★ 3,364+0近 7 天星标变化 - #16
50 多个你可以复制、部署并获利的开源生成式 AI 应用程序——图像生成器、视频工具、虚拟试穿、AI SaaS 模板以及平台整合。每个模板皆可一键 Vercel 部署。
★ 3,122+0近 7 天星标变化 - #17
Kandinsky 2 — 多语言 text2image 潜在扩散模型
★ 2,814+0近 7 天星标变化 - #18
FLUX, Stable Diffusion, SDXL, SD3, LoRA, 微调, DreamBooth, 训练, Automatic1111, Forge WebUI, SwarmUI, DeepFake, TTS, 动画, 文字转视频, 教程, 指南, 讲座, 课程, ComfyUI, Google Colab, RunPod, Kaggle, NoteBooks, ControlNet, TTS, 声音克隆, AI, AI 新闻, ML, ML 新闻, 新闻, 科技, 科技新闻, Kohya, Midjourney, RunPod
★ 2,762+0近 7 天星标变化 - #19
使用 Stable Diffusion 从任何文本提示生成图像的游乐场(先前使用 DALL-E Mini)
★ 2,740+0近 7 天星标变化 - #20
🔥 [ICCV 2025 Highlight] InfiniteYou:在保留您身份的同时进行灵活的照片重塑
★ 2,684+0近 7 天星标变化 - #21
(ෆ`꒳´ෆ) 文本到图像生成/合成综述。
★ 2,444+0近 7 天星标变化 - #22
Google Research PaperBanana 用于自动化学术图表、图形与研究可视化内容的开源实现与扩展,并已扩展至幻灯片生成等新领域。
★ 2,298+0近 7 天星标变化 - #23
AI 魔法相遇无限绘图板。
★ 1,934+0近 7 天星标变化 - #24
[ICML 2024] 掌握文本到图像扩散模型:利用多模态 LLM 进行重新标注、规划与生成(RPG)
★ 1,844+0近 7 天星标变化 - #25
[ECCV 2024] 论文“BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion”官方实现
★ 1,744+0近 7 天星标变化 - #26
“TokenFlow: Consistent Diffusion Features for Consistent Video Editing”的官方 PyTorch 实现,推出“TokenFlow”(ICLR 2024)
★ 1,707+0近 7 天星标变化 - #27★ 1,587+0近 7 天星标变化
- #28
官方 MiniMax Model Context Protocol (MCP) 服务器,可与强大的文本转语音、图像生成和视频生成 API 进行交互。
★ 1,573+0近 7 天星标变化 - #29★ 1,362+0近 7 天星标变化
- #30
将任何脸孔转化为电玩角色、像素艺术、黏土动画、3D 或玩具风格
★ 1,360+0近 7 天星标变化