text-to-image
text-to-image 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #31
WebAI2API: Camoufox 기반 웹 AI-to-API 도구, LMArena/Gemini 등 지원, 멀티 윈도우 동시성 및 계정 격리 제공. | Web AI to OpenAI API via Camoufox. Supports LMArena/Gemini and more, multi-window concurrency & account isolation.
★ 1,315+16최근 7일 스타 변화 - #32★ 1,314+0최근 7일 스타 변화
- #33
텍스트-이미지 디퓨전 모델의 제어 가능한 생성에 관한 리소스 모음.
★ 1,110+0최근 7일 스타 변화 - #34★ 1,101+1최근 7일 스타 변화
- #35
OpenClaw 리소스, 도구, 스킬, 튜토리얼 및 아티클 큐레이션 목록. OpenClaw(구 Moltbot / Clawdbot) — WhatsApp, Telegram, Discord 및 50개 이상의 연동을 지원하는 오픈소스 자체 호스팅 AI 에이전트.
★ 1,005+8최근 7일 스타 변화 - #36
Pytorch로 구현한 Masked Generative Transformers 기반 텍스트-이미지 생성 모델 Muse 구현체
★ 918+0최근 7일 스타 변화 - #37★ 916+5최근 7일 스타 변화
- #38
AI 생성 연구자를 위한 diffusers 프레임워크 내 LoRA(Low-Rank Adaptation) 사용법을 가장 쉽게 설명한 튜토리얼
★ 822-1최근 7일 스타 변화 - #39
[ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (공식 구현)
★ 814+0최근 7일 스타 변화 - #40
[TMLR 2025🔥] 비전 분야의 자기회귀 모델(autoregressive models)에 대한 서베이.
★ 808+1최근 7일 스타 변화 - #41
CLIP + FFT/DWT/RGB를 활용한 텍스트 기반 이미지/비디오 생성
★ 789+0최근 7일 스타 변화 - #42
Attend-and-Excite: 텍스트-이미지 확산 모델을 위한 어텐션 기반 의미론적 가이드 공식 구현 (SIGGRAPH 2023)
★ 770+0최근 7일 스타 변화 - #43
텍스트-이미지 생성 관련 우수 연구 모음
★ 765+0최근 7일 스타 변화 - #44
텍스트-비디오 생성 및 합성 기술에 대한 조사 보고서
★ 744+3최근 7일 스타 변화 - #45
Paddle 멀티모달 통합 및 탐색 도구. 엔드투엔드 대규모 멀티모달 사전 학습 모델 및 디퓨전 모델 툴박스를 포함한 주요 멀티모달 작업을 지원하며, 높은 성능과 유연성을 제공합니다.
★ 723-1최근 7일 스타 변화 - #46
가장 진보된 Nano Banana 이미지 생성 및 편집 애플리케이션. AI 이미지 생성과 수정을 위한 중앙 허브입니다. 직관적인 UI를 통해 참조 이미지, 이미지 마스크를 활용한 편집, 버전 기록 등을 지원하며 Gemini 2.5 Flash 이미지 API로 구동됩니다.
★ 710+0최근 7일 스타 변화 - #47
HunyuanImage-2.1: 고해상도(2K) 텍스트-이미지 생성을 위한 효율적인 확산 모델
★ 674+0최근 7일 스타 변화 - #48
OneDiffusion 논문 공식 구현 (CVPR 2025)
★ 665+0최근 7일 스타 변화 - #49
Flash Diffusion — 조건부 확산 모델 가속화 (AAAI 2025 Oral)
★ 664+1최근 7일 스타 변화 - #50
face-to-sticker
★ 641+0최근 7일 스타 변화 - #51★ 640+0최근 7일 스타 변화
- #52
"Blended Latent Diffusion" [SIGGRAPH 2023] 공식 구현체
★ 632+0최근 7일 스타 변화 - #53★ 614+0최근 7일 스타 변화
- #54
AI 이미지 생성을 위한 재사용 가능한 JSON 프롬프트 템플릿 및 스타일 참조 모음. 매일 업데이트됨.
★ 593+17최근 7일 스타 변화 - #55
CVPR 2025 논문 SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models의 공식 코드입니다.
★ 588-1최근 7일 스타 변화 - #56
Blended Diffusion for Text-driven Editing of Natural Images [CVPR 2022] 공식 구현체
★ 588+0최근 7일 스타 변화 - #57
LLM 기반 멀티모달 생성(이미지, 비디오, 3D, 오디오) 관련 논문 큐레이션 리스트
★ 552+0최근 7일 스타 변화 - #58
AI Plugin은 Payload CMS를 위한 강력한 확장 기능으로, 고급 AI 기능을 통합하여 콘텐츠 생성 및 관리를 향상함
★ 547+2최근 7일 스타 변화 - #59★ 529-1최근 7일 스타 변화
- #60
다양한 프로젝트를 위한 Google Colab 노트북 모음
★ 519+5최근 7일 스타 변화