본문으로 건너뛰기
buildradar
Sign in
토픽 · text-to-image

text-to-image

text-to-image 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 62개
  • WebAI2API@foxhui

    WebAI2API: Camoufox 기반 웹 AI-to-API 도구, LMArena/Gemini 등 지원, 멀티 윈도우 동시성 및 계정 격리 제공. | Web AI to OpenAI API via Camoufox. Supports LMArena/Gemini and more, multi-window concurrency & account isolation.

    1,315+16최근 7일 스타 변화
  • airunner@Capsize-Games

    이미지 생성, 실시간 음성 대화, LLM 기반 챗봇 및 자동화된 워크플로우를 위한 오프라인 추론 엔진

    1,314+0최근 7일 스타 변화
  • 텍스트-이미지 디퓨전 모델의 제어 가능한 생성에 관한 리소스 모음.

    1,110+0최근 7일 스타 변화
  • CogView4@zai-org

    CogView4, CogView3-Plus 및 CogView3 (ECCV 2024)

    1,101+1최근 7일 스타 변화
  • awesome-agent-apis@Anil-matcha

    OpenClaw 리소스, 도구, 스킬, 튜토리얼 및 아티클 큐레이션 목록. OpenClaw(구 Moltbot / Clawdbot) — WhatsApp, Telegram, Discord 및 50개 이상의 연동을 지원하는 오픈소스 자체 호스팅 AI 에이전트.

    1,005+8최근 7일 스타 변화
  • muse-maskgit-pytorch@lucidrains

    Pytorch로 구현한 Masked Generative Transformers 기반 텍스트-이미지 생성 모델 Muse 구현체

    918+0최근 7일 스타 변화
  • unfake.js@jenissimo

    브라우저에서 바로 AI 픽셀 아트와 벡터 이미지 수정

    916+5최근 7일 스타 변화
  • Lora-for-Diffusers@haofanwang

    AI 생성 연구자를 위한 diffusers 프레임워크 내 LoRA(Low-Rank Adaptation) 사용법을 가장 쉽게 설명한 튜토리얼

    822-1최근 7일 스타 변화
  • TF-ICON@Shilin-LU

    [ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (공식 구현)

    814+0최근 7일 스타 변화
  • [TMLR 2025🔥] 비전 분야의 자기회귀 모델(autoregressive models)에 대한 서베이.

    808+1최근 7일 스타 변화
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB를 활용한 텍스트 기반 이미지/비디오 생성

    789+0최근 7일 스타 변화
  • Attend-and-Excite@yuval-alaluf

    Attend-and-Excite: 텍스트-이미지 확산 모델을 위한 어텐션 기반 의미론적 가이드 공식 구현 (SIGGRAPH 2023)

    770+0최근 7일 스타 변화
  • 텍스트-이미지 생성 관련 우수 연구 모음

    765+0최근 7일 스타 변화
  • 텍스트-비디오 생성 및 합성 기술에 대한 조사 보고서

    744+3최근 7일 스타 변화
  • PaddleMIX@PaddlePaddle

    Paddle 멀티모달 통합 및 탐색 도구. 엔드투엔드 대규모 멀티모달 사전 학습 모델 및 디퓨전 모델 툴박스를 포함한 주요 멀티모달 작업을 지원하며, 높은 성능과 유연성을 제공합니다.

    723-1최근 7일 스타 변화
  • NanoBananaEditor@markfulton

    가장 진보된 Nano Banana 이미지 생성 및 편집 애플리케이션. AI 이미지 생성과 수정을 위한 중앙 허브입니다. 직관적인 UI를 통해 참조 이미지, 이미지 마스크를 활용한 편집, 버전 기록 등을 지원하며 Gemini 2.5 Flash 이미지 API로 구동됩니다.

    710+0최근 7일 스타 변화
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: 고해상도(2K) 텍스트-이미지 생성을 위한 효율적인 확산 모델

    674+0최근 7일 스타 변화
  • OneDiffusion@lehduong

    OneDiffusion 논문 공식 구현 (CVPR 2025)

    665+0최근 7일 스타 변화
  • flash-diffusion@gojasper

    Flash Diffusion — 조건부 확산 모델 가속화 (AAAI 2025 Oral)

    664+1최근 7일 스타 변화
  • face-to-sticker

    641+0최근 7일 스타 변화
  • Liquid@FoundationVision

    (IJCV 채택) Liquid: 확장 가능하고 통합된 멀티모달 생성 언어 모델.

    640+0최근 7일 스타 변화
  • blended-latent-diffusion@omriav

    "Blended Latent Diffusion" [SIGGRAPH 2023] 공식 구현체

    632+0최근 7일 스타 변화
  • MIGC@limuloo

    [CVPR 2024 Highlight] MIGC 및 [TPAMI 2024] MIGC++ (공식 구현)

    614+0최근 7일 스타 변화
  • AI 이미지 생성을 위한 재사용 가능한 JSON 프롬프트 템플릿 및 스타일 참조 모음. 매일 업데이트됨.

    593+17최근 7일 스타 변화
  • semantic-draw@ironjr

    CVPR 2025 논문 SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models의 공식 코드입니다.

    588-1최근 7일 스타 변화
  • blended-diffusion@omriav

    Blended Diffusion for Text-driven Editing of Natural Images [CVPR 2022] 공식 구현체

    588+0최근 7일 스타 변화
  • LLM 기반 멀티모달 생성(이미지, 비디오, 3D, 오디오) 관련 논문 큐레이션 리스트

    552+0최근 7일 스타 변화
  • payload-ai@ashbuilds

    AI Plugin은 Payload CMS를 위한 강력한 확장 기능으로, 고급 AI 기능을 통합하여 콘텐츠 생성 및 관리를 향상함

    547+2최근 7일 스타 변화
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] 시각적 생성 및 이해를 위한 통합 토크나이저

    529-1최근 7일 스타 변화
  • Google-Colab_Notebooks@Isi-dev

    다양한 프로젝트를 위한 Google Colab 노트북 모음

    519+5최근 7일 스타 변화
← 토픽 목록으로