text-to-image
Repositori open source terpantau bertanda text-to-image, diurutkan berdasarkan bintang.
- #31
WebAI2API: Alat konversi web AI ke API berbasis Camoufox, mendoroang LMArena/Gemini dll, konkurensi multi-jendela dan isolasi akun.
★ 1.315+0Perubahan bintang dalam 7 hari terakhir - #32
Mesin inferensi luring untuk seni, percakapan suara waktu nyata, chatbot bertenaga LLM, dan alur kerja otomatis
★ 1.314+0Perubahan bintang dalam 7 hari terakhir - #33
Kumpulan sumber daya tentang pembuatan terkontrol dengan model difusi teks-ke-gambar.
★ 1.110+0Perubahan bintang dalam 7 hari terakhir - #34★ 1.101+0Perubahan bintang dalam 7 hari terakhir
- #35
Daftar kurasi sumber daya, alat, keahlian, tutorial & artikel OpenClaw. OpenClaw (sebelumnya Moltbot / Clawdbot) — agen AI open-source yang di-hosting sendiri untuk WhatsApp, Telegram, Discord & 50+ integrasi.
★ 1.005+8Perubahan bintang dalam 7 hari terakhir - #36
Implementasi Muse: Text-to-Image Generation via Masked Generative Transformers, dalam Pytorch
★ 918+0Perubahan bintang dalam 7 hari terakhir - #37★ 916+6Perubahan bintang dalam 7 hari terakhir
- #38
Tutorial paling mudah dipahami untuk menggunakan LoRA (Low-Rank Adaptation) dalam framework diffusers bagi peneliti AI Generation.
★ 822+0Perubahan bintang dalam 7 hari terakhir - #39
[ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (Implementasi Resmi)
★ 814+0Perubahan bintang dalam 7 hari terakhir - #40
[TMLR 2025🔥] Survei untuk model autoregresif dalam visi.
★ 808+0Perubahan bintang dalam 7 hari terakhir - #41
CLIP + FFT/DWT/RGB = teks ke gambar/video
★ 789+0Perubahan bintang dalam 7 hari terakhir - #42
Implementasi resmi untuk "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)
★ 770+0Perubahan bintang dalam 7 hari terakhir - #43
Kumpulan studi pembuatan teks-ke-gambar yang luar biasa.
★ 765+0Perubahan bintang dalam 7 hari terakhir - #44
Survei tentang Pembuatan/Sintesis Teks-ke-Video.
★ 744+3Perubahan bintang dalam 7 hari terakhir - #45
Integrasi dan Eksplorasi Multimodal Paddle, mendukung tugas multimodal arus utama, termasuk model pra-pelatihan multimodal skala besar end-to-end dan kotak alat model difusi. Dilengkapi dengan kinerja tinggi dan fleksibilitas.
★ 723-1Perubahan bintang dalam 7 hari terakhir - #46
Aplikasi generator dan editor gambar Nano Banana tercanggih. Pusat kendali untuk pembuatan dan revisi gambar AI. UI intuitif dengan fitur gambar referensi, pengeditan dengan mask, riwayat versi, dan lainnya. Didukung oleh API gambar Gemini 2.5 Flash.
★ 710+0Perubahan bintang dalam 7 hari terakhir - #47
HunyuanImage-2.1: Model Difusi yang Efisien untuk Pembuatan Teks-ke-Gambar Resolusi Tinggi (2K)
★ 674-1Perubahan bintang dalam 7 hari terakhir - #48
Implementasi resmi makalah OneDiffusion (CVPR 2025)
★ 665+0Perubahan bintang dalam 7 hari terakhir - #49
Flash Diffusion — mempercepat model difusi bersyarat (AAAI 2025 Oral).
★ 664+1Perubahan bintang dalam 7 hari terakhir - #50
face-to-sticker
★ 641+0Perubahan bintang dalam 7 hari terakhir - #51
(Diterima oleh IJCV) Liquid: Model Bahasa adalah Generator Multimodal yang Skalabel dan Terpadu
★ 640+0Perubahan bintang dalam 7 hari terakhir - #52
Implementasi resmi untuk "Blended Latent Diffusion" [SIGGRAPH 2023]
★ 632+0Perubahan bintang dalam 7 hari terakhir - #53★ 614+0Perubahan bintang dalam 7 hari terakhir
- #54
Koleksi templat prompt JSON yang dapat digunakan kembali & referensi gaya untuk pembuatan gambar AI. Diperbarui setiap hari.
★ 593+6Perubahan bintang dalam 7 hari terakhir - #55
Implementasi resmi untuk "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022]
★ 588-1Perubahan bintang dalam 7 hari terakhir - #56
Kode resmi untuk makalah CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."
★ 588+0Perubahan bintang dalam 7 hari terakhir - #57
🔥🔥🔥 Daftar kurasi makalah tentang generasi multimodal berbasis LLM (gambar, video, 3D, dan audio).
★ 552+0Perubahan bintang dalam 7 hari terakhir - #58
AI Plugin adalah ekstensi canggih untuk Payload CMS, mengintegrasikan kemampuan AI tingkat lanjut untuk meningkatkan pembuatan dan pengelolaan konten.
★ 547-1Perubahan bintang dalam 7 hari terakhir - #59
[NeurIPS 2025 Spotlight] Tokenizer Terpadu untuk Pembuatan dan Pemahaman Visual
★ 529-1Perubahan bintang dalam 7 hari terakhir - #60
Kumpulan Google Colab Notebook untuk berbagai proyek
★ 519+1Perubahan bintang dalam 7 hari terakhir