image-generation
Repositori open source terpantau bertanda image-generation, diurutkan berdasarkan bintang.
- #61
Penampil mandiri sederhana untuk membaca prompt dari gambar hasil generasi Stable Diffusion di luar webui.
★ 1.340+0Perubahan bintang dalam 7 hari terakhir - #62
Model multimodal unified native dengan 3B parameter aktif untuk pemahaman, pembuatan, dan pengeditan gambar dan video.
★ 1.334+3Perubahan bintang dalam 7 hari terakhir - #63
WebAI2API: Alat konversi web AI ke API berbasis Camoufox, mendoroang LMArena/Gemini dll, konkurensi multi-jendela dan isolasi akun.
★ 1.315+16Perubahan bintang dalam 7 hari terakhir - #64
Mesin inferensi luring untuk seni, percakapan suara waktu nyata, chatbot bertenaga LLM, dan alur kerja otomatis
★ 1.314+0Perubahan bintang dalam 7 hari terakhir - #65
[NeurIPS 2020] Augmentasi Diferensial untuk Pelatihan GAN yang Efisien Data
★ 1.308+0Perubahan bintang dalam 7 hari terakhir - #66
Bernini adalah kerangka kerja terpadu untuk pembuatan dan penyuntingan video yang menggabungkan perencana semantik berbasis MLLM dengan renderer berbasis DiT.
★ 1.300+10Perubahan bintang dalam 7 hari terakhir - #67
Ekstensi Inpaint Anything yang melakukan inpainting stable diffusion pada UI browser menggunakan mask dari Segment Anything.
★ 1.298+0Perubahan bintang dalam 7 hari terakhir - #68
[ICCV 2025] Implementasi resmi dari "MV-Adapter: Multi-view Consistent Image Generation Made Easy"
★ 1.289+1Perubahan bintang dalam 7 hari terakhir - #69
Membuat PDF dan gambar dengan mudah di Symfony dengan mengonversi html menggunakan webkit
★ 1.247+0Perubahan bintang dalam 7 hari terakhir - #70
Skrip shell sederhana untuk menggunakan ChatGPT dan DALL-E dari OpenAI melalui terminal. Tidak memerlukan Python atau JS.
★ 1.241+3Perubahan bintang dalam 7 hari terakhir - #71
Kumpulan sumber daya pilihan tentang translasi gambar-ke-gambar.
★ 1.239+0Perubahan bintang dalam 7 hari terakhir - #72
Secara otomatis menemukan masalah dalam dataset gambar dan mempraktikkan visi komputer yang berpusat pada data.
★ 1.199+0Perubahan bintang dalam 7 hari terakhir - #73
PyTorch - Perhitungan FID dengan langkah pengubahan ukuran dan kuantisasi gambar yang tepat [CVPR 2022]
★ 1.167+0Perubahan bintang dalam 7 hari terakhir - #74
[ICLR24] Implementasi resmi dari makalah “MagicDrive: Street View Generation with Diverse 3D Geometry Control”
★ 1.167+1Perubahan bintang dalam 7 hari terakhir - #75
Implementasi resmi PyTorch dari "VITON-HD: High-Resolution Virtual Try-On via Misalignment-Aware Normalization" (CVPR 2021)
★ 1.161+0Perubahan bintang dalam 7 hari terakhir - #76
Studio AI lokal tanpa sensor untuk Windows, Linux, dan macOS. GUI tanpa pengaturan untuk Pembuatan Gambar, LLM GGUF, Text-to-Speech & Speech-to-Text
★ 1.118+87Perubahan bintang dalam 7 hari terakhir - #77
Skill ilustrasi material Guizang: menghasilkan diagram penjelasan beranotasi, mempercantik grafik, dan bantuan referensi gambar.
★ 1.116+37Perubahan bintang dalam 7 hari terakhir - #78
Server inferensi LLM native untuk Apple Silicon. Kompatibel dengan API OpenAI + Anthropic. Tanpa Python. Termasuk aplikasi macOS MLX Core dengan obrolan, mode agen, dan pemanggilan alat.
★ 1.115+245Perubahan bintang dalam 7 hari terakhir - #79★ 1.102+1Perubahan bintang dalam 7 hari terakhir
- #80
Perluas gambar apa pun ke segala arah dengan mulus menggunakan AI. Aplikasi web open-source yang didukung oleh Gemini melalui OpenRouter, dengan sambungan berbaur Poisson dan pemilih varian terbaik dari 3.
★ 1.101+4Perubahan bintang dalam 7 hari terakhir - #81
Daftar kurasi sumber daya, alat, keahlian, tutorial & artikel OpenClaw. OpenClaw (sebelumnya Moltbot / Clawdbot) — agen AI open-source yang di-hosting sendiri untuk WhatsApp, Telegram, Discord & 50+ integrasi.
★ 1.005+8Perubahan bintang dalam 7 hari terakhir - #82
:fire: :fire: :fire: Daftar makalah dari beberapa karya Computer Vision (CV) terkini
★ 973+1Perubahan bintang dalam 7 hari terakhir - #83
[ICLR 2026] Kerangka Kerja Iteratif Tanpa Pelatihan untuk Visualisasi Cerita Panjang
★ 957-2Perubahan bintang dalam 7 hari terakhir - #84
Hasilkan gambar dari sudut pandang kamera mana pun melalui kontrol interaktif 3D. Geser kamera di ruang 3D atau gunakan slider untuk mengatur azimuth/elevasi/jarak, lalu hasilkan. Dibangun dengan Three.js + Gradio, antarmuka dwibahasa ZH/EN.
★ 955+218Perubahan bintang dalam 7 hari terakhir - #85
Implementasi resmi PyTorch untuk makalah High-Resolution Virtual Try-On with Misalignment and Occlusion-Handled Conditions (ECCV 2022).
★ 917+0Perubahan bintang dalam 7 hari terakhir - #86
WebUI alur kerja AI Local-First untuk Gemini, mengintegrasikan obrolan multimodal, Canvas, pemrosesan file, pencarian real-time, eksekusi kode, dan penalaran tingkat lanjut.
★ 899+1Perubahan bintang dalam 7 hari terakhir - #87★ 881-1Perubahan bintang dalam 7 hari terakhir
- #88
🎨 Studio slide AI sumber terbuka di dalam Codex: dek berbasis gambar, setiap slide adalah kanvas visual penuh. ⚡ 10+ slide berkualitas tinggi dalam ~4–5 menit — Mode cepat merender setiap halaman secara paralel. 🔍 Tonton seluruh rantai secara langsung: riset → kerangka → gaya → render → edit → presentasi → ekspor PDF/PPTX. 🖥️ Berbasis browser · tanpa kunci API · proyek tahan lama.
★ 878+23Perubahan bintang dalam 7 hari terakhir - #89★ 875+1Perubahan bintang dalam 7 hari terakhir
- #90
CLI pembuatan media Flatkey untuk gambar, video, audio, teks, kredit, dan penemuan model.
★ 845+191Perubahan bintang dalam 7 hari terakhir