diffusion-models
Repositori open source terpantau bertanda diffusion-models, diurutkan berdasarkan bintang.
- #31
Koleksi makalah diffusion model yang dikategorikan berdasarkan sub-area mereka
★ 2.224+0Perubahan bintang dalam 7 hari terakhir - #32
Implementasi PyTorch untuk Score-Based Generative Modeling melalui Stochastic Differential Equations (ICLR 2021, Oral)
★ 2.130+0Perubahan bintang dalam 7 hari terakhir - #33★ 2.129+18Perubahan bintang dalam 7 hari terakhir
- #34
Model Difusi dalam Pencitraan Medis (Diterbitkan di Jurnal Analisis Citra Medis)
★ 2.110+2Perubahan bintang dalam 7 hari terakhir - #35
[NeurIPS 2025] Pengeditan gambar cukup dengan satu LoRA! 0,1% data pelatihan untuk pengeditan gambar yang fantastis! Melampaui GPT-4o dalam persistensi ID~ MoE ckpt dirilis! Hanya butuh 4GB VRAM untuk menjalankan!
★ 2.104+1Perubahan bintang dalam 7 hari terakhir - #36
DIAMOND adalah agen pembelajaran penguatan (reinforcement learning) yang dilatih dalam model dunia difusi. NeurIPS 2024 Spotlight.
★ 2.100+1Perubahan bintang dalam 7 hari terakhir - #37
Repositori kode untuk Zero123++: model dasar difusi multi-tampilan konsisten dari satu gambar.
★ 2.096+0Perubahan bintang dalam 7 hari terakhir - #38
Daftar bacaan untuk keamanan, keselamatan, dan privasi model besar (termasuk Awesome LLM Security, Safety, dll.).
★ 2.070+0Perubahan bintang dalam 7 hari terakhir - #39
Custom Diffusion: Kustomisasi Multi-Konsep untuk Difusi Teks-ke-Gambar (CVPR 2023).
★ 1.977-1Perubahan bintang dalam 7 hari terakhir - #40
[ICLR & NeurIPS 2025] Repositori untuk seri Show-o, satu Transformer tunggal untuk menyatukan pemahaman dan generasi multimodal.
★ 1.975+1Perubahan bintang dalam 7 hari terakhir - #41
Model Autoregressive Mengungguli Diffusion: 🦙 Llama untuk Pembuatan Gambar yang Dapat Diskalakan
★ 1.966+0Perubahan bintang dalam 7 hari terakhir - #42★ 1.964+0Perubahan bintang dalam 7 hari terakhir
- #43
[ICCV 2023] Make-It-3D: Pembuatan 3D fidelitas tinggi dari satu gambar dengan Diffusion Prior.
★ 1.891+0Perubahan bintang dalam 7 hari terakhir - #44
Kode resmi untuk "DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps" (Neurips 2022 Oral)
★ 1.852+0Perubahan bintang dalam 7 hari terakhir - #45
HunyuanVideo-I2V: Model Image-to-Video yang Dapat Disesuaikan Berdasarkan HunyuanVideo
★ 1.840+0Perubahan bintang dalam 7 hari terakhir - #46
[ICLR 2025] CatVTON adalah model difusi virtual try-on yang sederhana dan efisien dengan 1) Jaringan Ringan (total 899,06M parameter), 2) Pelatihan Efisien Parameter (49,57M parameter dapat dilatih), dan 3) Inferensi Sederhana (< 8GB VRAM untuk resolusi 1024X768).
★ 1.831+2Perubahan bintang dalam 7 hari terakhir - #47
[CVPR 2026] Menuju Streaming Video Super-Resolution Berbasis Difusi Real-Time — Kerangka kerja difusi satu langkah yang efisien untuk streaming VSR dengan attention jarang yang dibatasi lokalitas dan dekoder kondisional kecil.
★ 1.815+11Perubahan bintang dalam 7 hari terakhir - #48
Mengumpulkan makalah keren tentang RAG untuk AIGC. Kami mengusulkan taksonomi dasar, peningkatan, dan aplikasi RAG dalam makalah "Retrieval-Augmented Generation for AI-Generated Content: A Survey".
★ 1.789-1Perubahan bintang dalam 7 hari terakhir - #49
[ECCV 2024] Implementasi resmi dari makalah "BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion"
★ 1.744-1Perubahan bintang dalam 7 hari terakhir - #50
[ICLR'25 Oral] Penyelarasan Representasi untuk Generasi: Melatih Diffusion Transformers Lebih Mudah dari yang Anda Pikirkan
★ 1.706+2Perubahan bintang dalam 7 hari terakhir - #51
[NeurIPS 2023] ImageReward: Mempelajari dan Mengevaluasi Preferensi Manusia untuk Pembuatan Teks-ke-Gambar
★ 1.703+1Perubahan bintang dalam 7 hari terakhir - #52
MMaDA - Model Bahasa Difusi Besar Multimodal Sumber Terbuka (dLLM dengan block diffusion, mixed-CoT, unified RL)
★ 1.671+1Perubahan bintang dalam 7 hari terakhir - #53
Daftar kurasi sumber daya Diffusion Model dalam RL (terus diperbarui)
★ 1.635+2Perubahan bintang dalam 7 hari terakhir - #54
[ACM MM 2025] FantasyTalking: Pembuatan Potret Berbicara Realistis melalui Sintesis Gerakan Koheren
★ 1.628+0Perubahan bintang dalam 7 hari terakhir - #55
[ICLR'24] Implementasi Resmi PyTorch dari Magic123: Pembuatan Objek 3D Berkualitas Tinggi dari Satu Gambar Menggunakan Prior Difusi 2D dan 3D
★ 1.622-1Perubahan bintang dalam 7 hari terakhir - #56
Implementasi resmi dari "MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling"
★ 1.579+1Perubahan bintang dalam 7 hari terakhir - #57
Implementasi DiffDock: Langkah Difusi, Putaran, dan Belokan untuk Penambatan Molekuler
★ 1.570-1Perubahan bintang dalam 7 hari terakhir - #58
Repositori kode resmi untuk edisi kedua buku O'Reilly Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play.
★ 1.553+3Perubahan bintang dalam 7 hari terakhir - #59
Inpainting gratis pelatihan berkualitas tinggi untuk setiap model stable diffusion. Mendukung ComfyUI
★ 1.372+4Perubahan bintang dalam 7 hari terakhir - #60★ 1.371+2Perubahan bintang dalam 7 hari terakhir