diffusion-models
diffusion-models टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #31
डिफ्यूजन मॉडल पेपर्स का संग्रह जो उनके उप-क्षेत्रों के अनुसार वर्गीकृत हैं
★ 2,224+0पिछले 7 दिनों में स्टार का बदलाव - #32
स्टॉकैस्टिक डिफरेंशियल समीकरणों के माध्यम से स्कोर-आधारित जनरेटिव मॉडलिंग के लिए PyTorch कार्यान्वयन (ICLR 2021, ओरल)
★ 2,130+0पिछले 7 दिनों में स्टार का बदलाव - #33★ 2,129+18पिछले 7 दिनों में स्टार का बदलाव
- #34
मेडिकल इमेजिंग में डिफ्यूजन मॉडल्स (Medical Image Analysis Journal में प्रकाशित)
★ 2,110+2पिछले 7 दिनों में स्टार का बदलाव - #35
[NeurIPS 2025] इमेज एडिटिंग के लिए केवल एक LoRA पर्याप्त है! शानदार इमेज एडिटिंग के लिए 0.1% ट्रेनिंग डेटा! ID परसिस्टेंस में GPT-4o से आगे~ MoE ckpt जारी! चलाने के लिए केवल 4GB VRAM पर्याप्त है!
★ 2,104+1पिछले 7 दिनों में स्टार का बदलाव - #36
DIAMOND (DIffusion As a Model Of eNvironment Dreams) एक रीइन्फोर्समेंट लर्निंग एजेंट है जिसे डिफ्यूजन वर्ल्ड मॉडल में प्रशिक्षित किया गया है। NeurIPS 2024 Spotlight।
★ 2,100+1पिछले 7 दिनों में स्टार का बदलाव - #37
Zero123++ के लिए कोड रिपॉजिटरी: एक सिंगल इमेज से कंसिस्टेंट मल्टी-व्यू डिफ्यूजन बेस मॉडल।
★ 2,096+0पिछले 7 दिनों में स्टार का बदलाव - #38
बड़े मॉडल की सुरक्षा, संरक्षा और गोपनीयता के लिए एक पठन सूची (Awesome LLM Security, Safety, आदि सहित)।
★ 2,070+0पिछले 7 दिनों में स्टार का बदलाव - #39
Custom Diffusion: टेक्स्ट-टू-इमेज Diffusion का मल्टी-कॉन्सेप्ट कस्टमाइजेशन (CVPR 2023)
★ 1,977-1पिछले 7 दिनों में स्टार का बदलाव - #40
[ICLR & NeurIPS 2025] Show-o श्रृंखला के लिए रिपॉजिटरी, मल्टीमॉडल समझ और पीढ़ी को एकजुट करने के लिए एक सिंगल ट्रांसफॉर्मर।
★ 1,975+1पिछले 7 दिनों में स्टार का बदलाव - #41
ऑटोरिग्रेसिव मॉडल ने डिफ्यूजन को पछाड़ा: स्केलेबल इमेज जनरेशन के लिए 🦙 Llama
★ 1,966+0पिछले 7 दिनों में स्टार का बदलाव - #42★ 1,964+0पिछले 7 दिनों में स्टार का बदलाव
- #43
[ICCV 2023] Make-It-3D: डिफ्यूज़न पrior के साथ एक ही इमेज से हाई-फिडेलिटी 3D निर्माण
★ 1,891+0पिछले 7 दिनों में स्टार का बदलाव - #44
"DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps" (Neurips 2022 Oral) के लिए आधिकारिक कोड
★ 1,852+0पिछले 7 दिनों में स्टार का बदलाव - #45
HunyuanVideo-I2V: HunyuanVideo पर आधारित एक अनुकूलन योग्य इमेज-टू-वीडियो मॉडल
★ 1,840+0पिछले 7 दिनों में स्टार का बदलाव - #46
[ICLR 2025] CatVTON एक सरल और कुशल वर्चुअल ट्राई-ऑन डिफ्यूजन मॉडल है जिसमें 1) लाइटवेट नेटवर्क (कुल 899.06M पैरामीटर), 2) पैरामीटर-कुशल ट्रेनिंग (49.57M पैरामीटर ट्रेनेबल) और 3) सरलीकृत अनुमान (1024X768 रिज़ॉल्यूशन के लिए < 8G VRAM) शामिल हैं।
★ 1,831+2पिछले 7 दिनों में स्टार का बदलाव - #47
[CVPR 2026] रियल-टाइम डिफ्यूजन-आधारित स्ट्रीमिंग वीडियो सुपर-रिजॉल्यूशन की ओर — लोकैलिटी-कंसट्रेंड स्पार्स अटेंशन और एक छोटे कंडीशनल डिकोडर के साथ स्ट्रीमिंग VSR के लिए एक कुशल वन-स्टेप डिफ्यूजन फ्रेमवर्क।
★ 1,815+11पिछले 7 दिनों में स्टार का बदलाव - #48
AIGC के लिए RAG के बेहतरीन पेपर एकत्र करना। हम "Retrieval-Augmented Generation for AI-Generated Content: A Survey" पेपर में RAG की नींव, संवर्द्धन और अनुप्रयोगों के वर्गीकरण का प्रस्ताव करते हैं।
★ 1,789-1पिछले 7 दिनों में स्टार का बदलाव - #49
[ECCV 2024] पेपर "BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion" का आधिकारिक कार्यान्वयन
★ 1,744-1पिछले 7 दिनों में स्टार का बदलाव - #50
[ICLR'25 ओरल] जनरेशन के लिए रिप्रेजेंटेशन एलाइनमेंट: डिफ्यूजन ट्रांसफॉर्मर को प्रशिक्षित करना जितना आप सोचते हैं उससे कहीं अधिक आसान है
★ 1,706+2पिछले 7 दिनों में स्टार का बदलाव - #51
[NeurIPS 2023] ImageReward: टेक्स्ट-टू-इमेज जनरेशन के लिए मानवीय प्राथमिकताओं को सीखना और मूल्यांकन करना
★ 1,703+1पिछले 7 दिनों में स्टार का बदलाव - #52
MMaDA - ओपन-सोर्स्ड मल्टीमॉडल लार्ज डिफ्यूज़न लैंग्वेज मॉडल्स (ब्लॉक डिफ्यूज़न, मिक्स्ड-CoT, यूनिफाइड RL के साथ dLLMs)
★ 1,671+1पिछले 7 दिनों में स्टार का बदलाव - #53
RL में Diffusion Model संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)
★ 1,635+2पिछले 7 दिनों में स्टार का बदलाव - #54
[ACM MM 2025] FantasyTalking: सुसंगत गति संश्लेषण के माध्यम से यथार्थवादी टॉकिंग पोर्ट्रेट जनरेशन
★ 1,628+0पिछले 7 दिनों में स्टार का बदलाव - #55
[ICLR'24] Magic123 का आधिकारिक PyTorch कार्यान्वयन: 2D और 3D डिफ्यूजन प्रायोर का उपयोग करके एक इमेज से उच्च-गुणवत्ता वाला 3D ऑब्जेक्ट जनरेशन
★ 1,622-1पिछले 7 दिनों में स्टार का बदलाव - #56
"MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling" का आधिकारिक कार्यान्वयन
★ 1,579+1पिछले 7 दिनों में स्टार का बदलाव - #57★ 1,570-1पिछले 7 दिनों में स्टार का बदलाव
- #58
O'Reilly पुस्तक Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play के दूसरे संस्करण के लिए आधिकारिक कोड रिपॉजिटरी
★ 1,553+3पिछले 7 दिनों में स्टार का बदलाव - #59
प्रत्येक स्टेबल डिफ़्यूज़न मॉडल के लिए उच्च गुणवत्ता वाली ट्रेनिंग-मुक्त इनपेंट। ComfyUI का समर्थन करता है
★ 1,372+4पिछले 7 दिनों में स्टार का बदलाव - #60★ 1,371+2पिछले 7 दिनों में स्टार का बदलाव