मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · diffusion-models

diffusion-models

diffusion-models टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

163 रिपॉजिटरी
  • डिफ्यूजन मॉडल पेपर्स का संग्रह जो उनके उप-क्षेत्रों के अनुसार वर्गीकृत हैं

    2,224+0पिछले 7 दिनों में स्टार का बदलाव
  • score_sde_pytorch@yang-song

    स्टॉकैस्टिक डिफरेंशियल समीकरणों के माध्यम से स्कोर-आधारित जनरेटिव मॉडलिंग के लिए PyTorch कार्यान्वयन (ICLR 2021, ओरल)

    2,130+0पिछले 7 दिनों में स्टार का बदलाव
  • Helios@PKU-YuanGroup

    Helios: रियल रियल-टाइम लॉन्ग वीडियो जनरेशन मॉडल

    2,129+18पिछले 7 दिनों में स्टार का बदलाव
  • मेडिकल इमेजिंग में डिफ्यूजन मॉडल्स (Medical Image Analysis Journal में प्रकाशित)

    2,110+2पिछले 7 दिनों में स्टार का बदलाव
  • ICEdit@River-Zhang

    [NeurIPS 2025] इमेज एडिटिंग के लिए केवल एक LoRA पर्याप्त है! शानदार इमेज एडिटिंग के लिए 0.1% ट्रेनिंग डेटा! ID परसिस्टेंस में GPT-4o से आगे~ MoE ckpt जारी! चलाने के लिए केवल 4GB VRAM पर्याप्त है!

    2,104+1पिछले 7 दिनों में स्टार का बदलाव
  • diamond@eloialonso

    DIAMOND (DIffusion As a Model Of eNvironment Dreams) एक रीइन्फोर्समेंट लर्निंग एजेंट है जिसे डिफ्यूजन वर्ल्ड मॉडल में प्रशिक्षित किया गया है। NeurIPS 2024 Spotlight।

    2,100+1पिछले 7 दिनों में स्टार का बदलाव
  • zero123plus@SUDO-AI-3D

    Zero123++ के लिए कोड रिपॉजिटरी: एक सिंगल इमेज से कंसिस्टेंट मल्टी-व्यू डिफ्यूजन बेस मॉडल।

    2,096+0पिछले 7 दिनों में स्टार का बदलाव
  • Awesome-LM-SSP@CryptoAILab

    बड़े मॉडल की सुरक्षा, संरक्षा और गोपनीयता के लिए एक पठन सूची (Awesome LLM Security, Safety, आदि सहित)।

    2,070+0पिछले 7 दिनों में स्टार का बदलाव
  • custom-diffusion@adobe-research

    Custom Diffusion: टेक्स्ट-टू-इमेज Diffusion का मल्टी-कॉन्सेप्ट कस्टमाइजेशन (CVPR 2023)

    1,977-1पिछले 7 दिनों में स्टार का बदलाव
  • Show-o@showlab

    [ICLR & NeurIPS 2025] Show-o श्रृंखला के लिए रिपॉजिटरी, मल्टीमॉडल समझ और पीढ़ी को एकजुट करने के लिए एक सिंगल ट्रांसफॉर्मर।

    1,975+1पिछले 7 दिनों में स्टार का बदलाव
  • LlamaGen@FoundationVision

    ऑटोरिग्रेसिव मॉडल ने डिफ्यूजन को पछाड़ा: स्केलेबल इमेज जनरेशन के लिए 🦙 Llama

    1,966+0पिछले 7 दिनों में स्टार का बदलाव
  • onediff@siliconflow

    OneDiff: डिफ्यूजन मॉडल के लिए एक आउट-ऑफ-द-बॉक्स एक्सीलरेशन लाइब्रेरी।

    1,964+0पिछले 7 दिनों में स्टार का बदलाव
  • Make-It-3D@junshutang

    [ICCV 2023] Make-It-3D: डिफ्यूज़न पrior के साथ एक ही इमेज से हाई-फिडेलिटी 3D निर्माण

    1,891+0पिछले 7 दिनों में स्टार का बदलाव
  • dpm-solver@LuChengTHU

    "DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps" (Neurips 2022 Oral) के लिए आधिकारिक कोड

    1,852+0पिछले 7 दिनों में स्टार का बदलाव
  • HunyuanVideo-I2V@Tencent-Hunyuan

    HunyuanVideo-I2V: HunyuanVideo पर आधारित एक अनुकूलन योग्य इमेज-टू-वीडियो मॉडल

    1,840+0पिछले 7 दिनों में स्टार का बदलाव
  • CatVTON@Zheng-Chong

    [ICLR 2025] CatVTON एक सरल और कुशल वर्चुअल ट्राई-ऑन डिफ्यूजन मॉडल है जिसमें 1) लाइटवेट नेटवर्क (कुल 899.06M पैरामीटर), 2) पैरामीटर-कुशल ट्रेनिंग (49.57M पैरामीटर ट्रेनेबल) और 3) सरलीकृत अनुमान (1024X768 रिज़ॉल्यूशन के लिए < 8G VRAM) शामिल हैं।

    1,831+2पिछले 7 दिनों में स्टार का बदलाव
  • FlashVSR@OpenImagingLab

    [CVPR 2026] रियल-टाइम डिफ्यूजन-आधारित स्ट्रीमिंग वीडियो सुपर-रिजॉल्यूशन की ओर — लोकैलिटी-कंसट्रेंड स्पार्स अटेंशन और एक छोटे कंडीशनल डिकोडर के साथ स्ट्रीमिंग VSR के लिए एक कुशल वन-स्टेप डिफ्यूजन फ्रेमवर्क।

    1,815+11पिछले 7 दिनों में स्टार का बदलाव
  • RAG-Survey@hymie122

    AIGC के लिए RAG के बेहतरीन पेपर एकत्र करना। हम "Retrieval-Augmented Generation for AI-Generated Content: A Survey" पेपर में RAG की नींव, संवर्द्धन और अनुप्रयोगों के वर्गीकरण का प्रस्ताव करते हैं।

    1,789-1पिछले 7 दिनों में स्टार का बदलाव
  • BrushNet@TencentARC

    [ECCV 2024] पेपर "BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion" का आधिकारिक कार्यान्वयन

    1,744-1पिछले 7 दिनों में स्टार का बदलाव
  • REPA@sihyun-yu

    [ICLR'25 ओरल] जनरेशन के लिए रिप्रेजेंटेशन एलाइनमेंट: डिफ्यूजन ट्रांसफॉर्मर को प्रशिक्षित करना जितना आप सोचते हैं उससे कहीं अधिक आसान है

    1,706+2पिछले 7 दिनों में स्टार का बदलाव
  • ImageReward@zai-org

    [NeurIPS 2023] ImageReward: टेक्स्ट-टू-इमेज जनरेशन के लिए मानवीय प्राथमिकताओं को सीखना और मूल्यांकन करना

    1,703+1पिछले 7 दिनों में स्टार का बदलाव
  • MMaDA@Gen-Verse

    MMaDA - ओपन-सोर्स्ड मल्टीमॉडल लार्ज डिफ्यूज़न लैंग्वेज मॉडल्स (ब्लॉक डिफ्यूज़न, मिक्स्ड-CoT, यूनिफाइड RL के साथ dLLMs)

    1,671+1पिछले 7 दिनों में स्टार का बदलाव
  • RL में Diffusion Model संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)

    1,635+2पिछले 7 दिनों में स्टार का बदलाव
  • fantasy-talking@Fantasy-AMAP

    [ACM MM 2025] FantasyTalking: सुसंगत गति संश्लेषण के माध्यम से यथार्थवादी टॉकिंग पोर्ट्रेट जनरेशन

    1,628+0पिछले 7 दिनों में स्टार का बदलाव
  • Magic123@guochengqian

    [ICLR'24] Magic123 का आधिकारिक PyTorch कार्यान्वयन: 2D और 3D डिफ्यूजन प्रायोर का उपयोग करके एक इमेज से उच्च-गुणवत्ता वाला 3D ऑब्जेक्ट जनरेशन

    1,622-1पिछले 7 दिनों में स्टार का बदलाव
  • MIMO@menyifang

    "MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling" का आधिकारिक कार्यान्वयन

    1,579+1पिछले 7 दिनों में स्टार का बदलाव
  • DiffDock@gcorso

    DiffDock का कार्यान्वयन: आणविक डॉकिंग के लिए डिफ्यूजन चरण, मोड़ और घुमाव।

    1,570-1पिछले 7 दिनों में स्टार का बदलाव
  • Generative_Deep_Learning_2nd_Edition@davidADSP

    O'Reilly पुस्तक Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play के दूसरे संस्करण के लिए आधिकारिक कोड रिपॉजिटरी

    1,553+3पिछले 7 दिनों में स्टार का बदलाव
  • LanPaint@scraed

    प्रत्येक स्टेबल डिफ़्यूज़न मॉडल के लिए उच्च गुणवत्ता वाली ट्रेनिंग-मुक्त इनपेंट। ComfyUI का समर्थन करता है

    1,372+4पिछले 7 दिनों में स्टार का बदलाव
  • TeaCache@ali-vilab

    Timestep Embedding Tells: वीडियो डिफ्यूजन मॉडल के लिए कैश करने का समय आ गया है

    1,371+2पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस