diffusion-models
diffusion-models टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #61
डिफ्यूजन मॉडल का स्केलेबल और मेमोरी-ऑप्टिमाइज़्ड प्रशिक्षण
★ 1,359+0पिछले 7 दिनों में स्टार का बदलाव - #62
[ICASSP 2024] 🍵 Matcha-TTS: सशर्त प्रवाह मिलान (conditional flow matching) के साथ एक तेज़ TTS आर्किटेक्चर
★ 1,353+3पिछले 7 दिनों में स्टार का बदलाव - #63
[ICLR 2023 Oral] Denoising Diffusion Null-Space Model का उपयोग करके ज़ीरो-शॉट इमेज रेस्टोरेशन
★ 1,351+2पिछले 7 दिनों में स्टार का बदलाव - #64
FireRed-Image-Edit एक शक्तिशाली इमेज एडिटिंग फ़ाउंडेशन मॉडल है जो सटीक निर्देश पालन, उच्च-निष्ठा जनरेशन, बेहतर पहचान निरंतरता और सहज मल्टी-एलिमेंट फ्यूजन के साथ ओपन-सोर्स अत्याधुनिक प्रदर्शन प्राप्त करता है।
★ 1,350+3पिछले 7 दिनों में स्टार का बदलाव - #65
[AAAI 2025]👔IMAGDressing👔: वर्चुअल ड्रेसिंग के लिए इंटरएक्टिव मॉड्यूलर अपैरल जनरेशन।
★ 1,343+0पिछले 7 दिनों में स्टार का बदलाव - #66
[TPAMI 2025🔥] मैजिकटाइम: मेटामॉर्फिक सिमुलेटर्स के रूप में टाइम-लैप्स वीडियो जनरेशन मॉडल
★ 1,337-1पिछले 7 दिनों में स्टार का बदलाव - #67
Windows पर Hunyuan3D 2.0/2.1 चलाने के लिए पोर्टेबल पैकेज। | 混元 3D 2.0/2.1 整合包
★ 1,326+4पिछले 7 दिनों में स्टार का बदलाव - #68
Pruna डेवलपर्स के लिए बनाया गया एक मॉडल ऑप्टिमाइज़ेशन फ्रेमवर्क है, जो आपको न्यूनतम ओवरहेड के साथ तेज़, अधिक कुशल मॉडल डिलीवर करने में सक्षम बनाता है।
★ 1,274+1पिछले 7 दिनों में स्टार का बदलाव - #69
[CVPR 2025 Oral & Best Paper Finalist] Difix3D+: सिंगल-स्टेप डिफ्यूजन मॉडल के साथ 3D रीकंस्ट्रक्शन में सुधार करना
★ 1,267+1पिछले 7 दिनों में स्टार का बदलाव - #70
[CVPR2024, Highlight] DragDiffusion के लिए आधिकारिक कोड
★ 1,259+0पिछले 7 दिनों में स्टार का बदलाव - #71★ 1,238-1पिछले 7 दिनों में स्टार का बदलाव
- #72
HunyuanCustom: कस्टमाइज्ड वीडियो जनरेशन के लिए एक मल्टीमॉडल-संचालित आर्किटेक्चर।
★ 1,228-1पिछले 7 दिनों में स्टार का बदलाव - #73
इमोजी-संचालित स्टाइल नियंत्रण के साथ एक Flow Matching-आधारित Text-to-Speech मॉडल
★ 1,228+4पिछले 7 दिनों में स्टार का बदलाव - #74★ 1,196-1पिछले 7 दिनों में स्टार का बदलाव
- #75
Wunjo CE: Face Swap, Lip Sync, Control Remove Objects & Text & Background, Restyling, Audio Separator, Clone Voice, Video Generation। ओपन-सोर्स, लोकल और मुफ़्त।
★ 1,170+1पिछले 7 दिनों में स्टार का बदलाव - #76
[ICLR24] पेपर “MagicDrive: Street View Generation with Diverse 3D Geometry Control” का आधिकारिक कार्यान्वयन
★ 1,167+1पिछले 7 दिनों में स्टार का बदलाव - #77
टेक्स्ट-टू-इमेज डिफ्यूजन मॉडल के साथ कंट्रोलेबल जनरेशन पर संसाधनों का एक संग्रह।
★ 1,110+0पिछले 7 दिनों में स्टार का बदलाव - #78★ 1,108+3पिछले 7 दिनों में स्टार का बदलाव
- #79
PyTorch में स्क्रैच से कार्यान्वित Stable Diffusion
★ 1,078+0पिछले 7 दिनों में स्टार का बदलाव - #80
[ICLR'24 स्पॉटलाइट] चीनी और अंग्रेजी मल्टीमॉडल लार्ज मॉडल सीरीज़ (चैट और पेंट) | CPM बेस मॉडल पर आधारित चीनी-अंग्रेजी द्विभाषी मल्टीमॉडल लार्ज मॉडल सीरीज़
★ 1,061-1पिछले 7 दिनों में स्टार का बदलाव - #81
[ICLR 2025 Oral] "Diffusion-Based Planning for Autonomous Driving with Flexible Guidance" का आधिकारिक कार्यान्वयन
★ 1,053+4पिछले 7 दिनों में स्टार का बदलाव - #82
[ECCV 2024 Oral] MotionDirector: टेक्स्ट-टू-वीडियो डिफ्यूजन मॉडल का मोशन कस्टमाइजेशन
★ 1,053+2पिछले 7 दिनों में स्टार का बदलाव - #83
[CVPR 2025 Highlight] 3DTopia-XL: प्रिमिटिव डिफ्यूजन के माध्यम से उच्च-गुणवत्ता वाली 3D PBR एसेट जनरेशन
★ 1,046+0पिछले 7 दिनों में स्टार का बदलाव - #84
[ICLR 2024 Spotlight] SyncDreamer: सिंगल-व्यू इमेज से मल्टीव्यू-कंसिस्टेंट इमेज जनरेट करना
★ 1,044-1पिछले 7 दिनों में स्टार का बदलाव - #85
शोध पत्र का आधिकारिक कार्यान्वयन: "FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models"
★ 1,014-1पिछले 7 दिनों में स्टार का बदलाव - #86★ 990+22पिछले 7 दिनों में स्टार का बदलाव
- #87
[CVPR 2024] PIA, आपका वैयक्तिकृत इमेज एनिमेटर। टेक्स्ट प्रॉम्प्ट द्वारा अपनी छवियों को एनिमेट करें, Dreambooth के साथ संयोजन करें, शानदार वीडियो प्राप्त करें।
★ 975+0पिछले 7 दिनों में स्टार का बदलाव - #88★ 970-1पिछले 7 दिनों में स्टार का बदलाव
- #89★ 969+0पिछले 7 दिनों में स्टार का बदलाव
- #90★ 959+60पिछले 7 दिनों में स्टार का बदलाव