मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · image-generation

image-generation

image-generation टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

134 रिपॉजिटरी
  • वेब्यू के बाहर स्टेबल डिफ्यूजन द्वारा जेनरेट की गई छवियों से प्रॉम्प्ट पढ़ने के लिए एक सरल स्टैंडअलोन व्यूअर।

    1,340+0पिछले 7 दिनों में स्टार का बदलाव
  • Lance@bytedance

    छवि और वीडियो को समझने, जनरेट करने और संपादित करने के लिए एक 3B-सक्रिय-पैरामीटर मूल एकीकृत मल्टीमॉडल मॉडल।

    1,334+3पिछले 7 दिनों में स्टार का बदलाव
  • WebAI2API@foxhui

    WebAI2API: Camoufox पर आधारित वेब AI से API टूल, LMArena/Gemini आदि का समर्थन करता है, बहु-विंडो समवर्तीता और खाता अलगाव के साथ।

    1,315+16पिछले 7 दिनों में स्टार का बदलाव
  • airunner@Capsize-Games

    कला, वास्तविक समय की आवाज़ बातचीत, LLM-संचालित चैटबॉट्स और स्वचालित वर्कफ़्लो के लिए ऑफ़लाइन अनुमान इंजन

    1,314+0पिछले 7 दिनों में स्टार का बदलाव
  • data-efficient-gans@mit-han-lab

    [NeurIPS 2020] डेटा-कुशल GAN ट्रेनिंग के लिए डिफ़रेंशिएबल ऑगस्टमेंशन

    1,308+0पिछले 7 दिनों में स्टार का बदलाव
  • Bernini@bytedance

    Bernini वीडियो जनरेशन और संपादन के लिए एक एकीकृत फ्रेमवर्क है जो MLLM-आधारित सिमेंटिक प्लानर को DiT-आधारित रेंडरर के साथ जोड़ता है।

    1,300+10पिछले 7 दिनों में स्टार का बदलाव
  • Inpaint Anything एक्सटेंशन Segment Anything के मास्क का उपयोग करके ब्राउज़र UI पर स्टेबल डिफ़्यूजन इनपेंटिंग करता है।

    1,298+0पिछले 7 दिनों में स्टार का बदलाव
  • MV-Adapter@huanngzh

    [ICCV 2025] "MV-Adapter: Multi-view Consistent Image Generation Made Easy" का आधिकारिक कार्यान्वयन

    1,289+1पिछले 7 दिनों में स्टार का बदलाव
  • webkit का उपयोग करके html को परिवर्तित करके Symfony में आसानी से PDF और छवियां बनाएं

    1,247+0पिछले 7 दिनों में स्टार का बदलाव
  • टर्मिनल से OpenAI के ChatGPT और DALL-E का उपयोग करने के लिए सरल शेल स्क्रिप्ट। किसी Python या JS की आवश्यकता नहीं है।

    1,241+3पिछले 7 दिनों में स्टार का बदलाव
  • इमेज-टू-इमेज ट्रांसलेशन पर बेहतरीन संसाधनों का संग्रह।

    1,239+0पिछले 7 दिनों में स्टार का बदलाव
  • cleanvision@cleanlab

    इमेज डेटासेट में स्वचालित रूप से समस्याएँ खोजें और डेटा-केंद्रित कंप्यूटर विज़न का अभ्यास करें।

    1,199+0पिछले 7 दिनों में स्टार का बदलाव
  • MagicDrive@cure-lab

    [ICLR24] पेपर “MagicDrive: Street View Generation with Diverse 3D Geometry Control” का आधिकारिक कार्यान्वयन

    1,167+1पिछले 7 दिनों में स्टार का बदलाव
  • clean-fid@GaParmar

    PyTorch - उचित छवि रीसाइज़िंग और क्वांटाइजेशन चरणों के साथ FID गणना [CVPR 2022]

    1,167+0पिछले 7 दिनों में स्टार का बदलाव
  • VITON-HD@shadow2496

    "VITON-HD: High-Resolution Virtual Try-On via Misalignment-Aware Normalization" (CVPR 2021) का आधिकारिक PyTorch इम्प्लीमेंटेशन

    1,161+0पिछले 7 दिनों में स्टार का बदलाव
  • Uncensored-Local-Studio@techjarves

    Windows, Linux और macOS के लिए अनसेंसर्ड लोकल AI स्टूडियो। इमेज जनरेशन, GGUF LLMs, टेक्स्ट-टू-स्पीच और स्पीच-टू-टेक्स्ट के लिए जीरो-सेटअप GUI।

    1,118+87पिछले 7 दिनों में स्टार का बदलाव
  • mlx-serve@ddalcu

    Apple Silicon के लिए नेटिव LLM इन्फरेंस सर्वर। OpenAI और Anthropic API के साथ संगत। Python की आवश्यकता नहीं। इसमें चैट, एजेंट मोड और टूल कॉलिंग के साथ MLX Core macOS ऐप शामिल है।

    1,115+245पिछले 7 दिनों में स्टार का बदलाव
  • Guicang का मटीरियल इलस्ट्रेशन स्किल: व्याख्यात्मक टेक्स्ट के साथ इमेज जनरेट करना, चार्ट को बेहतर बनाना और संदर्भ सहायता चित्र।

    1,113+37पिछले 7 दिनों में स्टार का बदलाव
  • CogView4@zai-org

    CogView4, CogView3-Plus और CogView3 (ECCV 2024)।

    1,102+1पिछले 7 दिनों में स्टार का बदलाव
  • image-extender@boona13

    AI के साथ किसी भी छवि को किसी भी दिशा में सहजता से विस्तारित करें। OpenRouter के माध्यम से Gemini द्वारा संचालित ओपन-सोर्स वेब ऐप, जिसमें पॉइसन-ब्लेंडेड सीम्स और बेस्ट-ऑफ-3 वेरिएंट पिकर शामिल है।

    1,100+4पिछले 7 दिनों में स्टार का बदलाव
  • awesome-agent-apis@Anil-matcha

    OpenClaw संसाधनों, उपकरणों, कौशलों, ट्यूटोरियल और लेखों की एक क्यूरेटेड सूची। OpenClaw (पूर्व में Moltbot / Clawdbot) — WhatsApp, Telegram, Discord और 50+ एकीकरणों के लिए ओपन-सोर्स सेल्फ-होस्टेड AI एजेंट।

    1,005+8पिछले 7 दिनों में स्टार का बदलाव
  • हाल के कुछ कंप्यूटर विज़न (CV) कार्यों की पेपर सूची

    973+1पिछले 7 दिनों में स्टार का बदलाव
  • story-iter@UCSC-VLAA

    [ICLR 2026] लंबी कहानी के विज़ुअलाइज़ेशन के लिए एक ट्रेनिंग-मुक्त इटरेटिव फ्रेमवर्क

    957-2पिछले 7 दिनों में स्टार का बदलाव
  • 🎬 3D इंटरैक्टिव कंट्रोल के माध्यम से किसी भी कैमरा व्यू पॉइंट से इमेज जनरेट करें। 3D स्पेस में कैमरे को ड्रैग करें या एज़िमुथ/एलिवेशन/दूरी सेट करने के लिए स्लाइडर्स का उपयोग करें, फिर जनरेट करें। Three.js + Gradio के साथ निर्मित, द्विभाषी ZH/EN UI।

    942+218पिछले 7 दिनों में स्टार का बदलाव
  • HR-VITON@sangyun884

    High-Resolution Virtual Try-On with Misalignment and Occlusion-Handled Conditions (ECCV 2022) पेपर के लिए आधिकारिक PyTorch कार्यान्वयन।

    917+0पिछले 7 दिनों में स्टार का बदलाव
  • AMC-WebUI@yeahhe365

    Gemini के लिए लोकल-फर्स्ट AI वर्कफ़्लो वेबUI, जिसमें मल्टीमॉडल चैट, कैनवास, फ़ाइल प्रोसेसिंग, रीयल-टाइम सर्च, कोड निष्पादन और उन्नत तर्क शामिल हैं।

    895+1पिछले 7 दिनों में स्टार का बदलाव
  • AnyGPT@OpenMOSS

    AnyGPT: डिस्क्रीट सीक्वेंस मॉडलिंग के साथ यूनिफाइड मल्टीमॉडल LLM के लिए कोड

    881-1पिछले 7 दिनों में स्टार का बदलाव
  • codex-slides@nexu-io

    Codex के अंदर ओपन-सोर्स AI स्लाइड स्टूडियो: इमेज-नेटिव डेक, हर स्लाइड एक पूर्ण विज़ुअल कैनवास है। 4-5 मिनट में 10+ उच्च-गुणवत्ता वाली स्लाइड तैयार करें — फास्ट मोड हर पेज को समानांतर में रेंडर करता है। पूरी चेन को लाइव देखें: रिसर्च → आउटलाइन → स्टाइल → रेंडर → एडिट → प्रेजेंट → PDF/PPTX एक्सपोर्ट। ब्राउज़र-फर्स्ट, बिना किसी API की के, टिकाऊ प्रोजेक्ट्स।

    878+23पिछले 7 दिनों में स्टार का बदलाव
  • UniPic@SkyworkAI

    ओपन-सोर्स SOTA मल्टी-इमेज एडिटिंग मॉडल।

    875+1पिछले 7 दिनों में स्टार का बदलाव
  • flatkey-cli@flatkey-ai

    इमेज, वीडियो, ऑडियो, टेक्स्ट, क्रेडिट और मॉडल डिस्कवरी के लिए फ्लैटकी मीडिया जनरेशन CLI।

    845+191पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस