मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · reinforcement-learning

reinforcement-learning

reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

304 रिपॉजिटरी
  • tdmpc2@nicklashansen

    "TD-MPC2: Scalable, Robust World Models for Continuous Control" के लिए कोड

    943+6पिछले 7 दिनों में स्टार का बदलाव
  • UniRL@Tencent-Hunyuan

    UniRL यूनिफाइड मल्टीमॉडल मॉडल रीइन्फोर्समेंट लर्निंग के लिए एक फ्रेमवर्क है

    935+17पिछले 7 दिनों में स्टार का बदलाव
  • Mava@instadeepai

    JAX में मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग के त्वरित प्रयोग के लिए एक शोध-अनुकूल कोडबेस

    934+2पिछले 7 दिनों में स्टार का बदलाव
  • maro@microsoft

    Multi-Agent Resource Optimization (MARO) प्लेटफ़ॉर्म वास्तविक दुनिया की संसाधन अनुकूलन समस्याओं के लिए Reinforcement Learning as a Service (RaaS) का एक उदाहरण है।

    923+2पिछले 7 दिनों में स्टार का बदलाव
  • डिफ्यूजन मॉडल के बारे में सीखने के लिए प्रमुख शोध पत्रों और ब्लॉगों का सारांश। सभी प्रकाशित डिफ्यूजन रोबोटिक्स शोध पत्रों की विस्तृत सूची

    920+1पिछले 7 दिनों में स्टार का बदलाव
  • UniLab@Motphys

    UniLab: GPU-प्रधान प्रतिमानों से परे रोबोट RL के लिए एक विषम आर्किटेक्चर।

    918+23पिछले 7 दिनों में स्टार का बदलाव
  • safe-control-gym@learnsyslab

    PyBullet CartPole और Quadrotor एनवायरनमेंट—CasADi सिम्बोलिक ए प्रियोरी डायनामिक्स के साथ—लर्निंग-आधारित कंट्रोल और RL के लिए

    917+4पिछले 7 दिनों में स्टार का बदलाव
  • Decision Transformer संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)

    916+0पिछले 7 दिनों में स्टार का बदलाव
  • CARLA संसाधन जैसे ट्यूटोरियल, ब्लॉग, कोड आदि https://github.com/carla-simulator/carla

    915-1पिछले 7 दिनों में स्टार का बदलाव
  • hok_env@tencent-ailab

    Tencent का Honor of Kings AI ओपन एनवायरनमेंट।

    905+1पिछले 7 दिनों में स्टार का बदलाव
  • iris@eloialonso

    Transformers हैं सैंपल-एफिशिएंट वर्ल्ड मॉडल्स। ICLR 2023, उल्लेखनीय शीर्ष 5%।

    900+0पिछले 7 दिनों में स्टार का बदलाव
  • अद्भुत Deep Reinforcement Learning संसाधनों की एक क्यूरेटेड सूची।

    900+1पिछले 7 दिनों में स्टार का बदलाव
  • rl4co@ai4co

    कॉम्बिनेटरियल ऑप्टिमाइज़ेशन (CO) के लिए रीइन्फोर्समेंट लर्निंग (RL) से संबंधित सभी चीज़ों के लिए एक PyTorch लाइब्रेरी।

    900+1पिछले 7 दिनों में स्टार का बदलाव
  • TienKung-Lab@Open-X-Humanoid

    Tien Kung-Lab: पैरों वाले रोबोटों के लिए डायरेक्ट IsaacLab वर्कफ़्लो

    883+11पिछले 7 दिनों में स्टार का बदलाव
  • jumanji@instadeepai

    🕹️ JAX में स्केलेबल सुदृढीकरण शिक्षण (reinforcement learning) वातावरण का एक विविध सूट

    861+2पिछले 7 दिनों में स्टार का बदलाव
  • REINVENT4@MolecularAI

    डी नोवो डिज़ाइन, स्कैफोल्ड हॉपिंग, आर-ग्रुप रिप्लेसमेंट, लिंकर डिज़ाइन और मॉलिक्यूल ऑप्टिमाइज़ेशन के लिए AI मॉलिक्यूलर डिज़ाइन टूल।

    853+3पिछले 7 दिनों में स्टार का बदलाव
  • humanplus@MarkFzp

    [CoRL 2024] HumanPlus: Humanoid Shadowing and Imitation from Humans

    850+0पिछले 7 दिनों में स्टार का बदलाव
  • JaxMARL@bold-lab-ai

    JAX के साथ मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग

    848+3पिछले 7 दिनों में स्टार का बदलाव
  • openrl@OpenRL-Lab

    एकीकृत रीइंफोर्समेंट लर्निंग फ्रेमवर्क

    841+0पिछले 7 दिनों में स्टार का बदलाव
  • 🌟 मशीन लर्निंग, डीप लर्निंग, जेनरेटिव AI, NLP और डेटा साइंस को कवर करने वाले मुफ्त, उच्च गुणवत्ता वाले AI टूल्स, APIs, डेटासेट्स और लर्निंग रिसोर्सेज का संग्रह। डेवलपर्स, शोधकर्ताओं और क्रिएटर्स के लिए AI के साथ तेजी से निर्माण करने हेतु डिज़ाइन किया गया।

    840+27पिछले 7 दिनों में स्टार का बदलाव
  • contextualbandits@david-cortes

    Contextual bandits एल्गोरिदम का Python कार्यान्वयन

    838+0पिछले 7 दिनों में स्टार का बदलाव
  • 🚀🚀🚀 लार्ज लैंग्वेज मॉडल (LLM), विज़न लैंग्वेज मॉडल (VLM), विज़न लैंग्वेज एक्शन (VLA), AI जेनरेटेड कंटेंट (AIGC), और संबंधित डेटासेट व एप्लिकेशन के बारे में कुछ बेहतरीन सार्वजनिक प्रोजेक्ट्स का संग्रह।

    815+1पिछले 7 दिनों में स्टार का बदलाव
  • यह रिपॉजिटरी सुरक्षित रीइनफोर्समेंट लर्निंग बेसलाइन के लिए है।

    813+0पिछले 7 दिनों में स्टार का बदलाव
  • awesome-isaac-gym@robotlearning123

    शानदार NVIDIA Isaac Gym फ्रेमवर्क, पेपर, सॉफ्टवेयर और संसाधनों की एक क्यूरेटेड सूची

    797+2पिछले 7 दिनों में स्टार का बदलाव
  • लार्ज लैंग्वेज मॉडल्स के ऑन-पॉलिसी डिस्टिलेशन (OPD) के लिए पेपर्स, तकनीकी रिपोर्ट्स, फ्रेमवर्क्स और टूल्स का एक क्यूरेटेड संग्रह

    791+31पिछले 7 दिनों में स्टार का बदलाव
  • mobilegym@Purewhiter

    MobileGym: मोबाइल GUI एजेंट अनुसंधान के लिए एक सत्यापन योग्य और अत्यधिक समानांतर सिमुलेशन प्लेटफॉर्म · ब्राउज़र-होस्टेड Android सिम्युलेटर · सत्यापन योग्य मूल्यांकन · स्केलेबल ऑनलाइन RL प्रशिक्षण

    786+10पिछले 7 दिनों में स्टार का बदलाव
  • BFM-Zero@LeCAR-Lab

    BFM_Zero: अनसुपरवाइज्ड रीइन्फोर्समेंट लर्निंग का उपयोग करके ह्यूमनॉइड कंट्रोल के लिए एक प्रॉम्प्टेबल बिहेवियरल फाउंडेशन मॉडल

    776+15पिछले 7 दिनों में स्टार का बदलाव
  • POMDPs.jl@JuliaPOMDP

    Julia में MDPs और POMDPs - डिस्क्रीट और कंटीन्यूअस स्पेस पर पूरी तरह से और आंशिक रूप से अवलोकनीय मार्कोव निर्णय प्रक्रियाओं को परिभाषित करने, हल करने और सिम्युलेट करने के लिए एक इंटरफ़ेस।

    766+1पिछले 7 दिनों में स्टार का बदलाव
  • panda-gym@qgallouedec

    PyBullet फिजिक्स इंजन और gymnasium पर आधारित रोबोटिक वातावरण का सेट।

    765+1पिछले 7 दिनों में स्टार का बदलाव
  • स्वायत्त एजेंट बनाने पर हालिया शोध पत्रों का संग्रह। इसमें दो विषय शामिल हैं: RL-आधारित और LLM-आधारित एजेंट।

    760+3पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस