reinforcement-learning
reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #211★ 943+6पिछले 7 दिनों में स्टार का बदलाव
- #212★ 935+17पिछले 7 दिनों में स्टार का बदलाव
- #213
JAX में मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग के त्वरित प्रयोग के लिए एक शोध-अनुकूल कोडबेस
★ 934+2पिछले 7 दिनों में स्टार का बदलाव - #214
Multi-Agent Resource Optimization (MARO) प्लेटफ़ॉर्म वास्तविक दुनिया की संसाधन अनुकूलन समस्याओं के लिए Reinforcement Learning as a Service (RaaS) का एक उदाहरण है।
★ 923+2पिछले 7 दिनों में स्टार का बदलाव - #215
डिफ्यूजन मॉडल के बारे में सीखने के लिए प्रमुख शोध पत्रों और ब्लॉगों का सारांश। सभी प्रकाशित डिफ्यूजन रोबोटिक्स शोध पत्रों की विस्तृत सूची
★ 920+1पिछले 7 दिनों में स्टार का बदलाव - #216★ 918+23पिछले 7 दिनों में स्टार का बदलाव
- #217
PyBullet CartPole और Quadrotor एनवायरनमेंट—CasADi सिम्बोलिक ए प्रियोरी डायनामिक्स के साथ—लर्निंग-आधारित कंट्रोल और RL के लिए
★ 917+4पिछले 7 दिनों में स्टार का बदलाव - #218
Decision Transformer संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)
★ 916+0पिछले 7 दिनों में स्टार का बदलाव - #219
CARLA संसाधन जैसे ट्यूटोरियल, ब्लॉग, कोड आदि https://github.com/carla-simulator/carla
★ 915-1पिछले 7 दिनों में स्टार का बदलाव - #220★ 905+1पिछले 7 दिनों में स्टार का बदलाव
- #221★ 900+0पिछले 7 दिनों में स्टार का बदलाव
- #222
अद्भुत Deep Reinforcement Learning संसाधनों की एक क्यूरेटेड सूची।
★ 900+1पिछले 7 दिनों में स्टार का बदलाव - #223
कॉम्बिनेटरियल ऑप्टिमाइज़ेशन (CO) के लिए रीइन्फोर्समेंट लर्निंग (RL) से संबंधित सभी चीज़ों के लिए एक PyTorch लाइब्रेरी।
★ 900+1पिछले 7 दिनों में स्टार का बदलाव - #224
Tien Kung-Lab: पैरों वाले रोबोटों के लिए डायरेक्ट IsaacLab वर्कफ़्लो
★ 883+11पिछले 7 दिनों में स्टार का बदलाव - #225
🕹️ JAX में स्केलेबल सुदृढीकरण शिक्षण (reinforcement learning) वातावरण का एक विविध सूट
★ 861+2पिछले 7 दिनों में स्टार का बदलाव - #226
डी नोवो डिज़ाइन, स्कैफोल्ड हॉपिंग, आर-ग्रुप रिप्लेसमेंट, लिंकर डिज़ाइन और मॉलिक्यूल ऑप्टिमाइज़ेशन के लिए AI मॉलिक्यूलर डिज़ाइन टूल।
★ 853+3पिछले 7 दिनों में स्टार का बदलाव - #227★ 850+0पिछले 7 दिनों में स्टार का बदलाव
- #228★ 848+3पिछले 7 दिनों में स्टार का बदलाव
- #229★ 841+0पिछले 7 दिनों में स्टार का बदलाव
- #230
🌟 मशीन लर्निंग, डीप लर्निंग, जेनरेटिव AI, NLP और डेटा साइंस को कवर करने वाले मुफ्त, उच्च गुणवत्ता वाले AI टूल्स, APIs, डेटासेट्स और लर्निंग रिसोर्सेज का संग्रह। डेवलपर्स, शोधकर्ताओं और क्रिएटर्स के लिए AI के साथ तेजी से निर्माण करने हेतु डिज़ाइन किया गया।
★ 840+27पिछले 7 दिनों में स्टार का बदलाव - #231
Contextual bandits एल्गोरिदम का Python कार्यान्वयन
★ 838+0पिछले 7 दिनों में स्टार का बदलाव - #232
🚀🚀🚀 लार्ज लैंग्वेज मॉडल (LLM), विज़न लैंग्वेज मॉडल (VLM), विज़न लैंग्वेज एक्शन (VLA), AI जेनरेटेड कंटेंट (AIGC), और संबंधित डेटासेट व एप्लिकेशन के बारे में कुछ बेहतरीन सार्वजनिक प्रोजेक्ट्स का संग्रह।
★ 815+1पिछले 7 दिनों में स्टार का बदलाव - #233
यह रिपॉजिटरी सुरक्षित रीइनफोर्समेंट लर्निंग बेसलाइन के लिए है।
★ 813+0पिछले 7 दिनों में स्टार का बदलाव - #234
शानदार NVIDIA Isaac Gym फ्रेमवर्क, पेपर, सॉफ्टवेयर और संसाधनों की एक क्यूरेटेड सूची
★ 797+2पिछले 7 दिनों में स्टार का बदलाव - #235
लार्ज लैंग्वेज मॉडल्स के ऑन-पॉलिसी डिस्टिलेशन (OPD) के लिए पेपर्स, तकनीकी रिपोर्ट्स, फ्रेमवर्क्स और टूल्स का एक क्यूरेटेड संग्रह
★ 791+31पिछले 7 दिनों में स्टार का बदलाव - #236
MobileGym: मोबाइल GUI एजेंट अनुसंधान के लिए एक सत्यापन योग्य और अत्यधिक समानांतर सिमुलेशन प्लेटफॉर्म · ब्राउज़र-होस्टेड Android सिम्युलेटर · सत्यापन योग्य मूल्यांकन · स्केलेबल ऑनलाइन RL प्रशिक्षण
★ 786+10पिछले 7 दिनों में स्टार का बदलाव - #237
BFM_Zero: अनसुपरवाइज्ड रीइन्फोर्समेंट लर्निंग का उपयोग करके ह्यूमनॉइड कंट्रोल के लिए एक प्रॉम्प्टेबल बिहेवियरल फाउंडेशन मॉडल
★ 776+15पिछले 7 दिनों में स्टार का बदलाव - #238
Julia में MDPs और POMDPs - डिस्क्रीट और कंटीन्यूअस स्पेस पर पूरी तरह से और आंशिक रूप से अवलोकनीय मार्कोव निर्णय प्रक्रियाओं को परिभाषित करने, हल करने और सिम्युलेट करने के लिए एक इंटरफ़ेस।
★ 766+1पिछले 7 दिनों में स्टार का बदलाव - #239★ 765+1पिछले 7 दिनों में स्टार का बदलाव
- #240
स्वायत्त एजेंट बनाने पर हालिया शोध पत्रों का संग्रह। इसमें दो विषय शामिल हैं: RL-आधारित और LLM-आधारित एजेंट।
★ 760+3पिछले 7 दिनों में स्टार का बदलाव