reinforcement-learning
reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #121
Rainbow is all you need! DQN से Rainbow तक का चरण-दर-चरण ट्यूटोरियल
★ 2,032+0पिछले 7 दिनों में स्टार का बदलाव - #122★ 2,025+4पिछले 7 दिनों में स्टार का बदलाव
- #123
Keras के साथ उन्नत डीप लर्निंग, Packt द्वारा प्रकाशित
★ 2,023+0पिछले 7 दिनों में स्टार का बदलाव - #124
NVIDIA Nemotron के लिए डेवलपर एसेट हब — Nemotron मॉडल के साथ निर्माण के लिए ट्रेनिंग रेसिपी, उपयोग कुकबुक, डेटासेट और पूर्ण एंड-टू-एंड संदर्भ उदाहरणों के लिए एक वन-स्टॉप संसाधन
★ 2,015+18पिछले 7 दिनों में स्टार का बदलाव - #125
🚀 मुफ़्त AI संसाधन - 🎓 पाठ्यक्रम, 👷 नौकरियां, 📝 ब्लॉग, 🔬 AI अनुसंधान, और बहुत कुछ - सभी के लिए!
★ 1,975+9पिछले 7 दिनों में स्टार का बदलाव - #126★ 1,972+1पिछले 7 दिनों में स्टार का बदलाव
- #127
सरल तरीके से सभी RL एल्गोरिदम का कार्यान्वयन
★ 1,929+7पिछले 7 दिनों में स्टार का बदलाव - #128
रीइन्फोर्समेंट लर्निंग एजेंट या सरल नियम-आधारित एल्गोरिदम को प्रशिक्षित करने के लिए ट्रेडिंग और बैकटेस्टिंग वातावरण।
★ 1,915+2पिछले 7 दिनों में स्टार का बदलाव - #129
RoboVerse: स्केलेबल और सामान्यीकृत रोबोट लर्निंग के लिए एक एकीकृत प्लेटफ़ॉर्म, डेटासेट और बेंचमार्क की ओर
★ 1,851+11पिछले 7 दिनों में स्टार का बदलाव - #130
सीखنے और डाउनलोड करने के लिए कुछ बेहतरीन AI से संबंधित किताबें और PDF, साथ ही सीखने के लिए कुछ प्लेग्राउंड मॉडल लागू करना।
★ 1,799+2पिछले 7 दिनों में स्टार का बदलाव - #131★ 1,789+1पिछले 7 दिनों में स्टार का बदलाव
- #132★ 1,722+0पिछले 7 दिनों में स्टार का बदलाव
- #133
AgiBot X1 के लिए सुदृढीकरण शिक्षण (reinforcement learning) प्रशिक्षण कोड।
★ 1,698-1पिछले 7 दिनों में स्टार का बदलाव - #134★ 1,695+0पिछले 7 दिनों में स्टार का बदलाव
- #135
डीप न्यूरोइवोल्यूशन
★ 1,666-1पिछले 7 दिनों में स्टार का बदलाव - #136
[NeurIPS 2023 Spotlight] LightZero: सामान्य अनुक्रमिक निर्णय परिदृश्यों में Monte Carlo Tree Search के लिए एक एकीकृत बेंचमार्क (awesome MCTS)
★ 1,642+4पिछले 7 दिनों में स्टार का बदलाव - #137
Safe RLHF: Safe Reinforcement Learning from Human Feedback के माध्यम से प्रतिबंधित वैल्यू एलाइनमेंट
★ 1,613+1पिछले 7 दिनों में स्टार का बदलाव - #138
[IEEE RA-L'25] NavRL: गतिशील वातावरण में सुरक्षित उड़ान सीखना (NVIDIA Isaac/Python/ROS1/ROS2)
★ 1,599+7पिछले 7 दिनों में स्टार का बदलाव - #139
एक ओपन सोर्स पैकेज जो वीडियो गेम निर्माताओं, AI शोधकर्ताओं और शौक रखने वालों को अपने नॉन प्लेयर कैरेक्टर या एजेंटों के लिए जटिल व्यवहार सीखने का अवसर देता है
★ 1,578+1पिछले 7 दिनों में स्टार का बदलाव - #140
मुफ्त कोर्स जो आपको शून्य से Reinforcement Learning PRO तक ले जाता है 🦸🏻🦸🏽
★ 1,570+0पिछले 7 दिनों में स्टार का बदलाव - #141
AgentEvolver: कुशल स्व-विकसित एजेंट सिस्टम की ओर
★ 1,552+3पिछले 7 दिनों में स्टार का बदलाव - #142
🚀🀄️ रीइची माहजोंग के लिए एक तेज़ और शक्तिशाली AI, जो Rust और डीप रीइंफोर्समेंट लर्निंग द्वारा संचालित है।
★ 1,539+8पिछले 7 दिनों में स्टार का बदलाव - #143
सर्वश्रेष्ठ आर्टिफिशियल इंटेलिजेंस संसाधनों की एक क्यूरेटेड सूची
★ 1,522+2पिछले 7 दिनों में स्टार का बदलाव - #144
सामान्य RL वातावरण के लिए C++ आधारित उच्च-प्रदर्शन समानांतर वातावरण निष्पादन इंजन (वेक्टराइज्ड env)।
★ 1,513+2पिछले 7 दिनों में स्टार का बदलाव - #145
डीप RL और AI के भविष्य के लिए।
★ 1,513+0पिछले 7 दिनों में स्टार का बदलाव - #146
[NeurIPS 2025 Spotlight] सत्यापन योग्य पुरस्कारों के साथ सुदृढीकरण सीखने (Reinforcement Learning) के लिए तर्क वातावरण
★ 1,500+3पिछले 7 दिनों में स्टार का बदलाव - #147
रोबोट के लिए उपयोगी बेहतरीन लिंक और सॉफ़्टवेयर लाइब्रेरी की एक क्यूरेटेड सूची।
★ 1,483+3पिछले 7 दिनों में स्टार का बदलाव - #148
एंटरप्राइज़ उपयोग के मामलों के लिए संदर्भ Jupyter नोटबुक और डेमो AI/ML एप्लिकेशन का एक संग्रह: मार्केटिंग, प्राइसिंग, सप्लाई चेन, स्मार्ट मैन्युफैक्चरिंग और बहुत कुछ।
★ 1,453+1पिछले 7 दिनों में स्टार का बदलाव - #149
TextWorld टेक्स्ट-आधारित गेम पर रीइंफोर्समेंट लर्निंग (RL) एजेंटों के प्रशिक्षण और मूल्यांकन के लिए एक सैंडबॉक्स शिक्षण वातावरण है।
★ 1,442+1पिछले 7 दिनों में स्टार का बदलाव - #150
Unitree Go1 रोबोट के लिए Sim-to-real RL ट्रेनिंग और डिप्लॉयमेंट टूल।
★ 1,440+0पिछले 7 दिनों में स्टार का बदलाव