deep-reinforcement-learning
deep-reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #31★ 1,789+0पिछले 7 दिनों में स्टार का बदलाव
- #32
स्टार्स की संख्या के आधार पर सॉर्ट किए गए शीर्ष 200 डीप लर्निंग Github रिपॉजिटरी।
★ 1,775+0पिछले 7 दिनों में स्टार का बदलाव - #33★ 1,684+0पिछले 7 दिनों में स्टार का बदलाव
- #34
RL में Diffusion Model संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)
★ 1,635+0पिछले 7 दिनों में स्टार का बदलाव - #35
मुफ्त कोर्स जो आपको शून्य से Reinforcement Learning PRO तक ले जाता है 🦸🏻🦸🏽
★ 1,570+0पिछले 7 दिनों में स्टार का बदलाव - #36
डीप RL और AI के भविष्य के लिए।
★ 1,513+0पिछले 7 दिनों में स्टार का बदलाव - #37
बड़े पैमाने पर वितरित प्रशिक्षण और ग्रैंड-मास्टर एजेंटों के साथ StarCraft II के लिए एक कृत्रिम बुद्धिमत्ता प्लेटफ़ॉर्म।
★ 1,393+0पिछले 7 दिनों में स्टार का बदलाव - #38
PyTorch में मॉड्यूलर डीप रिइंफोर्समेंट लर्निंग फ्रेमवर्क। पुस्तक "फाउंडेशन ऑफ डीप रिइंफोर्समेंट लर्निंग" की सह-पुस्तकालय (कंपैनियन लाइब्रेरी)।
★ 1,362+0पिछले 7 दिनों में स्टार का बदलाव - #39
ROS Gazebo सिम्युलेटर में मोबाइल रोबोट नेविगेशन के लिए डीप रीइंफोर्समेंट लर्निंग। Twin Delayed Deep Deterministic Policy Gradient (TD3) न्यूरल नेटवर्क का उपयोग करके, एक रोबोट बाधाओं से बचते हुए simulated वातावरण में एक यादृच्छिक लक्ष्य बिंदु पर नेविगेट करना सीखता है।
★ 1,362+0पिछले 7 दिनों में स्टार का बदलाव - #40★ 1,345+0पिछले 7 दिनों में स्टार का बदलाव
- #41
Keras में न्यूनतम Deep Q Learning (DQN और DDQN) कार्यान्वयन
★ 1,329+0पिछले 7 दिनों में स्टार का बदलाव - #42
JMLR: OmniSafe, SafeRL अनुसंधान को गति देने के लिए एक इंफ्रास्ट्रक्चरल फ्रेमवर्क है।
★ 1,150+0पिछले 7 दिनों में स्टार का बदलाव - #43★ 1,103+2पिछले 7 दिनों में स्टार का बदलाव
- #44
यह एक लाइब्रेरी है जो Isaac Gym के माध्यम से दोहरे निपुण हाथ हेरफेर कार्य प्रदान करती है
★ 1,094+3पिछले 7 दिनों में स्टार का बदलाव - #45
SUMO के साथ ट्रैफिक सिग्नल कंट्रोल के लिए रीइंफोर्समेंट लर्निंग वातावरण। Gymnasium, PettingZoo और लोकप्रिय RL लाइब्रेरी के साथ संगत।
★ 1,075+2पिछले 7 दिनों में स्टार का बदलाव - #46
"Reinforcement Learning: Theory and Python Implementation" पुस्तक के लिए सोर्स कोड।
★ 1,033+1पिछले 7 दिनों में स्टार का बदलाव - #47
RLOps के साथ सुदृढीकरण सीखने (reinforcement learning) को सुव्यवस्थित करना। अत्याधुनिक RL एल्गोरिदम और उपकरण, इवोल्यूशनरी हाइपरपैरामीटर ऑप्टिमाइज़ेशन के माध्यम से 10 गुना तेज़ प्रशिक्षण के साथ।
★ 951+3पिछले 7 दिनों में स्टार का बदलाव - #48★ 947+0पिछले 7 दिनों में स्टार का बदलाव
- #49
रीइंफोर्समेंट लर्निंग के लिए Python लाइब्रेरी।
★ 944+0पिछले 7 दिनों में स्टार का बदलाव - #50
अद्भुत Deep Reinforcement Learning संसाधनों की एक क्यूरेटेड सूची।
★ 900+0पिछले 7 दिनों में स्टार का बदलाव - #51
ICLR-20 पेपर "Learning to Explore using Active Neural SLAM" के लिए Pytorch कोड।
★ 851+0पिछले 7 दिनों में स्टार का बदलाव - #52
इस रिपॉजिटरी में क्लासिक डीप रीइन्फोर्समेंट लर्निंग एल्गोरिदम के अधिकांश PyTorch कार्यान्वयन शामिल हैं, जिनमें DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO शामिल हैं। (अन्य एल्गोरिदम पर काम जारी है)
★ 697+1पिछले 7 दिनों में स्टार का बदलाव - #53
डीप रीइन्फोर्समेंट लर्निंग एजेंट्स बनाने के लिए एक PyTorch लाइब्रेरी।
★ 657+0पिछले 7 दिनों में स्टार का बदलाव - #54
Julia के लिए एक रीइन्फोर्समेंट लर्निंग पैकेज।
★ 652-1पिछले 7 दिनों में स्टार का बदलाव - #55★ 591+0पिछले 7 दिनों में स्टार का बदलाव
- #56
इमिटेशन लर्निंग एल्गोरिदम
★ 573-1पिछले 7 दिनों में स्टार का बदलाव - #57
स्टॉक मार्केट डेटा विश्लेषण के लिए एक टूल जो K-लाइन डेटा के आधार पर पेन, सेगमेंट, सेंटर और बाय-सेल पॉइंट्स की गणना करता है।
★ 568+0पिछले 7 दिनों में स्टार का बदलाव - #58★ 568+2पिछले 7 दिनों में स्टार का बदलाव
- #59
ऑटोनॉमस ड्राइविंग (Carla) में डीप रीइन्फोर्समेंट लर्निंग (PPO) [शून्य से]
★ 563-1पिछले 7 दिनों में स्टार का बदलाव - #60★ 519+0पिछले 7 दिनों में स्टार का बदलाव