reinforcement-learning-algorithms
reinforcement-learning-algorithms टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर reinforcement-learning-algorithms के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और reinforcement-learning-algorithms टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
Stable Baselines का PyTorch वर्शन, सुदृढीकरण शिक्षण (reinforcement learning) एल्गोरिदम के विश्वसनीय कार्यान्वयन।
★ 13,758+21पिछले 7 दिनों में स्टार का बदलाव - #2
डीप रेनफोर्समेंट लर्निंग नैनोडग्री प्रोग्राम के लिए रिपॉजिटरी
★ 5,176+0पिछले 7 दिनों में स्टार का बदलाव - #3
OpenDILab डिसीजन AI इंजन। सबसे व्यापक सुदृढीकरण शिक्षण (Reinforcement Learning) फ्रेमवर्क बी.पी.
★ 3,642+1पिछले 7 दिनों में स्टार का बदलाव - #4
PyTorch में क्लिप्ड ऑब्जेक्टिव Proximal Policy Optimization (PPO) का न्यूनतम कार्यान्वयन
★ 2,381+6पिछले 7 दिनों में स्टार का बदलाव - #5
अद्भुत मॉडल आधारित RL संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)
★ 1,393+0पिछले 7 दिनों में स्टार का बदलाव - #6
एक सरल और अच्छी तरह से स्टाइल किया गया PPO कार्यान्वयन। मेरी Medium श्रृंखला पर आधारित: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8
★ 1,269+1पिछले 7 दिनों में स्टार का बदलाव - #7★ 1,114+3पिछले 7 दिनों में स्टार का बदलाव
- #8★ 1,102+2पिछले 7 दिनों में स्टार का बदलाव
- #9
UI-Venus एक नेटिव UI एजेंट है जिसे केवल स्क्रीनशॉट का उपयोग करके सटीक GUI एलिमेंट ग्राउंडिंग और प्रभावी नेविगेशन करने के लिए डिज़ाइन किया गया है।
★ 1,037+23पिछले 7 दिनों में स्टार का बदलाव - #10
Decision Transformer संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)
★ 916+0पिछले 7 दिनों में स्टार का बदलाव - #11
NMA डीप लर्निंग कोर्स
★ 812+1पिछले 7 दिनों में स्टार का बदलाव - #12
Julia में MDPs और POMDPs - डिस्क्रीट और कंटीन्यूअस स्पेस पर पूरी तरह से और आंशिक रूप से अवलोकनीय मार्कोव निर्णय प्रक्रियाओं को परिभाषित करने, हल करने और सिम्युलेट करने के लिए एक इंटरफ़ेस।
★ 766+1पिछले 7 दिनों में स्टार का बदलाव - #13
Stable-Baselines3 के लिए कॉन्ट्रिब पैकेज - प्रयोगात्मक रीइन्फोर्समेंट लर्निंग (RL) कोड
★ 736+5पिछले 7 दिनों में स्टार का बदलाव - #14
यह UAV के लिए डीप रीइन्फोर्समेंट लर्निंग ऑटोनॉमस ऑब्सटैकल अवॉइडेंस एल्गोरिदम के बारे में एक प्रोजेक्ट है।
★ 730+0पिछले 7 दिनों में स्टार का बदलाव - #15
Nature प्रकाशन "Discovering State-of-the-art Reinforcement Algorithms" के लिए सहायक कोड
★ 728+2पिछले 7 दिनों में स्टार का बदलाव - #16
बेहतरीन एक्सप्लोरेशन RL संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)
★ 723+0पिछले 7 दिनों में स्टार का बदलाव - #17
पेपर के लिए कोड "Computation Offloading Optimization for UAV-assisted Mobile Edge Computing: A Deep Deterministic Policy Gradient Approach"
★ 722+1पिछले 7 दिनों में स्टार का बदलाव - #18
🤖 रोबोट लर्निंग फ्रॉम डेमोंस्ट्रेशन और रोबोट मैनिपुलेशन के लिए फुल प्रोसेस Python पैकेज
★ 720+1पिछले 7 दिनों में स्टार का बदलाव - #19
इम्प्लीमेंटेशन के साथ मोंटे कार्लो ट्री सर्च पेपर्स की एक क्यूरेटेड सूची
★ 715+1पिछले 7 दिनों में स्टार का बदलाव - #20
डीप रीइन्फोर्समेंट लर्निंग एजेंट्स बनाने के लिए एक PyTorch लाइब्रेरी।
★ 657+0पिछले 7 दिनों में स्टार का बदलाव - #21
[ICLR 2026] TraceRL के लिए आधिकारिक कोड: Diffusion LLMs के लिए पोस्ट-ट्रेनिंग में क्रांति, जो SOTA TraDo सीरीज़ को संचालित करता है।
★ 520+1पिछले 7 दिनों में स्टार का बदलाव