deep-reinforcement-learning
deep-reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर deep-reinforcement-learning के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और deep-reinforcement-learning टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
Unity Machine Learning Agents Toolkit (ML-Agents) एक ओपन-सोर्स प्रोजेक्ट है जो गेम्स और सिमुलेशन को गहरे सुदृढीकरण सीखने (deep reinforcement learning) और अनुकरण सीखने (imitation learning) का उपयोग करके बुद्धिमान एजेंटों को प्रशिक्षित करने के लिए वातावरण के रूप में काम करने में सक्षम बनाता है।
★ 19,655+2पिछले 7 दिनों में स्टार का बदलाव - #2
Microsoft AI & Research द्वारा Unreal Engine / Unity पर बनाया गया स्वायत्त वाहनों के लिए ओपन सोर्स सिमुलेटर
★ 18,434+8पिछले 7 दिनों में स्टार का बदलाव - #3★ 16,200+52पिछले 7 दिनों में स्टार का बदलाव
- #4
रिइनफोर्समेंट लर्निंग चीनी ट्यूटोरियल (मशरूम बुक 🍄), ऑनलाइन पढ़ने का पता: https://datawhalechina.github.io/easy-rl/
★ 14,600+8पिछले 7 दिनों में स्टार का बदलाव - #5★ 14,352+17पिछले 7 दिनों में स्टार का बदलाव
- #6
इन रोमांचक व्याख्यानों से सीखकर डीप लर्निंग, सुदृढीकरण लर्निंग, मशीन लर्निंग, कंप्यूटर विजन और NLP में डूब जाएं!!
★ 12,939+3पिछले 7 दिनों में स्टार का बदलाव - #7
MIT Deep Learning से संबंधित पाठ्यक्रमों के लिए ट्यूटोरियल, असाइनमेंट और प्रतियोगिताएं।
★ 10,453-1पिछले 7 दिनों में स्टार का बदलाव - #8
अनुसंधान-अनुकूल सुविधाओं (PPO, DQN, C51, DDPG, TD3, SAC, PPG) के साथ डीप रीइंफोर्समेंट लर्निंग एल्गोरिदम का उच्च-गुणवत्ता वाला सिंगल-फ़ाइल कार्यान्वयन
★ 10,358+19पिछले 7 दिनों में स्टार का बदलाव - #9
(⌐■_■) - WiFi pwning के लिए bettercap को इंस्ट्रूमेंट करने वाला Deep Reinforcement Learning।
★ 9,193+1पिछले 7 दिनों में स्टार का बदलाव - #10
MIT 6.S191 के लिए लैब सामग्री: डीप लर्निंग का परिचय
★ 8,770+8पिछले 7 दिनों में स्टार का बदलाव - #11
डीप रीइंफोर्समेंट लर्निंग (डीप Q-learning) का उपयोग करके Flappy Bird हैक।
★ 6,819+0पिछले 7 दिनों में स्टार का बदलाव - #12
वास्तविक दुनिया में रीइंफोर्समेंट लर्निंग पर एक कोर्स
★ 6,566+0पिछले 7 दिनों में स्टार का बदलाव - #13
डीप रेनफोर्समेंट लर्निंग नैनोडग्री प्रोग्राम के लिए रिपॉजिटरी
★ 5,176+0पिछले 7 दिनों में स्टार का बदलाव - #14
इस रिपॉजिटरी में Hugging Face डीप रीइन्फोर्समेंट लर्निंग कोर्स शामिल है।
★ 5,006+10पिछले 7 दिनों में स्टार का बदलाव - #15
"लार्ज लैंग्वेज मॉडल" लेखक: झाओ शिन, ली जुनिई, झोउ कुन, तांग तियानयी, वेन जिरोंग
★ 4,557+3पिछले 7 दिनों में स्टार का बदलाव - #16
ह्यूमन फीडबैक के साथ रीइंफोर्समेंट लर्निंग संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)
★ 4,424+2पिछले 7 दिनों में स्टार का बदलाव - #17
न्यूनतम और स्वच्छ रिइंफोर्समेंट लर्निंग उदाहरण
★ 3,660+0पिछले 7 दिनों में स्टार का बदलाव - #18
FinRL-X: मात्रात्मक व्यापार के लिए एक AI-नेटिव मॉड्यूलर बुनियादी ढांचा
★ 3,657+50पिछले 7 दिनों में स्टार का बदलाव - #19
ताश (पॉकर) गेम में सुदृढीकरण सीखना / AI बॉट्स - ब्लैकजैक, लेड्यूक, टेक्सास, डौडिझू, माजोंग, यूएनओ।
★ 3,541+0पिछले 7 दिनों में स्टार का बदलाव - #20★ 3,452+3पिछले 7 दिनों में स्टार का बदलाव
- #21
लोकप्रिय Deep Reinforcement Learning (DRL) एल्गोरिदम का स्वच्छ, मजबूत और एकीकृत PyTorch कार्यान्वयन (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)
★ 3,440+3पिछले 7 दिनों में स्टार का बदलाव - #22
Tensorforce: एप्लाइड सुदृढीकरण सीखने (reinforcement learning) के लिए एक TensorFlow लाइब्रेरी
★ 3,305+0पिछले 7 दिनों में स्टार का बदलाव - #23★ 3,197+1पिछले 7 दिनों में स्टार का बदलाव
- #24
विभिन्न प्रकार के कार्यों और वातावरणों में एम्बॉडीड AI एजेंटों को प्रशिक्षित करने के लिए एक मॉड्यूलर हाई-लेवल लाइब्रेरी।
★ 3,117+6पिछले 7 दिनों में स्टार का बदलाव - #25
हाइपरपैरामीटर ऑप्टिमाइज़ेशन और प्री-ट्रेन किए गए एजेंटों के साथ Stable Baselines3 रीइंफोर्समेंट लर्निंग एजेंटों के लिए एक ट्रेनिंग फ्रेमवर्क।
★ 2,873+1पिछले 7 दिनों में स्टार का बदलाव - #26
MuZero
★ 2,865+2पिछले 7 दिनों में स्टार का बदलाव - #27
PPO x Family DRL ट्यूटोरियल कोर्स (निर्णय इंटेलिजेंस शुरुआती स्तर का सार्वजनिक कोर्स: एल्गोरिदम सिद्धांत को समझने, कोड लॉजिक को व्यवस्थित करने और निर्णय AI अनुप्रयोगों का अभ्यास करने में आपकी मदद करने के लिए 8 कक्षाएं)
★ 2,616+2पिछले 7 दिनों में स्टार का बदलाव - #28
PyTorch में क्लिप्ड ऑब्जेक्टिव Proximal Policy Optimization (PPO) का न्यूनतम कार्यान्वयन
★ 2,381+6पिछले 7 दिनों में स्टार का बदलाव - #29★ 2,293+0पिछले 7 दिनों में स्टार का बदलाव
- #30
FinRL-Meta: FinRL के लिए गतिशील डेटासेट और मार्केट वातावरण।
★ 1,934+4पिछले 7 दिनों में स्टार का बदलाव