policy-gradient
policy-gradient टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर policy-gradient के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और policy-gradient टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
रिइनफोर्समेंट लर्निंग चीनी ट्यूटोरियल (मशरूम बुक 🍄), ऑनलाइन पढ़ने का पता: https://datawhalechina.github.io/easy-rl/
★ 14,600+8पिछले 7 दिनों में स्टार का बदलाव - #2★ 10,955+10पिछले 7 दिनों में स्टार का बदलाव
- #3
सरल सुदृढीकरण शिक्षण ट्यूटोरियल, मोफान पाइथन चीनी एआई शिक्षण
★ 9,508-2पिछले 7 दिनों में स्टार का बदलाव - #4
न्यूनतम और स्वच्छ रिइंफोर्समेंट लर्निंग उदाहरण
★ 3,660+0पिछले 7 दिनों में स्टार का बदलाव - #5
PyTorch में क्लिप्ड ऑब्जेक्टिव Proximal Policy Optimization (PPO) का न्यूनतम कार्यान्वयन
★ 2,381+6पिछले 7 दिनों में स्टार का बदलाव - #6
PyTorch में मॉड्यूलर डीप रिइंफोर्समेंट लर्निंग फ्रेमवर्क। पुस्तक "फाउंडेशन ऑफ डीप रिइंफोर्समेंट लर्निंग" की सह-पुस्तकालय (कंपैनियन लाइब्रेरी)।
★ 1,362+0पिछले 7 दिनों में स्टार का बदलाव - #7
इम्प्लीमेंटेशन के साथ मोंटे कार्लो ट्री सर्च पेपर्स की एक क्यूरेटेड सूची
★ 715+1पिछले 7 दिनों में स्टार का बदलाव