मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें

TianhongDai/reinforcement-learning-algorithms

@TianhongDai

इस रिपॉजिटरी में क्लासिक डीप रीइन्फोर्समेंट लर्निंग एल्गोरिदम के अधिकांश PyTorch कार्यान्वयन शामिल हैं, जिनमें DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO शामिल हैं। (अन्य एल्गोरिदम पर काम जारी है)

स्टार
697
फ़ोर्क
110
भाषा
Python
लाइसेंस
आख़िरी push
9 माह पहले
Pythondeep-learningdeep-reinforcement-learningpytorchalgorithmppoproximal-policy-optimizationsacsoft-actor-critica2cddpgdqnactor-criticatari2600dueling-dqnflappy-birdtrpotrust-region-policy-optimization

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।