मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · deep-reinforcement-learning

deep-reinforcement-learning

deep-reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

62 रिपॉजिटरी
  • snake@chynl

    AI के साथ स्नेक गेम खेलना।

    1,789+0पिछले 7 दिनों में स्टार का बदलाव
  • Top-Deep-Learning@mbadry1

    स्टार्स की संख्या के आधार पर सॉर्ट किए गए शीर्ष 200 डीप लर्निंग Github रिपॉजिटरी।

    1,775+0पिछले 7 दिनों में स्टार का बदलाव
  • d3rlpy@takuseno

    एक ऑफ़लाइन डीप रीइंफोर्समेंट लर्निंग लाइब्रेरी

    1,684+0पिछले 7 दिनों में स्टार का बदलाव
  • RL में Diffusion Model संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)

    1,635+0पिछले 7 दिनों में स्टार का बदलाव
  • hands-on-rl@Paulescu

    मुफ्त कोर्स जो आपको शून्य से Reinforcement Learning PRO तक ले जाता है 🦸🏻‍🦸🏽

    1,570+0पिछले 7 दिनों में स्टार का बदलाव
  • awesome-deep-rl@tigerneil

    डीप RL और AI के भविष्य के लिए।

    1,513+0पिछले 7 दिनों में स्टार का बदलाव
  • DI-star@opendilab

    बड़े पैमाने पर वितरित प्रशिक्षण और ग्रैंड-मास्टर एजेंटों के साथ StarCraft II के लिए एक कृत्रिम बुद्धिमत्ता प्लेटफ़ॉर्म।

    1,393+0पिछले 7 दिनों में स्टार का बदलाव
  • SLM-Lab@kengz

    PyTorch में मॉड्यूलर डीप रिइंफोर्समेंट लर्निंग फ्रेमवर्क। पुस्तक "फाउंडेशन ऑफ डीप रिइंफोर्समेंट लर्निंग" की सह-पुस्तकालय (कंपैनियन लाइब्रेरी)।

    1,362+0पिछले 7 दिनों में स्टार का बदलाव
  • DRL-robot-navigation@reiniscimurs

    ROS Gazebo सिम्युलेटर में मोबाइल रोबोट नेविगेशन के लिए डीप रीइंफोर्समेंट लर्निंग। Twin Delayed Deep Deterministic Policy Gradient (TD3) न्यूरल नेटवर्क का उपयोग करके, एक रोबोट बाधाओं से बचते हुए simulated वातावरण में एक यादृच्छिक लक्ष्य बिंदु पर नेविगेट करना सीखता है।

    1,362+0पिछले 7 दिनों में स्टार का बदलाव
  • MARLlib@Replicable-MARL

    मल्टी-एजेंट रीइंफोर्समेंट लर्निंग (MARL) के लिए केवल एक रिपॉजिटरी आवश्यक है

    1,345+0पिछले 7 दिनों में स्टार का बदलाव
  • Keras में न्यूनतम Deep Q Learning (DQN और DDQN) कार्यान्वयन

    1,329+0पिछले 7 दिनों में स्टार का बदलाव
  • omnisafe@PKU-Alignment

    JMLR: OmniSafe, SafeRL अनुसंधान को गति देने के लिए एक इंफ्रास्ट्रक्चरल फ्रेमवर्क है।

    1,150+0पिछले 7 दिनों में स्टार का बदलाव
  • purejaxrl@luchris429

    अत्यंत तेज़ एंड-टू-एंड Jax RL कार्यान्वयन

    1,103+2पिछले 7 दिनों में स्टार का बदलाव
  • DexterousHands@PKU-MARL

    यह एक लाइब्रेरी है जो Isaac Gym के माध्यम से दोहरे निपुण हाथ हेरफेर कार्य प्रदान करती है

    1,094+3पिछले 7 दिनों में स्टार का बदलाव
  • sumo-rl@LucasAlegre

    SUMO के साथ ट्रैफिक सिग्नल कंट्रोल के लिए रीइंफोर्समेंट लर्निंग वातावरण। Gymnasium, PettingZoo और लोकप्रिय RL लाइब्रेरी के साथ संगत।

    1,075+2पिछले 7 दिनों में स्टार का बदलाव
  • rl-book@ZhiqingXiao

    "Reinforcement Learning: Theory and Python Implementation" पुस्तक के लिए सोर्स कोड।

    1,033+1पिछले 7 दिनों में स्टार का बदलाव
  • AgileRL@AgileRL

    RLOps के साथ सुदृढीकरण सीखने (reinforcement learning) को सुव्यवस्थित करना। अत्याधुनिक RL एल्गोरिदम और उपकरण, इवोल्यूशनरी हाइपरपैरामीटर ऑप्टिमाइज़ेशन के माध्यम से 10 गुना तेज़ प्रशिक्षण के साथ।

    951+3पिछले 7 दिनों में स्टार का बदलाव
  • GibsonEnv@StanfordVL

    Gibson Environments: एम्बॉडीड एजेंट्स के लिए वास्तविक दुनिया की धारणा।

    947+0पिछले 7 दिनों में स्टार का बदलाव
  • mushroom-rl@MushroomRL

    रीइंफोर्समेंट लर्निंग के लिए Python लाइब्रेरी।

    944+0पिछले 7 दिनों में स्टार का बदलाव
  • अद्भुत Deep Reinforcement Learning संसाधनों की एक क्यूरेटेड सूची।

    900+0पिछले 7 दिनों में स्टार का बदलाव
  • Neural-SLAM@devendrachaplot

    ICLR-20 पेपर "Learning to Explore using Active Neural SLAM" के लिए Pytorch कोड।

    851+0पिछले 7 दिनों में स्टार का बदलाव
  • इस रिपॉजिटरी में क्लासिक डीप रीइन्फोर्समेंट लर्निंग एल्गोरिदम के अधिकांश PyTorch कार्यान्वयन शामिल हैं, जिनमें DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO शामिल हैं। (अन्य एल्गोरिदम पर काम जारी है)

    697+1पिछले 7 दिनों में स्टार का बदलाव
  • डीप रीइन्फोर्समेंट लर्निंग एजेंट्स बनाने के लिए एक PyTorch लाइब्रेरी।

    657+0पिछले 7 दिनों में स्टार का बदलाव
  • ReinforcementLearning.jl@JuliaReinforcementLearning

    Julia के लिए एक रीइन्फोर्समेंट लर्निंग पैकेज।

    652-1पिछले 7 दिनों में स्टार का बदलाव
  • phillip@vladfi1

    SSBM "Phillip" AI।

    591+0पिछले 7 दिनों में स्टार का बदलाव
  • imitation-learning@Kaixhin

    इमिटेशन लर्निंग एल्गोरिदम

    573-1पिछले 7 दिनों में स्टार का बदलाव
  • -chanlun@tomcat123a

    स्टॉक मार्केट डेटा विश्लेषण के लिए एक टूल जो K-लाइन डेटा के आधार पर पेन, सेगमेंट, सेंटर और बाय-सेल पॉइंट्स की गणना करता है।

    568+0पिछले 7 दिनों में स्टार का बदलाव
  • hutb@OpenHUTB

    मानव-वाहन सिम्युलेटर (Human-vehicle Simulator)

    568+2पिछले 7 दिनों में स्टार का बदलाव
  • ऑटोनॉमस ड्राइविंग (Carla) में डीप रीइन्फोर्समेंट लर्निंग (PPO) [शून्य से]

    563-1पिछले 7 दिनों में स्टार का बदलाव
  • DI-sheep@opendilab

    3 Tiles Game + डीप रीइन्फोर्समेंट लर्निंग (Deep Reinforcement Learning)

    519+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस