मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · reinforcement-learning-algorithms

reinforcement-learning-algorithms

reinforcement-learning-algorithms टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
21
कुल स्टार
39,604
औसत स्टार
1,886
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर reinforcement-learning-algorithms के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और reinforcement-learning-algorithms टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • Stable Baselines का PyTorch वर्शन, सुदृढीकरण शिक्षण (reinforcement learning) एल्गोरिदम के विश्वसनीय कार्यान्वयन।

    13,758+21पिछले 7 दिनों में स्टार का बदलाव
  • deep-reinforcement-learning@udacity

    डीप रेनफोर्समेंट लर्निंग नैनोडग्री प्रोग्राम के लिए रिपॉजिटरी

    5,176+0पिछले 7 दिनों में स्टार का बदलाव
  • DI-engine@opendilab

    OpenDILab डिसीजन AI इंजन। सबसे व्यापक सुदृढीकरण शिक्षण (Reinforcement Learning) फ्रेमवर्क बी.पी.

    3,642+1पिछले 7 दिनों में स्टार का बदलाव
  • PPO-PyTorch@nikhilbarhate99

    PyTorch में क्लिप्ड ऑब्जेक्टिव Proximal Policy Optimization (PPO) का न्यूनतम कार्यान्वयन

    2,381+6पिछले 7 दिनों में स्टार का बदलाव
  • अद्भुत मॉडल आधारित RL संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)

    1,393+0पिछले 7 दिनों में स्टार का बदलाव
  • PPO-for-Beginners@ericyangyu

    एक सरल और अच्छी तरह से स्टाइल किया गया PPO कार्यान्वयन। मेरी Medium श्रृंखला पर आधारित: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8

    1,269+1पिछले 7 दिनों में स्टार का बदलाव
  • ARPO@RUC-NLPIR

    [ICLR 2026] एजेंटिक रीइन्फोर्स्ड पॉलिसी ऑप्टिमाइज़ेशन (ARPO)

    1,114+3पिछले 7 दिनों में स्टार का बदलाव
  • purejaxrl@luchris429

    अत्यंत तेज़ एंड-टू-एंड Jax RL कार्यान्वयन

    1,102+2पिछले 7 दिनों में स्टार का बदलाव
  • UI-Venus@inclusionAI

    UI-Venus एक नेटिव UI एजेंट है जिसे केवल स्क्रीनशॉट का उपयोग करके सटीक GUI एलिमेंट ग्राउंडिंग और प्रभावी नेविगेशन करने के लिए डिज़ाइन किया गया है।

    1,037+23पिछले 7 दिनों में स्टार का बदलाव
  • Decision Transformer संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)

    916+0पिछले 7 दिनों में स्टार का बदलाव
  • course-content-dl@NeuromatchAcademy

    NMA डीप लर्निंग कोर्स

    812+1पिछले 7 दिनों में स्टार का बदलाव
  • POMDPs.jl@JuliaPOMDP

    Julia में MDPs और POMDPs - डिस्क्रीट और कंटीन्यूअस स्पेस पर पूरी तरह से और आंशिक रूप से अवलोकनीय मार्कोव निर्णय प्रक्रियाओं को परिभाषित करने, हल करने और सिम्युलेट करने के लिए एक इंटरफ़ेस।

    766+1पिछले 7 दिनों में स्टार का बदलाव
  • stable-baselines3-contrib@Stable-Baselines-Team

    Stable-Baselines3 के लिए कॉन्ट्रिब पैकेज - प्रयोगात्मक रीइन्फोर्समेंट लर्निंग (RL) कोड

    736+5पिछले 7 दिनों में स्टार का बदलाव
  • यह UAV के लिए डीप रीइन्फोर्समेंट लर्निंग ऑटोनॉमस ऑब्सटैकल अवॉइडेंस एल्गोरिदम के बारे में एक प्रोजेक्ट है।

    730+0पिछले 7 दिनों में स्टार का बदलाव
  • disco_rl@google-deepmind

    Nature प्रकाशन "Discovering State-of-the-art Reinforcement Algorithms" के लिए सहायक कोड

    728+2पिछले 7 दिनों में स्टार का बदलाव
  • बेहतरीन एक्सप्लोरेशन RL संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)

    723+0पिछले 7 दिनों में स्टार का बदलाव
  • UAV-DDPG@fangvv

    पेपर के लिए कोड "Computation Offloading Optimization for UAV-assisted Mobile Edge Computing: A Deep Deterministic Policy Gradient Approach"

    722+1पिछले 7 दिनों में स्टार का बदलाव
  • Rofunc@Skylark0924

    🤖 रोबोट लर्निंग फ्रॉम डेमोंस्ट्रेशन और रोबोट मैनिपुलेशन के लिए फुल प्रोसेस Python पैकेज

    720+1पिछले 7 दिनों में स्टार का बदलाव
  • इम्प्लीमेंटेशन के साथ मोंटे कार्लो ट्री सर्च पेपर्स की एक क्यूरेटेड सूची

    715+1पिछले 7 दिनों में स्टार का बदलाव
  • डीप रीइन्फोर्समेंट लर्निंग एजेंट्स बनाने के लिए एक PyTorch लाइब्रेरी।

    657+0पिछले 7 दिनों में स्टार का बदलाव
  • dLLM-RL@Gen-Verse

    [ICLR 2026] TraceRL के लिए आधिकारिक कोड: Diffusion LLMs के लिए पोस्ट-ट्रेनिंग में क्रांति, जो SOTA TraDo सीरीज़ को संचालित करता है।

    520+1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस