मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · reinforcement-learning

reinforcement-learning

reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

305 रिपॉजिटरी
  • Rainbow is all you need! DQN से Rainbow तक का चरण-दर-चरण ट्यूटोरियल

    2,032+0पिछले 7 दिनों में स्टार का बदलाव
  • AgentFlow@lupantech

    AgentFlow: इन-द-फ्लो एजेंटिक सिस्टम ऑप्टिमाइज़ेशन

    2,025+4पिछले 7 दिनों में स्टार का बदलाव
  • Keras के साथ उन्नत डीप लर्निंग, Packt द्वारा प्रकाशित

    2,023+0पिछले 7 दिनों में स्टार का बदलाव
  • Nemotron@NVIDIA-NeMo

    NVIDIA Nemotron के लिए डेवलपर एसेट हब — Nemotron मॉडल के साथ निर्माण के लिए ट्रेनिंग रेसिपी, उपयोग कुकबुक, डेटासेट और पूर्ण एंड-टू-एंड संदर्भ उदाहरणों के लिए एक वन-स्टॉप संसाधन

    2,015+18पिछले 7 दिनों में स्टार का बदलाव
  • 🚀 मुफ़्त AI संसाधन - 🎓 पाठ्यक्रम, 👷 नौकरियां, 📝 ब्लॉग, 🔬 AI अनुसंधान, और बहुत कुछ - सभी के लिए!

    1,975+9पिछले 7 दिनों में स्टार का बदलाव
  • PhySO@WassimTenachi

    भौतिक प्रतीकात्मक अनुकूलन

    1,972+1पिछले 7 दिनों में स्टार का बदलाव
  • all-rl-algorithms@FareedKhan-dev

    सरल तरीके से सभी RL एल्गोरिदम का कार्यान्वयन

    1,929+7पिछले 7 दिनों में स्टार का बदलाव
  • TradingGym@Yvictor

    रीइन्फोर्समेंट लर्निंग एजेंट या सरल नियम-आधारित एल्गोरिदम को प्रशिक्षित करने के लिए ट्रेडिंग और बैकटेस्टिंग वातावरण।

    1,915+2पिछले 7 दिनों में स्टार का बदलाव
  • RoboVerse@RoboVerseOrg

    RoboVerse: स्केलेबल और सामान्यीकृत रोबोट लर्निंग के लिए एक एकीकृत प्लेटफ़ॉर्म, डेटासेट और बेंचमार्क की ओर

    1,851+11पिछले 7 दिनों में स्टार का बदलाव
  • awesome-AI-books@zslucky

    सीखنے और डाउनलोड करने के लिए कुछ बेहतरीन AI से संबंधित किताबें और PDF, साथ ही सीखने के लिए कुछ प्लेग्राउंड मॉडल लागू करना।

    1,799+2पिछले 7 दिनों में स्टार का बदलाव
  • snake@chynl

    AI के साथ स्नेक गेम खेलना।

    1,789+1पिछले 7 दिनों में स्टार का बदलाव
  • tnt@meta-pytorch

    PyTorch ट्रेनिंग टूल्स और यूटिलिटीज के लिए एक हल्की लाइब्रेरी

    1,722+0पिछले 7 दिनों में स्टार का बदलाव
  • agibot_x1_train@AgibotTech

    AgiBot X1 के लिए सुदृढीकरण शिक्षण (reinforcement learning) प्रशिक्षण कोड।

    1,698-1पिछले 7 दिनों में स्टार का बदलाव
  • bindsnet@BindsNET

    PyTorch का उपयोग करके स्पाइकिंग न्यूरल नेटवर्क (SNN) का सिमुलेशन।

    1,695+0पिछले 7 दिनों में स्टार का बदलाव
  • deep-neuroevolution@uber-research

    डीप न्यूरोइवोल्यूशन

    1,666-1पिछले 7 दिनों में स्टार का बदलाव
  • LightZero@opendilab

    [NeurIPS 2023 Spotlight] LightZero: सामान्य अनुक्रमिक निर्णय परिदृश्यों में Monte Carlo Tree Search के लिए एक एकीकृत बेंचमार्क (awesome MCTS)

    1,642+4पिछले 7 दिनों में स्टार का बदलाव
  • safe-rlhf@PKU-Alignment

    Safe RLHF: Safe Reinforcement Learning from Human Feedback के माध्यम से प्रतिबंधित वैल्यू एलाइनमेंट

    1,613+1पिछले 7 दिनों में स्टार का बदलाव
  • NavRL@Zhefan-Xu

    [IEEE RA-L'25] NavRL: गतिशील वातावरण में सुरक्षित उड़ान सीखना (NVIDIA Isaac/Python/ROS1/ROS2)

    1,599+7पिछले 7 दिनों में स्टार का बदलाव
  • godot_rl_agents@edbeeching

    एक ओपन सोर्स पैकेज जो वीडियो गेम निर्माताओं, AI शोधकर्ताओं और शौक रखने वालों को अपने नॉन प्लेयर कैरेक्टर या एजेंटों के लिए जटिल व्यवहार सीखने का अवसर देता है

    1,578+1पिछले 7 दिनों में स्टार का बदलाव
  • hands-on-rl@Paulescu

    मुफ्त कोर्स जो आपको शून्य से Reinforcement Learning PRO तक ले जाता है 🦸🏻‍🦸🏽

    1,570+0पिछले 7 दिनों में स्टार का बदलाव
  • AgentEvolver@modelscope

    AgentEvolver: कुशल स्व-विकसित एजेंट सिस्टम की ओर

    1,552+3पिछले 7 दिनों में स्टार का बदलाव
  • Mortal@Equim-chan

    🚀🀄️ रीइची माहजोंग के लिए एक तेज़ और शक्तिशाली AI, जो Rust और डीप रीइंफोर्समेंट लर्निंग द्वारा संचालित है।

    1,539+8पिछले 7 दिनों में स्टार का बदलाव
  • ai_all_resources@nivu

    सर्वश्रेष्ठ आर्टिफिशियल इंटेलिजेंस संसाधनों की एक क्यूरेटेड सूची

    1,522+2पिछले 7 दिनों में स्टार का बदलाव
  • envpool@sail-sg

    सामान्य RL वातावरण के लिए C++ आधारित उच्च-प्रदर्शन समानांतर वातावरण निष्पादन इंजन (वेक्टराइज्ड env)।

    1,513+2पिछले 7 दिनों में स्टार का बदलाव
  • awesome-deep-rl@tigerneil

    डीप RL और AI के भविष्य के लिए।

    1,513+0पिछले 7 दिनों में स्टार का बदलाव
  • reasoning-gym@open-thought

    [NeurIPS 2025 Spotlight] सत्यापन योग्य पुरस्कारों के साथ सुदृढीकरण सीखने (Reinforcement Learning) के लिए तर्क वातावरण

    1,500+3पिछले 7 दिनों में स्टार का बदलाव
  • रोबोट के लिए उपयोगी बेहतरीन लिंक और सॉफ़्टवेयर लाइब्रेरी की एक क्यूरेटेड सूची।

    1,483+3पिछले 7 दिनों में स्टार का बदलाव
  • tensor-house@ikatsov

    एंटरप्राइज़ उपयोग के मामलों के लिए संदर्भ Jupyter नोटबुक और डेमो AI/ML एप्लिकेशन का एक संग्रह: मार्केटिंग, प्राइसिंग, सप्लाई चेन, स्मार्ट मैन्युफैक्चरिंग और बहुत कुछ।

    1,453+1पिछले 7 दिनों में स्टार का बदलाव
  • TextWorld@microsoft

    TextWorld टेक्स्ट-आधारित गेम पर रीइंफोर्समेंट लर्निंग (RL) एजेंटों के प्रशिक्षण और मूल्यांकन के लिए एक सैंडबॉक्स शिक्षण वातावरण है।

    1,442+1पिछले 7 दिनों में स्टार का बदलाव
  • walk-these-ways@Improbable-AI

    Unitree Go1 रोबोट के लिए Sim-to-real RL ट्रेनिंग और डिप्लॉयमेंट टूल।

    1,440+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस