मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · reinforcement-learning

reinforcement-learning

reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

305 रिपॉजिटरी
  • ChatGPT डेटा संग्रह और अध्ययन, निरंतर अपडेट...

    4,190+1पिछले 7 दिनों में स्टार का बदलाव
  • acme@google-deepmind

    रीइंफोर्समेंट लर्निंग घटकों और एजेंट्स की एक लाइब्रेरी

    4,054+2पिछले 7 दिनों में स्टार का बदलाव
  • fsrs4anki@open-spaced-repetition

    Free Spaced Repetition Scheduler एल्गोरिदम पर आधारित एक आधुनिक Anki कस्टम शेड्यूलिंग

    4,052+1पिछले 7 दिनों में स्टार का बदलाव
  • Andrew-NG-Notes@ashishpatel26

    यह Andrew NG Coursera के हस्तलिखित नोट्स हैं।

    3,808+6पिछले 7 दिनों में स्टार का बदलाव
  • polyaxon@polyaxon

    AI इंफ्रा / AI ऑर्केस्ट्रेशन / AI कंट्रोल प्लेन

    3,727+0पिछले 7 दिनों में स्टार का बदलाव
  • dreamerv3@danijar

    वर्ल्ड मॉडल के माध्यम से विविध डोमेन में महारत हासिल करना

    3,726+12पिछले 7 दिनों में स्टार का बदलाव
  • न्यूनतम और स्वच्छ रिइंफोर्समेंट लर्निंग उदाहरण

    3,660+0पिछले 7 दिनों में स्टार का बदलाव
  • awesome-DeepLearning@PaddlePaddle

    डीप लर्निंग शुरुआती पाठ्यक्रम, उन्नत पाठ्यक्रम, विशेष पाठ्यक्रम, अकादमिक मामले, औद्योगिक अभ्यास मामले, डीप लर्निंग ज्ञान विश्वकोश और साक्षात्कार प्रश्न बैंक।

    3,651+2पिछले 7 दिनों में स्टार का बदलाव
  • DI-engine@opendilab

    OpenDILab डिसीजन AI इंजन। सबसे व्यापक सुदृढीकरण शिक्षण (Reinforcement Learning) फ्रेमवर्क बी.पी.

    3,642+1पिछले 7 दिनों में स्टार का बदलाव
  • AlphaZero_Gomoku@junxiaosong

    गोमोकू (जिसे गोबांग या फाइव इन ए रो भी कहा जाता है) के लिए AlphaZero एल्गोरिदम का एक कार्यान्वयन।

    3,627+2पिछले 7 दिनों में स्टार का बदलाव
  • Reco-papers@wzhe06

    सिफारिश पर क्लासिक पेपर और संसाधन

    3,568+1पिछले 7 दिनों में स्टार का बदलाव
  • ml-course@girafe-ai

    ओपन मशीन लर्निंग कोर्स

    3,545+4पिछले 7 दिनों में स्टार का बदलाव
  • rl@pytorch

    रिइंफोर्समेंट लर्निंग के लिए एक मॉड्यूलर, प्रिमिटिव-फर्स्ट, पाइथन-फर्स्ट PyTorch लाइब्रेरी।

    3,545+5पिछले 7 दिनों में स्टार का बदलाव
  • rlcard@datamllab

    ताश (पॉकर) गेम में सुदृढीकरण सीखना / AI बॉट्स - ब्लैकजैक, लेड्यूक, टेक्सास, डौडिझू, माजोंग, यूएनओ।

    3,541+0पिछले 7 दिनों में स्टार का बदलाव
  • PettingZoo@Farama-Foundation

    लोकप्रिय संदर्भ वातावरण और संबंधित यूटिलिटीज के साथ मल्टी-एजेंट सुदृढीकरण सीखने के वातावरण के लिए एक मानक API

    3,503+4पिछले 7 दिनों में स्टार का बदलाव
  • MetaClaw@aiming-lab

    🦞 बस अपने एजेंट से बात करें — यह सीखता है और विकसित (EVOLVES) होता है 🧬।

    3,496-1पिछले 7 दिनों में स्टार का बदलाव
  • tensorwatch@microsoft

    Python मशीन लर्निंग और डेटा साइंस के लिए डिबगिंग, मॉनिटरिंग और विज़ुअलाइज़ेशन

    3,472+1पिछले 7 दिनों में स्टार का बदलाव
  • PARL@PaddlePaddle

    Reinforcement Learning के लिए एक उच्च-प्रदर्शन वितरित प्रशिक्षण ढांचा

    3,454+1पिछले 7 दिनों में स्टार का बदलाव
  • DRL-Pytorch@XinJingHao

    लोकप्रिय Deep Reinforcement Learning (DRL) एल्गोरिदम का स्वच्छ, मजबूत और एकीकृत PyTorch कार्यान्वयन (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)

    3,440+3पिछले 7 दिनों में स्टार का बदलाव
  • catalyst@catalyst-team

    त्वरित (accelerated) डीप लर्निंग R&D

    3,382+0पिछले 7 दिनों में स्टार का बदलाव
  • tensorforce@tensorforce

    Tensorforce: एप्लाइड सुदृढीकरण सीखने (reinforcement learning) के लिए एक TensorFlow लाइब्रेरी

    3,305+0पिछले 7 दिनों में स्टार का बदलाव
  • HighwayEnv@Farama-Foundation

    स्वायत्त ड्राइविंग और सामरिक निर्णय लेने के कार्यों के लिए वातावरण का एक संग्रह।

    3,302+3पिछले 7 दिनों में स्टार का बदलाव
  • ManiSkill@mani-skill

    मैनिपुलेशन स्किल फ्रेमवर्क, एक ओपन सोर्स GPU समानांतर रोबोटिक्स सिम्युलेटर और बेंचमार्क

    3,283+13पिछले 7 दिनों में स्टार का बदलाव
  • brax@google

    एक्सीलरेटर हार्डवेयर पर बड़े पैमाने पर समानांतर रिजिडबॉडी भौतिकी सिमुलेशन।

    3,227+1पिछले 7 दिनों में स्टार का बदलाव
  • डेटा साइंस के लिए सावधानीपूर्वक क्यूरेट किए गए संसाधन लिंक एक ही स्थान पर

    3,222+1पिछले 7 दिनों में स्टार का बदलाव
  • Skywork-R1V@SkyworkAI

    Skywork-R1V, Skywork AI द्वारा विकसित एक उन्नत मल्टीमॉडल AI मॉडल श्रृंखला है, जो विजन-लैंग्वेज रीज़निंग में विशेषज्ञता रखती है।

    3,168+0पिछले 7 दिनों में स्टार का बदलाव
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: वास्तविक कंप्यूटर वातावरण में ओपन-एंडेड कार्यों के लिए मल्टीमॉडल एजेंट्स का मूल्यांकन

    3,118+6पिछले 7 दिनों में स्टार का बदलाव
  • habitat-lab@facebookresearch

    विभिन्न प्रकार के कार्यों और वातावरणों में एम्बॉडीड AI एजेंटों को प्रशिक्षित करने के लिए एक मॉड्यूलर हाई-लेवल लाइब्रेरी।

    3,117+6पिछले 7 दिनों में स्टार का बदलाव
  • वीडियो लेक्चर के साथ बेहतरीन मुफ्त Machine Learning और AI कोर्स।

    3,112+0पिछले 7 दिनों में स्टार का बदलाव
  • TradeMaster@TradeMaster-NTU

    TradeMaster रीइंफोर्समेंट लर्निंग द्वारा संचालित क्वांटिटेटिव ट्रेडिंग के लिए एक ओपन-सोर्स प्लेटफॉर्म है :fire: :zap: :rainbow:

    3,056+2पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस