reinforcement-learning
reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #61
ChatGPT डेटा संग्रह और अध्ययन, निरंतर अपडेट...
★ 4,190+1पिछले 7 दिनों में स्टार का बदलाव - #62★ 4,054+2पिछले 7 दिनों में स्टार का बदलाव
- #63
Free Spaced Repetition Scheduler एल्गोरिदम पर आधारित एक आधुनिक Anki कस्टम शेड्यूलिंग
★ 4,052+1पिछले 7 दिनों में स्टार का बदलाव - #64
यह Andrew NG Coursera के हस्तलिखित नोट्स हैं।
★ 3,808+6पिछले 7 दिनों में स्टार का बदलाव - #65★ 3,727+0पिछले 7 दिनों में स्टार का बदलाव
- #66★ 3,726+12पिछले 7 दिनों में स्टार का बदलाव
- #67
न्यूनतम और स्वच्छ रिइंफोर्समेंट लर्निंग उदाहरण
★ 3,660+0पिछले 7 दिनों में स्टार का बदलाव - #68
डीप लर्निंग शुरुआती पाठ्यक्रम, उन्नत पाठ्यक्रम, विशेष पाठ्यक्रम, अकादमिक मामले, औद्योगिक अभ्यास मामले, डीप लर्निंग ज्ञान विश्वकोश और साक्षात्कार प्रश्न बैंक।
★ 3,651+2पिछले 7 दिनों में स्टार का बदलाव - #69
OpenDILab डिसीजन AI इंजन। सबसे व्यापक सुदृढीकरण शिक्षण (Reinforcement Learning) फ्रेमवर्क बी.पी.
★ 3,642+1पिछले 7 दिनों में स्टार का बदलाव - #70
गोमोकू (जिसे गोबांग या फाइव इन ए रो भी कहा जाता है) के लिए AlphaZero एल्गोरिदम का एक कार्यान्वयन।
★ 3,627+2पिछले 7 दिनों में स्टार का बदलाव - #71
सिफारिश पर क्लासिक पेपर और संसाधन
★ 3,568+1पिछले 7 दिनों में स्टार का बदलाव - #72★ 3,545+4पिछले 7 दिनों में स्टार का बदलाव
- #73
रिइंफोर्समेंट लर्निंग के लिए एक मॉड्यूलर, प्रिमिटिव-फर्स्ट, पाइथन-फर्स्ट PyTorch लाइब्रेरी।
★ 3,545+5पिछले 7 दिनों में स्टार का बदलाव - #74
ताश (पॉकर) गेम में सुदृढीकरण सीखना / AI बॉट्स - ब्लैकजैक, लेड्यूक, टेक्सास, डौडिझू, माजोंग, यूएनओ।
★ 3,541+0पिछले 7 दिनों में स्टार का बदलाव - #75
लोकप्रिय संदर्भ वातावरण और संबंधित यूटिलिटीज के साथ मल्टी-एजेंट सुदृढीकरण सीखने के वातावरण के लिए एक मानक API
★ 3,503+4पिछले 7 दिनों में स्टार का बदलाव - #76★ 3,496-1पिछले 7 दिनों में स्टार का बदलाव
- #77
Python मशीन लर्निंग और डेटा साइंस के लिए डिबगिंग, मॉनिटरिंग और विज़ुअलाइज़ेशन
★ 3,472+1पिछले 7 दिनों में स्टार का बदलाव - #78★ 3,454+1पिछले 7 दिनों में स्टार का बदलाव
- #79
लोकप्रिय Deep Reinforcement Learning (DRL) एल्गोरिदम का स्वच्छ, मजबूत और एकीकृत PyTorch कार्यान्वयन (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)
★ 3,440+3पिछले 7 दिनों में स्टार का बदलाव - #80★ 3,382+0पिछले 7 दिनों में स्टार का बदलाव
- #81
Tensorforce: एप्लाइड सुदृढीकरण सीखने (reinforcement learning) के लिए एक TensorFlow लाइब्रेरी
★ 3,305+0पिछले 7 दिनों में स्टार का बदलाव - #82
स्वायत्त ड्राइविंग और सामरिक निर्णय लेने के कार्यों के लिए वातावरण का एक संग्रह।
★ 3,302+3पिछले 7 दिनों में स्टार का बदलाव - #83
मैनिपुलेशन स्किल फ्रेमवर्क, एक ओपन सोर्स GPU समानांतर रोबोटिक्स सिम्युलेटर और बेंचमार्क
★ 3,283+13पिछले 7 दिनों में स्टार का बदलाव - #84★ 3,227+1पिछले 7 दिनों में स्टार का बदलाव
- #85
डेटा साइंस के लिए सावधानीपूर्वक क्यूरेट किए गए संसाधन लिंक एक ही स्थान पर
★ 3,222+1पिछले 7 दिनों में स्टार का बदलाव - #86
Skywork-R1V, Skywork AI द्वारा विकसित एक उन्नत मल्टीमॉडल AI मॉडल श्रृंखला है, जो विजन-लैंग्वेज रीज़निंग में विशेषज्ञता रखती है।
★ 3,168+0पिछले 7 दिनों में स्टार का बदलाव - #87
[NeurIPS 2024] OSWorld: वास्तविक कंप्यूटर वातावरण में ओपन-एंडेड कार्यों के लिए मल्टीमॉडल एजेंट्स का मूल्यांकन
★ 3,118+6पिछले 7 दिनों में स्टार का बदलाव - #88
विभिन्न प्रकार के कार्यों और वातावरणों में एम्बॉडीड AI एजेंटों को प्रशिक्षित करने के लिए एक मॉड्यूलर हाई-लेवल लाइब्रेरी।
★ 3,117+6पिछले 7 दिनों में स्टार का बदलाव - #89
वीडियो लेक्चर के साथ बेहतरीन मुफ्त Machine Learning और AI कोर्स।
★ 3,112+0पिछले 7 दिनों में स्टार का बदलाव - #90
TradeMaster रीइंफोर्समेंट लर्निंग द्वारा संचालित क्वांटिटेटिव ट्रेडिंग के लिए एक ओपन-सोर्स प्लेटफॉर्म है :fire: :zap: :rainbow:
★ 3,056+2पिछले 7 दिनों में स्टार का बदलाव