reinforcement-learning
reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #181
Super Mario Bros के लिए Asynchronous Advantage Actor-Critic (A3C) एल्गोरिदम।
★ 1,111-1पिछले 7 दिनों में स्टार का बदलाव - #182★ 1,103+3पिछले 7 दिनों में स्टार का बदलाव
- #183
मॉड्यूलर रीइन्फोर्समेंट लर्निंग (RL) लाइब्रेरी (PyTorch, JAX, और NVIDIA Warp में कार्यान्वित), जो Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground और अन्य वातावरणों का समर्थन करती है।
★ 1,095+2पिछले 7 दिनों में स्टार का बदलाव - #184
यह एक लाइब्रेरी है जो Isaac Gym के माध्यम से दोहरे निपुण हाथ हेरफेर कार्य प्रदान करती है
★ 1,094+7पिछले 7 दिनों में स्टार का बदलाव - #185★ 1,086+4पिछले 7 दिनों में स्टार का बदलाव
- #186
ऑफ़लाइन सुदृढीकरण शिक्षण (offline-rl) के लिए एल्गोरिदम का एक सूचकांक
★ 1,078+3पिछले 7 दिनों में स्टार का बदलाव - #187
अतिरिक्त गेम्स, एमुलेटर और समर्थित प्लेटफॉर्म के साथ gym-retro का एक फोर्क।
★ 1,077+395पिछले 7 दिनों में स्टार का बदलाव - #188
SUMO के साथ ट्रैफिक सिग्नल कंट्रोल के लिए रीइंफोर्समेंट लर्निंग वातावरण। Gymnasium, PettingZoo और लोकप्रिय RL लाइब्रेरी के साथ संगत।
★ 1,075+4पिछले 7 दिनों में स्टार का बदलाव - #189★ 1,066+6पिछले 7 दिनों में स्टार का बदलाव
- #190
AI/ML/DL/CV के साथ बने रहने के लिए आवश्यक मार्गदर्शिका
★ 1,063+0पिछले 7 दिनों में स्टार का बदलाव - #191
एजेंटों के लिए निरंतर-सुधार स्टैक। हमारा पर्यावरण डेटा और मूल्यांकन एजेंट सुधार और निगरानी को शक्ति प्रदान करते हैं।
★ 1,060+2पिछले 7 दिनों में स्टार का बदलाव - #192
Agent इंजीनियरों के लिए सबसे व्यापक लर्निंग पाथ · शून्य से AI इंजीनियरिंग में महारत · 20 चरण, 503 पाठ · पूर्ण चीनी अनुवाद + सहायक साइट + एनिमेटेड वीडियो · AI Agent इंजीनियर बनने के लिए एक गाइड
★ 1,047+39पिछले 7 दिनों में स्टार का बदलाव - #193
Learning Efficient Online 3D Bin Packing on Packing Configuration Trees का कोड कार्यान्वयन। हम पदानुक्रमित पैकिंग कॉन्फ़िगरेशन ट्री पर लर्निंग के माध्यम से ऑनलाइन 3D Bin Packing Problem (BPP) की व्यावहारिक प्रयोज्यता को बढ़ाने का प्रस्ताव करते हैं, जो DRL मॉडल को व्यावहारिक बाधाओं से निपटने और निरंतर समाधान स्थान के साथ भी अच्छा प्रदर्शन करने में सक्षम बनाता है।
★ 1,047+1पिछले 7 दिनों में स्टार का बदलाव - #194★ 1,043+3पिछले 7 दिनों में स्टार का बदलाव
- #195
"Reinforcement Learning: Theory and Python Implementation" पुस्तक के लिए सोर्स कोड।
★ 1,033+3पिछले 7 दिनों में स्टार का बदलाव - #196★ 1,033+3पिछले 7 दिनों में स्टार का बदलाव
- #197
क्वाड्रुपेड रोबोट लोकोमोशन के MPC कंट्रोल के लिए डीप RL।
★ 1,024+4पिछले 7 दिनों में स्टार का बदलाव - #198
उच्च थ्रूपुट सिंक्रोनस और असिंक्रोनस सुदृढीकरण शिक्षण (reinforcement learning)
★ 1,022+0पिछले 7 दिनों में स्टार का बदलाव - #199
सिफारिश और विज्ञापन उद्योग के क्लासिक और ಅತ್ಯಂತ नवीनतम पेपर, संसाधनों का संग्रह / रिकमेंडेशन सिस्टम और CTR प्रेडिक्शन पर अवश्य पढ़ने योग्य पेपर
★ 1,016+0पिछले 7 दिनों में स्टार का बदलाव - #200
पूरी तरह से सहयोगात्मक human-AI प्रदर्शन के लिए एक बेंचमार्क वातावरण।
★ 1,003+5पिछले 7 दिनों में स्टार का बदलाव - #201★ 983+73पिछले 7 दिनों में स्टार का बदलाव
- #202
मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग पर आधारित बेहतरीन गेम AI सामग्री
★ 980+2पिछले 7 दिनों में स्टार का बदलाव - #203
एक शक्तिशाली 3B-पैरामीटर, LLM-आधारित रीइन्फोर्समेंट लर्निंग ऑडियो एडिट मॉडल, जो भावना, बोलने की शैली और पैरालिंग्विस्टिक्स को एडिट करने में उत्कृष्ट है, और इसमें मजबूत ज़ीरो-शॉट टेक्स्ट-टू-स्पीच की सुविधा है।
★ 973+2पिछले 7 दिनों में स्टार का बदलाव - #204
रीइन्फोर्समेंट लर्निंग के लिए रोबोटिक्स सिमुलेशन वातावरण का संग्रह
★ 963+1पिछले 7 दिनों में स्टार का बदलाव - #205
मशीन लर्निंग ओपन सोर्स यूनिवर्सिटी
★ 955+0पिछले 7 दिनों में स्टार का बदलाव - #206
Generative AI और Deep Learning का उपयोग करके मॉलिक्यूलर और मटेरियल डिज़ाइन की सूची।
★ 952+1पिछले 7 दिनों में स्टार का बदलाव - #207
RLOps के साथ सुदृढीकरण सीखने (reinforcement learning) को सुव्यवस्थित करना। अत्याधुनिक RL एल्गोरिदम और उपकरण, इवोल्यूशनरी हाइपरपैरामीटर ऑप्टिमाइज़ेशन के माध्यम से 10 गुना तेज़ प्रशिक्षण के साथ।
★ 951+5पिछले 7 दिनों में स्टार का बदलाव - #208★ 947+1पिछले 7 दिनों में स्टार का बदलाव
- #209★ 946+7पिछले 7 दिनों में स्टार का बदलाव
- #210
PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama
★ 945—पिछले 7 दिनों में स्टार का बदलाव