reinforcement-learning
reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर reinforcement-learning के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और reinforcement-learning टैग वाली रिपॉजिटरी।
- #1
एक जीवंत पारिस्थितिकी तंत्र जहाँ AI एजेंट वर्कफ़्लो लूप के माध्यम से कार्य पूरे करते हैं, पुनरावृत्ति निष्पादन के माध्यम से सुधार करते हैं, मेंटर एजेंटों या लूप में मनुष्यों द्वारा मूल्यांकित किए जाते हैं, और भविष्य के एजेंटों को बेहतर बनाने के लिए पूर्ण किए गए कार्य को पुन: प्रयोज्य कार्य अनुभव और डेटा में बदलते हैं।
★ 1,334 - #2★ 727
- #3
人形机器人运动智能论文、开源项目、产业与求职知识库
★ 502 - #4
Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.
★ 160 - #5
🎬 OraRL — Annotations as Rollouts for efficient, scalable reinforcement learning of unified video MLLMs.
★ 152
- #1
वीडियो व्याख्यानों के साथ कंप्यूटर साइंस पाठ्यक्रमों की सूची।
★ 83,389+163पिछले 7 दिनों में स्टार का बदलाव - #2
Qwen3.8, Kimi K3, MiniMax-H3, Gemma 4, DeepSeek-V4, FLUX और अन्य सहित LLM और डिफ़्यूज़न मॉडल को चलाने और प्रशिक्षित करने के लिए स्थानीय UI।
★ 75,515+337पिछले 7 दिनों में स्टार का बदलाव - #3
🧑🏫 साइड-बाय-साइड नोट्स के साथ डीप लर्निंग पेपर के 60+ कार्यान्वयन/ट्यूटोरियल 📝; जिसमें ट्रांसफॉर्मर (original, xl, switch, feedback, vit, ...), ऑप्टिमाइज़र (adam, adabelief, sophia, ...), gan (cyclegan, stylegan2, ...), 🎮 सुदृढीकरण सीखना (ppo, dqn), capsnet, डिस्ट 유नेशन, ... 🧠 शामिल हैं।
★ 67,389+21पिछले 7 दिनों में स्टार का बदलाव - #4
इसे सीखें। इसे बनाएं। इसे दूसरों के लिए शिप करें।
★ 52,098+1,149पिछले 7 दिनों में स्टार का बदलाव - #5
"深入理解 AI Agent:设计原理与工程实践" (लेखक: ली बोजी) का ओपन-सोर्स मुख्य रिपॉजिटरी: पूरी पुस्तक का पाठ, संकलित PDF और अध्याय-वार संबंधित कोड
★ 44,381+1,022पिछले 7 दिनों में स्टार का बदलाव - #6
Ray एक AI कंप्यूट इंजन है। Ray में ML वर्कलोड को तेज करने के लिए एक कोर डिस्ट्रिब्यूटेड रनटाइम और AI लाइब्रेरी का एक सेट शामिल है।
★ 43,688+41पिछले 7 दिनों में स्टार का बदलाव - #7
SGLang बड़े भाषा मॉडल और मल्टीमॉडल मॉडल के लिए एक उच्च-प्रदर्शन सर्विंग फ्रेमवर्क है।
★ 33,538+791पिछले 7 दिनों में स्टार का बदलाव - #8
उत्पादन में डेटा साइंस और मशीन लर्निंग पर अपना काम साझा करने वाली कंपनियों द्वारा पेपर और टेक ब्लॉग।
★ 30,107+10पिछले 7 दिनों में स्टार का बदलाव - #9
मल्टी-फ्रेमवर्क कोड, गणित और चर्चाओं के साथ इंटरैक्टिव गहरी सीखने की किताब। स्टैनफोर्ड, MIT, Harvard और कैम्ब्रिज सहित 70 देशों के 500 विश्वविद्यालयों में अपनाया गया।
★ 29,512+30पिछले 7 दिनों में स्टार का बदलाव - #10
FinGPT: ओपन-सोर्स फाइनेंशियल लार्ज लैंग्वेज मॉडल! क्रांति लाएं 🔥 हम प्रशिक्षित मॉडल को HuggingFace पर रिलीज़ करते हैं।
★ 21,201+17पिछले 7 दिनों में स्टार का बदलाव - #11
ट्रेडिंग के लिए मशीन लर्निंग का कोड, तीसरा संस्करण - डेटा सोर्सिंग से लेकर लाइव निष्पादन तक।
★ 20,762+43पिछले 7 दिनों में स्टार का बदलाव - #12
Unity Machine Learning Agents Toolkit (ML-Agents) एक ओपन-सोर्स प्रोजेक्ट है जो गेम्स और सिमुलेशन को गहरे सुदृढीकरण सीखने (deep reinforcement learning) और अनुकरण सीखने (imitation learning) का उपयोग करके बुद्धिमान एजेंटों को प्रशिक्षित करने के लिए वातावरण के रूप में काम करने में सक्षम बनाता है।
★ 19,655+2पिछले 7 दिनों में स्टार का बदलाव - #13
AI एजेंटों को रोशन करने के लिए परम ट्रेनर।
★ 17,959+56पिछले 7 दिनों में स्टार का बदलाव - #14
यह "Mathematical Foundations of Reinforcement Learning" नामक नई पुस्तक का होमपेज है।
★ 17,663+53पिछले 7 दिनों में स्टार का बदलाव - #15
《ली होंगयी डीप लर्निंग ट्यूटोरियल》(प्रोफेसर ली होंगयी द्वारा अनुशंसित👍, एप्पल बुक🍎), PDF डाउनलोड लिंक: https://github.com/datawhalechina/leedl-tutorial/releases
★ 16,747+8पिछले 7 दिनों में स्टार का बदलाव - #16
कृत्रिम बुद्धिमत्ता (AI) कोर्सेस, बुक्स, वीडियो लेक्चर्स और पेपर्स की एक क्यूरेटेड लिस्ट।
★ 16,306+44पिछले 7 दिनों में स्टार का बदलाव - #17
Reinforcement Learning: An Introduction का Python कार्यान्वयन।
★ 14,758+0पिछले 7 दिनों में स्टार का बदलाव - #18
Bullet Physics SDK: VR, गेम्स, विजुअल इफेक्ट्स, रोबोटिक्स, मशीन लर्निंग आदि के लिए रियल-टाइम कोलिजन डिटेक्शन और मल्टी-फिजिक्स सिमुलेशन।
★ 14,711+7पिछले 7 दिनों में स्टार का बदलाव - #19
रिइनफोर्समेंट लर्निंग चीनी ट्यूटोरियल (मशरूम बुक 🍄), ऑनलाइन पढ़ने का पता: https://datawhalechina.github.io/easy-rl/
★ 14,600+8पिछले 7 दिनों में स्टार का बदलाव - #20
Stable Baselines का PyTorch वर्शन, सुदृढीकरण शिक्षण (reinforcement learning) एल्गोरिदम के विश्वसनीय कार्यान्वयन।
★ 13,758+21पिछले 7 दिनों में स्टार का बदलाव - #21
इन रोमांचक व्याख्यानों से सीखकर डीप लर्निंग, सुदृढीकरण लर्निंग, मशीन लर्निंग, कंप्यूटर विजन और NLP में डूब जाएं!!
★ 12,939+3पिछले 7 दिनों में स्टार का बदलाव - #22
सिंगल-एजेंट रीइंफोर्समेंट लर्निंग वातावरण के लिए एक मानक API, लोकप्रिय संदर्भ वातावरण और संबंधित यूटिलिटीज के साथ (पूर्व में Gym)
★ 12,451+21पिछले 7 दिनों में स्टार का बदलाव - #23
AI डेवलपर प्लेटफ़ॉर्म। मॉडल को प्रशिक्षित और फ़ाइन-ट्यून करने के लिए Weights & Biases का उपयोग करें, और प्रयोग से लेकर प्रोडक्शन तक मॉडल प्रबंधित करें।
★ 11,249+4पिछले 7 दिनों में स्टार का बदलाव - #24
Jupyter नोटबुक के उदाहरण जो Amazon SageMaker का उपयोग करके मशीन लर्निंग मॉडल बनाने, प्रशिक्षित करने और तैनात करने का तरीका प्रदर्शित करते हैं।
★ 10,983+2पिछले 7 दिनों में स्टार का बदलाव - #25
Agent Reinforcement Trainer: GRPO का उपयोग करके वास्तविक दुनिया के कार्यों के लिए मल्टी-स्टेप एजेंटों को प्रशिक्षित करें। अपने एजेंटों को ऑन-द-जॉब ट्रेनिंग दें। Qwen3.6, GPT-OSS, Llama और अन्य के लिए रीइन्फोर्समेंट लर्निंग।
★ 10,689+10पिछले 7 दिनों में स्टार का बदलाव - #26
अनुसंधान-अनुकूल सुविधाओं (PPO, DQN, C51, DDPG, TD3, SAC, PPG) के साथ डीप रीइंफोर्समेंट लर्निंग एल्गोरिदम का उच्च-गुणवत्ता वाला सिंगल-फ़ाइल कार्यान्वयन
★ 10,358+19पिछले 7 दिनों में स्टार का बदलाव - #27
Ray पर आधारित एक उपयोग में आसान, स्केलेबल और उच्च-प्रदर्शन वाला एजेंटिक RL फ्रेमवर्क (PPO, DAPO, REINFORCE++, VLM, TIS, vLLM, Ray और Async RL)
★ 9,969+9पिछले 7 दिनों में स्टार का बदलाव - #28
सरल सुदृढीकरण शिक्षण ट्यूटोरियल, मोफान पाइथन चीनी एआई शिक्षण
★ 9,508-2पिछले 7 दिनों में स्टार का बदलाव - #29★ 8,925+37पिछले 7 दिनों में स्टार का बदलाव
- #30
मशीन लर्निंग उदाहरणों और ट्यूटोरियल का एक संग्रह।
★ 8,917+1पिछले 7 दिनों में स्टार का बदलाव