मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · reinforcement-learning

reinforcement-learning

reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
305
कुल स्टार
12,92,198
औसत स्टार
4,237
हिस्सा
0.07%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर reinforcement-learning के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और reinforcement-learning टैग वाली रिपॉजिटरी।

  • agent-apprenticeship@ray-r-ren

    एक जीवंत पारिस्थितिकी तंत्र जहाँ AI एजेंट वर्कफ़्लो लूप के माध्यम से कार्य पूरे करते हैं, पुनरावृत्ति निष्पादन के माध्यम से सुधार करते हैं, मेंटर एजेंटों या लूप में मनुष्यों द्वारा मूल्यांकित किए जाते हैं, और भविष्य के एजेंटों को बेहतर बनाने के लिए पूर्ण किए गए कार्य को पुन: प्रयोज्य कार्य अनुभव और डेटा में बदलते हैं।

    1,334
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    727
  • 人形机器人运动智能论文、开源项目、产业与求职知识库

    502
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • OraRL@HVision-NKU

    🎬 OraRL — Annotations as Rollouts for efficient, scalable reinforcement learning of unified video MLLMs.

    152
  • वीडियो व्याख्यानों के साथ कंप्यूटर साइंस पाठ्यक्रमों की सूची।

    83,389+163पिछले 7 दिनों में स्टार का बदलाव
  • unsloth@unslothai

    Qwen3.8, Kimi K3, MiniMax-H3, Gemma 4, DeepSeek-V4, FLUX और अन्य सहित LLM और डिफ़्यूज़न मॉडल को चलाने और प्रशिक्षित करने के लिए स्थानीय UI।

    75,515+337पिछले 7 दिनों में स्टार का बदलाव
  • 🧑‍🏫 साइड-बाय-साइड नोट्स के साथ डीप लर्निंग पेपर के 60+ कार्यान्वयन/ट्यूटोरियल 📝; जिसमें ट्रांसफॉर्मर (original, xl, switch, feedback, vit, ...), ऑप्टिमाइज़र (adam, adabelief, sophia, ...), gan (cyclegan, stylegan2, ...), 🎮 सुदृढीकरण सीखना (ppo, dqn), capsnet, डिस्ट 유नेशन, ... 🧠 शामिल हैं।

    67,389+21पिछले 7 दिनों में स्टार का बदलाव
  • इसे सीखें। इसे बनाएं। इसे दूसरों के लिए शिप करें।

    52,098+1,149पिछले 7 दिनों में स्टार का बदलाव
  • ai-agent-book@bojieli

    "深入理解 AI Agent:设计原理与工程实践" (लेखक: ली बोजी) का ओपन-सोर्स मुख्य रिपॉजिटरी: पूरी पुस्तक का पाठ, संकलित PDF और अध्याय-वार संबंधित कोड

    44,381+1,022पिछले 7 दिनों में स्टार का बदलाव
  • ray@ray-project

    Ray एक AI कंप्यूट इंजन है। Ray में ML वर्कलोड को तेज करने के लिए एक कोर डिस्ट्रिब्यूटेड रनटाइम और AI लाइब्रेरी का एक सेट शामिल है।

    43,688+41पिछले 7 दिनों में स्टार का बदलाव
  • sglang@sgl-project

    SGLang बड़े भाषा मॉडल और मल्टीमॉडल मॉडल के लिए एक उच्च-प्रदर्शन सर्विंग फ्रेमवर्क है।

    33,538+791पिछले 7 दिनों में स्टार का बदलाव
  • applied-ml@eugeneyan

    उत्पादन में डेटा साइंस और मशीन लर्निंग पर अपना काम साझा करने वाली कंपनियों द्वारा पेपर और टेक ब्लॉग।

    30,107+10पिछले 7 दिनों में स्टार का बदलाव
  • d2l-en@d2l-ai

    मल्टी-फ्रेमवर्क कोड, गणित और चर्चाओं के साथ इंटरैक्टिव गहरी सीखने की किताब। स्टैनफोर्ड, MIT, Harvard और कैम्ब्रिज सहित 70 देशों के 500 विश्वविद्यालयों में अपनाया गया।

    29,512+30पिछले 7 दिनों में स्टार का बदलाव
  • FinGPT@AI4Finance-Foundation

    FinGPT: ओपन-सोर्स फाइनेंशियल लार्ज लैंग्वेज मॉडल! क्रांति लाएं 🔥 हम प्रशिक्षित मॉडल को HuggingFace पर रिलीज़ करते हैं।

    21,201+17पिछले 7 दिनों में स्टार का बदलाव
  • machine-learning-for-trading@stefan-jansen

    ट्रेडिंग के लिए मशीन लर्निंग का कोड, तीसरा संस्करण - डेटा सोर्सिंग से लेकर लाइव निष्पादन तक।

    20,762+43पिछले 7 दिनों में स्टार का बदलाव
  • ml-agents@Unity-Technologies

    Unity Machine Learning Agents Toolkit (ML-Agents) एक ओपन-सोर्स प्रोजेक्ट है जो गेम्स और सिमुलेशन को गहरे सुदृढीकरण सीखने (deep reinforcement learning) और अनुकरण सीखने (imitation learning) का उपयोग करके बुद्धिमान एजेंटों को प्रशिक्षित करने के लिए वातावरण के रूप में काम करने में सक्षम बनाता है।

    19,655+2पिछले 7 दिनों में स्टार का बदलाव
  • agent-lightning@microsoft

    AI एजेंटों को रोशन करने के लिए परम ट्रेनर।

    17,959+56पिछले 7 दिनों में स्टार का बदलाव
  • यह "Mathematical Foundations of Reinforcement Learning" नामक नई पुस्तक का होमपेज है।

    17,663+53पिछले 7 दिनों में स्टार का बदलाव
  • leedl-tutorial@datawhalechina

    《ली होंगयी डीप लर्निंग ट्यूटोरियल》(प्रोफेसर ली होंगयी द्वारा अनुशंसित👍, एप्पल बुक🍎), PDF डाउनलोड लिंक: https://github.com/datawhalechina/leedl-tutorial/releases

    16,747+8पिछले 7 दिनों में स्टार का बदलाव
  • कृत्रिम बुद्धिमत्ता (AI) कोर्सेस, बुक्स, वीडियो लेक्चर्स और पेपर्स की एक क्यूरेटेड लिस्ट।

    16,306+44पिछले 7 दिनों में स्टार का बदलाव
  • Reinforcement Learning: An Introduction का Python कार्यान्वयन।

    14,758+0पिछले 7 दिनों में स्टार का बदलाव
  • bullet3@bulletphysics

    Bullet Physics SDK: VR, गेम्स, विजुअल इफेक्ट्स, रोबोटिक्स, मशीन लर्निंग आदि के लिए रियल-टाइम कोलिजन डिटेक्शन और मल्टी-फिजिक्स सिमुलेशन।

    14,711+7पिछले 7 दिनों में स्टार का बदलाव
  • easy-rl@datawhalechina

    रिइनफोर्समेंट लर्निंग चीनी ट्यूटोरियल (मशरूम बुक 🍄), ऑनलाइन पढ़ने का पता: https://datawhalechina.github.io/easy-rl/

    14,600+8पिछले 7 दिनों में स्टार का बदलाव
  • Stable Baselines का PyTorch वर्शन, सुदृढीकरण शिक्षण (reinforcement learning) एल्गोरिदम के विश्वसनीय कार्यान्वयन।

    13,758+21पिछले 7 दिनों में स्टार का बदलाव
  • इन रोमांचक व्याख्यानों से सीखकर डीप लर्निंग, सुदृढीकरण लर्निंग, मशीन लर्निंग, कंप्यूटर विजन और NLP में डूब जाएं!!

    12,939+3पिछले 7 दिनों में स्टार का बदलाव
  • Gymnasium@Farama-Foundation

    सिंगल-एजेंट रीइंफोर्समेंट लर्निंग वातावरण के लिए एक मानक API, लोकप्रिय संदर्भ वातावरण और संबंधित यूटिलिटीज के साथ (पूर्व में Gym)

    12,451+21पिछले 7 दिनों में स्टार का बदलाव
  • wandb@wandb

    AI डेवलपर प्लेटफ़ॉर्म। मॉडल को प्रशिक्षित और फ़ाइन-ट्यून करने के लिए Weights & Biases का उपयोग करें, और प्रयोग से लेकर प्रोडक्शन तक मॉडल प्रबंधित करें।

    11,249+4पिछले 7 दिनों में स्टार का बदलाव
  • amazon-sagemaker-examples@aws

    Jupyter नोटबुक के उदाहरण जो Amazon SageMaker का उपयोग करके मशीन लर्निंग मॉडल बनाने, प्रशिक्षित करने और तैनात करने का तरीका प्रदर्शित करते हैं।

    10,983+2पिछले 7 दिनों में स्टार का बदलाव
  • ART@OpenPipe

    Agent Reinforcement Trainer: GRPO का उपयोग करके वास्तविक दुनिया के कार्यों के लिए मल्टी-स्टेप एजेंटों को प्रशिक्षित करें। अपने एजेंटों को ऑन-द-जॉब ट्रेनिंग दें। Qwen3.6, GPT-OSS, Llama और अन्य के लिए रीइन्फोर्समेंट लर्निंग।

    10,689+10पिछले 7 दिनों में स्टार का बदलाव
  • cleanrl@vwxyzjn

    अनुसंधान-अनुकूल सुविधाओं (PPO, DQN, C51, DDPG, TD3, SAC, PPG) के साथ डीप रीइंफोर्समेंट लर्निंग एल्गोरिदम का उच्च-गुणवत्ता वाला सिंगल-फ़ाइल कार्यान्वयन

    10,358+19पिछले 7 दिनों में स्टार का बदलाव
  • OpenRLHF@OpenRLHF

    Ray पर आधारित एक उपयोग में आसान, स्केलेबल और उच्च-प्रदर्शन वाला एजेंटिक RL फ्रेमवर्क (PPO, DAPO, REINFORCE++, VLM, TIS, vLLM, Ray और Async RL)

    9,969+9पिछले 7 दिनों में स्टार का बदलाव
  • सरल सुदृढीकरण शिक्षण ट्यूटोरियल, मोफान पाइथन चीनी एआई शिक्षण

    9,508-2पिछले 7 दिनों में स्टार का बदलाव
  • Sana@NVlabs

    SANA: लीनियर डिफ्यूजन ट्रांसफॉर्मर के साथ कुशल हाई-रिज़ॉल्यूशन इमेज सिंथेसिस।

    8,925+37पिछले 7 दिनों में स्टार का बदलाव
  • machine_learning_examples@lazyprogrammer

    मशीन लर्निंग उदाहरणों और ट्यूटोरियल का एक संग्रह।

    8,917+1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस