मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · ppo

ppo

ppo टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
26
कुल स्टार
86,263
औसत स्टार
3,318
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर ppo के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और ppo टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • easy-rl@datawhalechina

    रिइनफोर्समेंट लर्निंग चीनी ट्यूटोरियल (मशरूम बुक 🍄), ऑनलाइन पढ़ने का पता: https://datawhalechina.github.io/easy-rl/

    14,600+8पिछले 7 दिनों में स्टार का बदलाव
  • tianshou@thu-ml

    एक सुंदर PyTorch डीप रीइंफोर्समेंट लर्निंग लाइब्रेरी।

    10,955+10पिछले 7 दिनों में स्टार का बदलाव
  • cleanrl@vwxyzjn

    अनुसंधान-अनुकूल सुविधाओं (PPO, DQN, C51, DDPG, TD3, SAC, PPG) के साथ डीप रीइंफोर्समेंट लर्निंग एल्गोरिदम का उच्च-गुणवत्ता वाला सिंगल-फ़ाइल कार्यान्वयन

    10,358+19पिछले 7 दिनों में स्टार का बदलाव
  • सरल सुदृढीकरण शिक्षण ट्यूटोरियल, मोफान पाइथन चीनी एआई शिक्षण

    9,508-2पिछले 7 दिनों में स्टार का बदलाव
  • deep-reinforcement-learning@udacity

    डीप रेनफोर्समेंट लर्निंग नैनोडग्री प्रोग्राम के लिए रिपॉजिटरी

    5,176+0पिछले 7 दिनों में स्टार का बदलाव
  • ElegantRL@AI4Finance-Foundation

    बड़े पैमाने पर समानांतर डीप रीइंफोर्समेंट लर्निंग। 🔥

    4,359+2पिछले 7 दिनों में स्टार का बदलाव
  • hands-on-modern-rl@walkinglabs

    🚀 बुनियादी RL अवधारणाओं से LLM संरेखण, RLVR, और उन्नत एजेंटिक प्रणालियों के बीच की खाई को पाटने वाला एक ओपन-सोर्स, व्यावहारिक पाठ्यक्रम।

    4,199+54पिछले 7 दिनों में स्टार का बदलाव
  • FinRL-Trading@AI4Finance-Foundation

    FinRL-X: मात्रात्मक व्यापार के लिए एक AI-नेटिव मॉड्यूलर बुनियादी ढांचा

    3,657+50पिछले 7 दिनों में स्टार का बदलाव
  • DeepRL@ShangtongZhang

    PyTorch में Deep RL एल्गोरिदम का मॉड्यूलर कार्यान्वयन

    3,452+3पिछले 7 दिनों में स्टार का बदलाव
  • DRL-Pytorch@XinJingHao

    लोकप्रिय Deep Reinforcement Learning (DRL) एल्गोरिदम का स्वच्छ, मजबूत और एकीकृत PyTorch कार्यान्वयन (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)

    3,440+3पिछले 7 दिनों में स्टार का बदलाव
  • PPO-PyTorch@nikhilbarhate99

    PyTorch में क्लिप्ड ऑब्जेक्टिव Proximal Policy Optimization (PPO) का न्यूनतम कार्यान्वयन

    2,381+6पिछले 7 दिनों में स्टार का बदलाव
  • on-policy@marlbenchmark

    यह Multi-Agent PPO (MAPPO) का आधिकारिक कार्यान्वयन है।

    2,088+1पिछले 7 दिनों में स्टार का बदलाव
  • SLM-Lab@kengz

    PyTorch में मॉड्यूलर डीप रिइंफोर्समेंट लर्निंग फ्रेमवर्क। पुस्तक "फाउंडेशन ऑफ डीप रिइंफोर्समेंट लर्निंग" की सह-पुस्तकालय (कंपैनियन लाइब्रेरी)।

    1,362+0पिछले 7 दिनों में स्टार का बदलाव
  • PPO-for-Beginners@ericyangyu

    एक सरल और अच्छी तरह से स्टाइल किया गया PPO कार्यान्वयन। मेरी Medium श्रृंखला पर आधारित: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8

    1,269+1पिछले 7 दिनों में स्टार का बदलाव
  • LearningHumanoidWalking@rohanpsingh

    रीइंफोर्समेंट लर्निंग का उपयोग करके लोकोमोशन के लिए ह्यूमनॉइड रोबोट को प्रशिक्षित करना

    1,210+3पिछले 7 दिनों में स्टार का बदलाव
  • purejaxrl@luchris429

    अत्यंत तेज़ एंड-टू-एंड Jax RL कार्यान्वयन

    1,102+2पिछले 7 दिनों में स्टार का बदलाव
  • xuance@agi-brain

    XuanCe: एक व्यापक और एकीकृत डीप रीइंफोर्समेंट लर्निंग लाइब्रेरी

    1,083+2पिछले 7 दिनों में स्टार का बदलाव
  • HALOs@ContextualAI

    DPO, KTO, PPO, ORPO और अन्य ह्यूमन-अवेयर लॉस फंक्शन्स (HALOs) के विस्तार योग्य कार्यान्वयन वाली एक लाइब्रेरी।

    909-1पिछले 7 दिनों में स्टार का बदलाव
  • rl-starter-files@lcswillems

    RL स्टार्टर फ़ाइलें ताकि बिना कोई कोड लिखे तुरंत एजेंट को ट्रेन, विज़ुअलाइज़ और इवैल्यूएट किया जा सके।

    728+0पिछले 7 दिनों में स्टार का बदलाव
  • इस रिपॉजिटरी में क्लासिक डीप रीइन्फोर्समेंट लर्निंग एल्गोरिदम के अधिकांश PyTorch कार्यान्वयन शामिल हैं, जिनमें DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO शामिल हैं। (अन्य एल्गोरिदम पर काम जारी है)

    697+1पिछले 7 दिनों में स्टार का बदलाव
  • oat@sail-sg

    🌾 OAT: LLM ऑनलाइन अलाइनमेंट के लिए एक शोध-अनुकूल फ़्रेमवर्क, जिसमें रीइन्फोर्समेंट लर्निंग, प्रेफरेंस लर्निंग आदि शामिल हैं।

    669-1पिछले 7 दिनों में स्टार का बदलाव
  • डीप रीइन्फोर्समेंट लर्निंग एजेंट्स बनाने के लिए एक PyTorch लाइब्रेरी।

    657+0पिछले 7 दिनों में स्टार का बदलाव
  • Open-AgentRL@Gen-Verse

    RLAnything (ICML 2026) और AutoTool (ICML 2026), DemyAgent: LLMs और एजेंटिक परिदृश्यों के लिए ओपन-सोर्स RL।

    632+9पिछले 7 दिनों में स्टार का बदलाव
  • LLamaTuner@jianzhnie

    LLMs की आसान और कुशल फाइन-ट्यूनिंग। (LLama, LLama2, LLama3, Qwen, Baichuan, GLM, Falcon समर्थित)

    621+0पिछले 7 दिनों में स्टार का बदलाव
  • वीडियो जनरेशन के लिए रीइन्फोर्समेंट लर्निंग पर शोध पत्रों की एक क्यूरेटेड सूची

    591+1पिछले 7 दिनों में स्टार का बदलाव
  • ऑटोनॉमस ड्राइविंग (Carla) में डीप रीइन्फोर्समेंट लर्निंग (PPO) [शून्य से]

    563-1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस