मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · reinforcement-learning

reinforcement-learning

reinforcement-learning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

305 रिपॉजिटरी
  • Super Mario Bros के लिए Asynchronous Advantage Actor-Critic (A3C) एल्गोरिदम।

    1,111-1पिछले 7 दिनों में स्टार का बदलाव
  • purejaxrl@luchris429

    अत्यंत तेज़ एंड-टू-एंड Jax RL कार्यान्वयन

    1,103+3पिछले 7 दिनों में स्टार का बदलाव
  • skrl@Toni-SM

    मॉड्यूलर रीइन्फोर्समेंट लर्निंग (RL) लाइब्रेरी (PyTorch, JAX, और NVIDIA Warp में कार्यान्वित), जो Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground और अन्य वातावरणों का समर्थन करती है।

    1,095+2पिछले 7 दिनों में स्टार का बदलाव
  • DexterousHands@PKU-MARL

    यह एक लाइब्रेरी है जो Isaac Gym के माध्यम से दोहरे निपुण हाथ हेरफेर कार्य प्रदान करती है

    1,094+7पिछले 7 दिनों में स्टार का बदलाव
  • xuance@agi-brain

    XuanCe: एक व्यापक और एकीकृत डीप रीइंफोर्समेंट लर्निंग लाइब्रेरी

    1,086+4पिछले 7 दिनों में स्टार का बदलाव
  • ऑफ़लाइन सुदृढीकरण शिक्षण (offline-rl) के लिए एल्गोरिदम का एक सूचकांक

    1,078+3पिछले 7 दिनों में स्टार का बदलाव
  • Stable-Retro@Farama-Foundation

    अतिरिक्त गेम्स, एमुलेटर और समर्थित प्लेटफॉर्म के साथ gym-retro का एक फोर्क।

    1,077+395पिछले 7 दिनों में स्टार का बदलाव
  • sumo-rl@LucasAlegre

    SUMO के साथ ट्रैफिक सिग्नल कंट्रोल के लिए रीइंफोर्समेंट लर्निंग वातावरण। Gymnasium, PettingZoo और लोकप्रिय RL लाइब्रेरी के साथ संगत।

    1,075+4पिछले 7 दिनों में स्टार का बदलाव
  • Books@Rishabh-creator601

    प्रोग्रामिंग के विभिन्न क्षेत्रों के लिए किताबें / PDF / EPUB।

    1,066+6पिछले 7 दिनों में स्टार का बदलाव
  • AI/ML/DL/CV के साथ बने रहने के लिए आवश्यक मार्गदर्शिका

    1,063+0पिछले 7 दिनों में स्टार का बदलाव
  • judgeval@JudgmentLabs

    एजेंटों के लिए निरंतर-सुधार स्टैक। हमारा पर्यावरण डेटा और मूल्यांकन एजेंट सुधार और निगरानी को शक्ति प्रदान करते हैं।

    1,060+2पिछले 7 दिनों में स्टार का बदलाव
  • Agent इंजीनियरों के लिए सबसे व्यापक लर्निंग पाथ · शून्य से AI इंजीनियरिंग में महारत · 20 चरण, 503 पाठ · पूर्ण चीनी अनुवाद + सहायक साइट + एनिमेटेड वीडियो · AI Agent इंजीनियर बनने के लिए एक गाइड

    1,047+39पिछले 7 दिनों में स्टार का बदलाव
  • Online-3D-BPP-PCT@alexfrom0815

    Learning Efficient Online 3D Bin Packing on Packing Configuration Trees का कोड कार्यान्वयन। हम पदानुक्रमित पैकिंग कॉन्फ़िगरेशन ट्री पर लर्निंग के माध्यम से ऑनलाइन 3D Bin Packing Problem (BPP) की व्यावहारिक प्रयोज्यता को बढ़ाने का प्रस्ताव करते हैं, जो DRL मॉडल को व्यावहारिक बाधाओं से निपटने और निरंतर समाधान स्थान के साथ भी अच्छा प्रदर्शन करने में सक्षम बनाता है।

    1,047+1पिछले 7 दिनों में स्टार का बदलाव
  • GPTSwarm@metauto-ai

    🐝 RL / प्रॉम्प्टिंग ऑप्टिमाइज़ेशन के साथ पहले स्व-सुधार करने वाले एजेंट

    1,043+3पिछले 7 दिनों में स्टार का बदलाव
  • rl-book@ZhiqingXiao

    "Reinforcement Learning: Theory and Python Implementation" पुस्तक के लिए सोर्स कोड।

    1,033+3पिछले 7 दिनों में स्टार का बदलाव
  • rl-tools@rl-tools

    सबसे तेज़ डीप रीइन्फोर्समेंट लर्निंग लाइब्रेरी

    1,033+3पिछले 7 दिनों में स्टार का बदलाव
  • rl-mpc-locomotion@silvery107

    क्वाड्रुपेड रोबोट लोकोमोशन के MPC कंट्रोल के लिए डीप RL।

    1,024+4पिछले 7 दिनों में स्टार का बदलाव
  • sample-factory@alex-petrenko

    उच्च थ्रूपुट सिंक्रोनस और असिंक्रोनस सुदृढीकरण शिक्षण (reinforcement learning)

    1,022+0पिछले 7 दिनों में स्टार का बदलाव
  • DeepRec@imsheridan

    सिफारिश और विज्ञापन उद्योग के क्लासिक और ಅತ್ಯಂತ नवीनतम पेपर, संसाधनों का संग्रह / रिकमेंडेशन सिस्टम और CTR प्रेडिक्शन पर अवश्य पढ़ने योग्य पेपर

    1,016+0पिछले 7 दिनों में स्टार का बदलाव
  • overcooked_ai@HumanCompatibleAI

    पूरी तरह से सहयोगात्मक human-AI प्रदर्शन के लिए एक बेंचमार्क वातावरण।

    1,003+5पिछले 7 दिनों में स्टार का बदलाव
  • verl-omni@verl-project

    डिफ्यूजन और ओम्नी मॉडल के लिए मल्टीमॉडल RL प्रशिक्षण फ्रेमवर्क

    983+73पिछले 7 दिनों में स्टार का बदलाव
  • मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग पर आधारित बेहतरीन गेम AI सामग्री

    980+2पिछले 7 दिनों में स्टार का बदलाव
  • Step-Audio-EditX@stepfun-ai

    एक शक्तिशाली 3B-पैरामीटर, LLM-आधारित रीइन्फोर्समेंट लर्निंग ऑडियो एडिट मॉडल, जो भावना, बोलने की शैली और पैरालिंग्विस्टिक्स को एडिट करने में उत्कृष्ट है, और इसमें मजबूत ज़ीरो-शॉट टेक्स्ट-टू-स्पीच की सुविधा है।

    973+2पिछले 7 दिनों में स्टार का बदलाव
  • Gymnasium-Robotics@Farama-Foundation

    रीइन्फोर्समेंट लर्निंग के लिए रोबोटिक्स सिमुलेशन वातावरण का संग्रह

    963+1पिछले 7 दिनों में स्टार का बदलाव
  • मशीन लर्निंग ओपन सोर्स यूनिवर्सिटी

    955+0पिछले 7 दिनों में स्टार का बदलाव
  • Generative AI और Deep Learning का उपयोग करके मॉलिक्यूलर और मटेरियल डिज़ाइन की सूची।

    952+1पिछले 7 दिनों में स्टार का बदलाव
  • AgileRL@AgileRL

    RLOps के साथ सुदृढीकरण सीखने (reinforcement learning) को सुव्यवस्थित करना। अत्याधुनिक RL एल्गोरिदम और उपकरण, इवोल्यूशनरी हाइपरपैरामीटर ऑप्टिमाइज़ेशन के माध्यम से 10 गुना तेज़ प्रशिक्षण के साथ।

    951+5पिछले 7 दिनों में स्टार का बदलाव
  • GibsonEnv@StanfordVL

    Gibson Environments: एम्बॉडीड एजेंट्स के लिए वास्तविक दुनिया की धारणा।

    947+1पिछले 7 दिनों में स्टार का बदलाव
  • tdmpc2@nicklashansen

    "TD-MPC2: Scalable, Robust World Models for Continuous Control" के लिए कोड

    946+7पिछले 7 दिनों में स्टार का बदलाव
  • Shimmy@Farama-Foundation

    PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama

    945पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस