Zum Hauptinhalt springen
buildradar
Sign in
Thema · rl

rl

Erfasste Open-Source-Repos mit dem Tag rl, sortiert nach Sternen.

46 Repos
  • mobilegym@Purewhiter

    MobileGym: Eine verifizierbare und hochparallele Simulationsplattform für die Forschung zu mobilen GUI-Agenten · Im Browser laufender Android-Emulator · Browser-hosted Android Simulator · Verifizierbare Evaluierung · Skalierbares Online-RL-Training

    786+10Sterne-Änderung der letzten 7 Tage
  • stable-baselines3-contrib@Stable-Baselines-Team

    Contrib-Paket für Stable-Baselines3 – Experimenteller Reinforcement-Learning-Code (RL)

    736+5Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Monte-Carlo-Tree-Search-Papern mit Implementierungen.

    715+1Sterne-Änderung der letzten 7 Tage
  • Matterport3DSimulator@peteanderson80

    KI-Forschungsplattform für Reinforcement Learning aus echten Panoramabildern.

    713+1Sterne-Änderung der letzten 7 Tage
  • dr-tulu@rlresearch

    Offizielles Repository für DR Tulu: Reinforcement Learning mit evolvierenden Rubriken für Deep Research

    704+4Sterne-Änderung der letzten 7 Tage
  • irl-imitation@yrlu

    Implementierung von Algorithmen für Inverse Reinforcement Learning (IRL) in Python/Tensorflow. Deep MaxEnt, MaxEnt, LPIRL

    681+2Sterne-Änderung der letzten 7 Tage
  • RosettaStone@utilForever

    Hearthstone-Simulator in C++ mit etwas Reinforcement Learning

    680+1Sterne-Änderung der letzten 7 Tage
  • BenchMARL@facebookresearch

    BenchMARL ist eine Bibliothek für Benchmarking im Bereich Multi-Agent Reinforcement Learning (MARL). BenchMARL ermöglicht den schnellen Vergleich verschiedener MARL-Algorithmen, -Aufgaben und -Modelle, gestützt auf die zwei Kernprinzipien: Reproduzierbarkeit und Standardisierung.

    656+2Sterne-Änderung der letzten 7 Tage
  • Neueste Fortschritte beim Long Chain-of-Thought Reasoning

    647-1Sterne-Änderung der letzten 7 Tage
  • WebShop@princeton-nlp

    [NeurIPS 2022] 🛒WebShop: Auf dem Weg zu skalierbarer Web-Interaktion in der realen Welt mit Grounded Language Agents.

    589+3Sterne-Änderung der letzten 7 Tage
  • ROS2-Control-Implementierungen für Quadruped-Roboter, einschließlich Sim2Real

    567+3Sterne-Änderung der letzten 7 Tage
  • Meta Agents Research Environments ist eine umfassende Plattform zur Evaluierung von KI-Agenten in dynamischen, realistischen Szenarien. Im Gegensatz zu statischen Benchmarks bietet diese Plattform sich entwickelnde Umgebungen, in denen Agenten ihre Strategien bei neuen Informationen anpassen müssen, um reale Herausforderungen abzubilden.

    551+3Sterne-Änderung der letzten 7 Tage
  • morl-baselines@LucasAlegre

    Implementierungen von Multi-Objective Reinforcement Learning Algorithmen.

    533+1Sterne-Änderung der letzten 7 Tage
  • DeepThinkVLA@OpenBMB

    DeepThinkVLA: Verbesserung der Schlussfolgerungsfähigkeit von Vision-Language-Action-Modellen

    529+0Sterne-Änderung der letzten 7 Tage
  • gem@axon-rl

    Eine Trainingsumgebung für agentische LLMs

    506+1Sterne-Änderung der letzten 7 Tage
  • GDPO@NVlabs

    Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization

    501Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen