Zum Hauptinhalt springen
buildradar
Sign in
Thema · reinforcement-learning

reinforcement-learning

Erfasste Open-Source-Repos mit dem Tag reinforcement-learning, sortiert nach Sternen.

304 Repos
  • Eine Sammlung aktueller Arbeiten zum Aufbau autonomer Agenten. Zwei Themen enthalten: RL-basierte / LLM-basierte Agenten.

    758+1Sterne-Änderung der letzten 7 Tage
  • tmrl@trackmania-rl

    Reinforcement Learning für Echtzeitanwendungen

    737+2Sterne-Änderung der letzten 7 Tage
  • stable-baselines3-contrib@Stable-Baselines-Team

    Contrib-Paket für Stable-Baselines3 – Experimenteller Reinforcement-Learning-Code (RL)

    736+4Sterne-Änderung der letzten 7 Tage
  • Dies ist ein Projekt über einen Algorithmus zum autonomen Hindernisausweichen für UAVs mittels Deep Reinforcement Learning.

    730+2Sterne-Änderung der letzten 7 Tage
  • Long-RL@NVlabs

    Long-RL: Skalierung von RL auf lange Sequenzen (NeurIPS 2025)

    730+1Sterne-Änderung der letzten 7 Tage
  • disco_rl@google-deepmind

    Begleitcode zur Nature-Veröffentlichung „Discovering State-of-the-art Reinforcement Algorithms“

    728+1Sterne-Änderung der letzten 7 Tage
  • rl-agents@eleurent

    Implementierungen von Reinforcement-Learning- und Planungsalgorithmen.

    726+0Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von großartigen Ressourcen zum explorativen Reinforcement Learning (wird laufend aktualisiert)

    723+0Sterne-Änderung der letzten 7 Tage
  • PyPokerEngine@ishikota

    Poker-Engine für die Entwicklung von Poker-KI in Python

    722+0Sterne-Änderung der letzten 7 Tage
  • UAV-DDPG@fangvv

    Code zum Paper 'Computation Offloading Optimization for UAV-assisted Mobile Edge Computing: A Deep Deterministic Policy Gradient Approach'.

    722+0Sterne-Änderung der letzten 7 Tage
  • neuron_poker@dickreuter

    Texas-Holdem-OpenAI-Gym-Poker-Umgebung mit Reinforcement Learning auf Basis von keras-rl. Inklusive virtuellem Rendering und Monte-Carlo-Simulation zur Equity-Berechnung.

    722+1Sterne-Änderung der letzten 7 Tage
  • DeepRetrieval@pat-jj

    [COLM’25] DeepRetrieval — 🔥 Training von Suchagenten durch RLVR mit Suchergebnis

    718+0Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Monte-Carlo-Tree-Search-Papern mit Implementierungen.

    715+1Sterne-Änderung der letzten 7 Tage
  • Matterport3DSimulator@peteanderson80

    KI-Forschungsplattform für Reinforcement Learning aus echten Panoramabildern.

    714+2Sterne-Änderung der letzten 7 Tage
  • mpc-reinforcement-learning@FilippoAiraldi

    Reinforcement Learning mit modellprädiktiver Regelung

    710+0Sterne-Änderung der letzten 7 Tage
  • pymarl2@hijkzzz

    Feingetunte MARL-Algorithmen auf SMAC (100 % Siegtrefferquote in den meisten Szenarien)

    708+0Sterne-Änderung der letzten 7 Tage
  • Eine umfassende Frontend-Sammlung und Übersicht von Vision-Language-Model-Papern und -Modellen auf GitHub. Kontinuierliche Updates.

    706+5Sterne-Änderung der letzten 7 Tage
  • ns3-gym@tkn-tub

    ns3-gym – Die Spielwiese für Reinforcement Learning in der Netzwerkforschung

    692+1Sterne-Änderung der letzten 7 Tage
  • Flow-Factory@X-GenGroup

    Ein einheitliches Framework für einfaches Reinforcement Learning in Flow-Matching-Modellen

    690+6Sterne-Änderung der letzten 7 Tage
  • irl-imitation@yrlu

    Implementierung von Algorithmen für Inverse Reinforcement Learning (IRL) in Python/Tensorflow. Deep MaxEnt, MaxEnt, LPIRL

    681+2Sterne-Änderung der letzten 7 Tage
  • RosettaStone@utilForever

    Hearthstone-Simulator in C++ mit etwas Reinforcement Learning

    680+2Sterne-Änderung der letzten 7 Tage
  • AI-Toolbox@Svalorzen

    Ein C++-Framework für MDPs und POMDPs mit Python-Anbindungen

    671+1Sterne-Änderung der letzten 7 Tage
  • Eine PyTorch-Bibliothek zum Erstellen von Deep-Reinforcement-Learning-Agenten.

    657+1Sterne-Änderung der letzten 7 Tage
  • BenchMARL@facebookresearch

    BenchMARL ist eine Bibliothek für Benchmarking im Bereich Multi-Agent Reinforcement Learning (MARL). BenchMARL ermöglicht den schnellen Vergleich verschiedener MARL-Algorithmen, -Aufgaben und -Modelle, gestützt auf die zwei Kernprinzipien: Reproduzierbarkeit und Standardisierung.

    656+0Sterne-Änderung der letzten 7 Tage
  • Vollständiger Lebenszyklus eines Data-Science-Projekts

    653+0Sterne-Änderung der letzten 7 Tage
  • ReinforcementLearning.jl@JuliaReinforcementLearning

    Ein Reinforcement-Learning-Paket für Julia

    652+1Sterne-Änderung der letzten 7 Tage
  • Neueste Fortschritte beim Long Chain-of-Thought Reasoning

    647+0Sterne-Änderung der letzten 7 Tage
  • pgx@sotetsuk

    Vektorisierten RL-Spielumgebungen in JAX

    643+2Sterne-Änderung der letzten 7 Tage
  • Seg-Zero@JIA-Lab-research

    Projektseite für „Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement“

    639+1Sterne-Änderung der letzten 7 Tage
  • DI-drive@opendilab

    Decision-Intelligence-Plattform für die Simulation autonomen Fahrens.

    639+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen