reinforcement-learning
Erfasste Open-Source-Repos mit dem Tag reinforcement-learning, sortiert nach Sternen.
- #241
Eine Sammlung aktueller Arbeiten zum Aufbau autonomer Agenten. Zwei Themen enthalten: RL-basierte / LLM-basierte Agenten.
★ 758+1Sterne-Änderung der letzten 7 Tage - #242★ 737+2Sterne-Änderung der letzten 7 Tage
- #243
Contrib-Paket für Stable-Baselines3 – Experimenteller Reinforcement-Learning-Code (RL)
★ 736+4Sterne-Änderung der letzten 7 Tage - #244
Dies ist ein Projekt über einen Algorithmus zum autonomen Hindernisausweichen für UAVs mittels Deep Reinforcement Learning.
★ 730+2Sterne-Änderung der letzten 7 Tage - #245★ 730+1Sterne-Änderung der letzten 7 Tage
- #246
Begleitcode zur Nature-Veröffentlichung „Discovering State-of-the-art Reinforcement Algorithms“
★ 728+1Sterne-Änderung der letzten 7 Tage - #247★ 726+0Sterne-Änderung der letzten 7 Tage
- #248
Eine kuratierte Liste von großartigen Ressourcen zum explorativen Reinforcement Learning (wird laufend aktualisiert)
★ 723+0Sterne-Änderung der letzten 7 Tage - #249
Poker-Engine für die Entwicklung von Poker-KI in Python
★ 722+0Sterne-Änderung der letzten 7 Tage - #250
Code zum Paper 'Computation Offloading Optimization for UAV-assisted Mobile Edge Computing: A Deep Deterministic Policy Gradient Approach'.
★ 722+0Sterne-Änderung der letzten 7 Tage - #251
Texas-Holdem-OpenAI-Gym-Poker-Umgebung mit Reinforcement Learning auf Basis von keras-rl. Inklusive virtuellem Rendering und Monte-Carlo-Simulation zur Equity-Berechnung.
★ 722+1Sterne-Änderung der letzten 7 Tage - #252
[COLM’25] DeepRetrieval — 🔥 Training von Suchagenten durch RLVR mit Suchergebnis
★ 718+0Sterne-Änderung der letzten 7 Tage - #253
Eine kuratierte Liste von Monte-Carlo-Tree-Search-Papern mit Implementierungen.
★ 715+1Sterne-Änderung der letzten 7 Tage - #254
KI-Forschungsplattform für Reinforcement Learning aus echten Panoramabildern.
★ 714+2Sterne-Änderung der letzten 7 Tage - #255
Reinforcement Learning mit modellprädiktiver Regelung
★ 710+0Sterne-Änderung der letzten 7 Tage - #256
Feingetunte MARL-Algorithmen auf SMAC (100 % Siegtrefferquote in den meisten Szenarien)
★ 708+0Sterne-Änderung der letzten 7 Tage - #257
Eine umfassende Frontend-Sammlung und Übersicht von Vision-Language-Model-Papern und -Modellen auf GitHub. Kontinuierliche Updates.
★ 706+5Sterne-Änderung der letzten 7 Tage - #258★ 692+1Sterne-Änderung der letzten 7 Tage
- #259
Ein einheitliches Framework für einfaches Reinforcement Learning in Flow-Matching-Modellen
★ 690+6Sterne-Änderung der letzten 7 Tage - #260
Implementierung von Algorithmen für Inverse Reinforcement Learning (IRL) in Python/Tensorflow. Deep MaxEnt, MaxEnt, LPIRL
★ 681+2Sterne-Änderung der letzten 7 Tage - #261
Hearthstone-Simulator in C++ mit etwas Reinforcement Learning
★ 680+2Sterne-Änderung der letzten 7 Tage - #262
Ein C++-Framework für MDPs und POMDPs mit Python-Anbindungen
★ 671+1Sterne-Änderung der letzten 7 Tage - #263
Eine PyTorch-Bibliothek zum Erstellen von Deep-Reinforcement-Learning-Agenten.
★ 657+1Sterne-Änderung der letzten 7 Tage - #264
BenchMARL ist eine Bibliothek für Benchmarking im Bereich Multi-Agent Reinforcement Learning (MARL). BenchMARL ermöglicht den schnellen Vergleich verschiedener MARL-Algorithmen, -Aufgaben und -Modelle, gestützt auf die zwei Kernprinzipien: Reproduzierbarkeit und Standardisierung.
★ 656+0Sterne-Änderung der letzten 7 Tage - #265
Vollständiger Lebenszyklus eines Data-Science-Projekts
★ 653+0Sterne-Änderung der letzten 7 Tage - #266
Ein Reinforcement-Learning-Paket für Julia
★ 652+1Sterne-Änderung der letzten 7 Tage - #267
Neueste Fortschritte beim Long Chain-of-Thought Reasoning
★ 647+0Sterne-Änderung der letzten 7 Tage - #268★ 643+2Sterne-Änderung der letzten 7 Tage
- #269
Projektseite für „Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement“
★ 639+1Sterne-Änderung der letzten 7 Tage - #270★ 639+0Sterne-Änderung der letzten 7 Tage