reinforcement-learning-algorithms
Erfasste Open-Source-Repos mit dem Tag reinforcement-learning-algorithms, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit reinforcement-learning-algorithms am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit reinforcement-learning-algorithms getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
PyTorch-Version von Stable Baselines, zuverlässige Implementierungen von Reinforcement-Learning-Algorithmen.
★ 13.758+29Sterne-Änderung der letzten 7 Tage - #2
Repository für das Deep Reinforcement Learning Nanodegree-Programm
★ 5.176+0Sterne-Änderung der letzten 7 Tage - #3
OpenDILab Decision AI Engine. Das umfassendste Reinforcement-Learning-Framework.
★ 3.642+4Sterne-Änderung der letzten 7 Tage - #4
Minimale Implementierung von PPO (Proximal Policy Optimization) mit gekappter Zielfunktion in PyTorch
★ 2.381+6Sterne-Änderung der letzten 7 Tage - #5
Eine kuratierte Liste fantastischer modellbasierter RL-Ressourcen (laufend aktualisiert)
★ 1.393+0Sterne-Änderung der letzten 7 Tage - #6
Eine einfache und gut strukturierte PPO-Implementierung. Basiert auf meiner Medium-Serie: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.
★ 1.269+1Sterne-Änderung der letzten 7 Tage - #7★ 1.114+4Sterne-Änderung der letzten 7 Tage
- #8★ 1.102+2Sterne-Änderung der letzten 7 Tage
- #9
UI-Venus ist ein nativer UI-Agent, der entwickelt wurde, um präzises GUI-Element-Grounding und effektive Navigation nur mit Screenshots als Eingabe durchzuführen.
★ 1.037+20Sterne-Änderung der letzten 7 Tage - #10
Eine kuratierte Liste von Ressourcen zu Decision Transformer (wird laufend aktualisiert).
★ 916+1Sterne-Änderung der letzten 7 Tage - #11
NMA-Kurs für Deep Learning
★ 812+1Sterne-Änderung der letzten 7 Tage - #12
MDPs und POMDPs in Julia – Eine Schnittstelle zum Definieren, Lösen und Simulieren vollständig und teilweise beobachtbarer Markov-Entscheidungsprozesse auf diskreten und kontinuierlichen Räumen.
★ 766+0Sterne-Änderung der letzten 7 Tage - #13
Contrib-Paket für Stable-Baselines3 – Experimenteller Reinforcement-Learning-Code (RL)
★ 736+4Sterne-Änderung der letzten 7 Tage - #14
Dies ist ein Projekt über einen Algorithmus zum autonomen Hindernisausweichen für UAVs mittels Deep Reinforcement Learning.
★ 730+2Sterne-Änderung der letzten 7 Tage - #15
Begleitcode zur Nature-Veröffentlichung „Discovering State-of-the-art Reinforcement Algorithms“
★ 728+1Sterne-Änderung der letzten 7 Tage - #16
Eine kuratierte Liste von großartigen Ressourcen zum explorativen Reinforcement Learning (wird laufend aktualisiert)
★ 723+0Sterne-Änderung der letzten 7 Tage - #17
Code zum Paper 'Computation Offloading Optimization for UAV-assisted Mobile Edge Computing: A Deep Deterministic Policy Gradient Approach'.
★ 722+0Sterne-Änderung der letzten 7 Tage - #18
🤖 Das vollständige Python-Paket für Robot Learning from Demonstration und Roboter-Manipulation
★ 720+1Sterne-Änderung der letzten 7 Tage - #19
Eine kuratierte Liste von Monte-Carlo-Tree-Search-Papern mit Implementierungen.
★ 715+1Sterne-Änderung der letzten 7 Tage - #20
Eine PyTorch-Bibliothek zum Erstellen von Deep-Reinforcement-Learning-Agenten.
★ 657+1Sterne-Änderung der letzten 7 Tage - #21
[ICLR 2026] Offizieller Code für TraceRL: Revolutionierung des Post-Trainings für Diffusion LLMs, die Basis der SOTA TraDo-Serie.
★ 520+1Sterne-Änderung der letzten 7 Tage