Zum Hauptinhalt springen
buildradar
Anmelden

vwxyzjn/cleanrl

@vwxyzjn

Hochwertige Ein-Datei-Implementierung von Deep-Reinforcement-Learning-Algorithmen mit forschungsfreundlichen Funktionen (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

Sterne
10.358
Forks
1.160
Sprache
Python
Lizenz
NOASSERTION
Letzter Push
vor 5 Monaten
Pythonpythonmachine-learningdeep-learninggymdeep-reinforcement-learningpytorchreinforcement-learningatarippoproximal-policy-optimizationa2cadvantage-actor-criticwandbactor-criticalephasic-policy-gradient

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.