Zum Hauptinhalt springen
buildradar
Sign in
Thema · proximal-policy-optimization

proximal-policy-optimization

Erfasste Open-Source-Repos mit dem Tag proximal-policy-optimization, sortiert nach Sternen.

Repos
7
Sterne gesamt
34.133
Sterne im Schnitt
4.876
Anteil
0,00%

Themen, die häufig gemeinsam mit proximal-policy-optimization am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit proximal-policy-optimization getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • cleanrl@vwxyzjn

    Hochwertige Ein-Datei-Implementierung von Deep-Reinforcement-Learning-Algorithmen mit forschungsfreundlichen Funktionen (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

    10.358+19Sterne-Änderung der letzten 7 Tage
  • OpenRLHF@OpenRLHF

    Ein benutzerfreundliches, skalierbares und leistungsstarkes Agentic-RL-Framework basierend auf Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    9.969+9Sterne-Änderung der letzten 7 Tage
  • Einfache Tutorials für Reinforcement Learning, Morvan Python Chinesischer AI-Unterricht

    9.508-2Sterne-Änderung der letzten 7 Tage
  • PPO-PyTorch@nikhilbarhate99

    Minimale Implementierung von PPO (Proximal Policy Optimization) mit gekappter Zielfunktion in PyTorch

    2.381+6Sterne-Änderung der letzten 7 Tage
  • Dieses Repository enthält die meisten PyTorch-Implementierungen klassischer Deep-Reinforcement-Learning-Algorithmen, einschließlich DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO (weitere Algorithmen in Entwicklung).

    697+1Sterne-Änderung der letzten 7 Tage
  • Eine PyTorch-Bibliothek zum Erstellen von Deep-Reinforcement-Learning-Agenten.

    657+0Sterne-Änderung der letzten 7 Tage
  • Deep Reinforcement Learning (PPO) im autonomen Fahren (Carla) [von Grund auf]

    563-1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen