ppo
Erfasste Open-Source-Repos mit dem Tag ppo, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit ppo am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit ppo getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Chinesisches Tutorial zum Reinforcement Learning (Pilz-Buch 🍄), Online-Leseadresse: https://datawhalechina.github.io/easy-rl/
★ 14.592+28Sterne-Änderung der letzten 7 Tage - #2★ 10.945+11Sterne-Änderung der letzten 7 Tage
- #3
Hochwertige Ein-Datei-Implementierung von Deep-Reinforcement-Learning-Algorithmen mit forschungsfreundlichen Funktionen (PPO, DQN, C51, DDPG, TD3, SAC, PPG)
★ 10.339+36Sterne-Änderung der letzten 7 Tage - #4
Einfache Tutorials für Reinforcement Learning, Morvan Python Chinesischer AI-Unterricht
★ 9.510+7Sterne-Änderung der letzten 7 Tage - #5
Repository für das Deep Reinforcement Learning Nanodegree-Programm
★ 5.176+0Sterne-Änderung der letzten 7 Tage - #6★ 4.357+1Sterne-Änderung der letzten 7 Tage
- #7
🚀 Ein Open-Source-Praxislehrplan, der die Lücke von grundlegenden RL-Konzepten bis hin zu LLM-Alignment, RLVR und fortgeschrittenen Agentensystemen schließt.
★ 4.145+94Sterne-Änderung der letzten 7 Tage - #8
FinRL-X: Eine KI-native, modulare Infrastruktur für den quantitativen Handel
★ 3.607+25Sterne-Änderung der letzten 7 Tage - #9★ 3.449+2Sterne-Änderung der letzten 7 Tage
- #10
Saubere, robuste und einheitliche PyTorch-Implementierung beliebter Deep Reinforcement Learning (DRL)-Algorithmen (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)
★ 3.437+4Sterne-Änderung der letzten 7 Tage - #11
Minimale Implementierung von PPO (Proximal Policy Optimization) mit gekappter Zielfunktion in PyTorch
★ 2.376+0Sterne-Änderung der letzten 7 Tage - #12★ 2.087+2Sterne-Änderung der letzten 7 Tage
- #13
Modulares Deep-Reinforcement-Learning-Framework in PyTorch. Begleitbibliothek zum Buch "Foundations of Deep Reinforcement Learning".
★ 1.362-1Sterne-Änderung der letzten 7 Tage - #14
Eine einfache und gut strukturierte PPO-Implementierung. Basiert auf meiner Medium-Serie: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.
★ 1.268+3Sterne-Änderung der letzten 7 Tage - #15
Training eines humanoiden Roboters für die Fortbewegung mittels Reinforcement Learning
★ 1.207+1Sterne-Änderung der letzten 7 Tage - #16★ 1.100+2Sterne-Änderung der letzten 7 Tage
- #17★ 1.081+1Sterne-Änderung der letzten 7 Tage
- #18
Eine Bibliothek mit erweiterbaren Implementierungen von DPO, KTO, PPO, ORPO und anderen menschzentrierten Verlustfunktionen (HALOs).
★ 910+0Sterne-Änderung der letzten 7 Tage - #19
RL-Starterdateien zum sofortigen Trainieren, Visualisieren und Evaluieren eines Agenten ohne eine einzige Zeile Code
★ 728+1Sterne-Änderung der letzten 7 Tage - #20
Dieses Repository enthält die meisten PyTorch-Implementierungen klassischer Deep-Reinforcement-Learning-Algorithmen, einschließlich DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO (weitere Algorithmen in Entwicklung).
★ 696+0Sterne-Änderung der letzten 7 Tage - #21
OAT: Ein forschungsfreundliches Framework für das Online-Alignment von LLMs, einschließlich Reinforcement Learning, Präferenzlernen usw.
★ 670-1Sterne-Änderung der letzten 7 Tage - #22
Eine PyTorch-Bibliothek zum Erstellen von Deep-Reinforcement-Learning-Agenten.
★ 657+1Sterne-Änderung der letzten 7 Tage - #23
RLAnything (ICML 2026) & AutoTool (ICML 2026), DemyAgent: Open-Source-RL für LLMs und Agentenszenarien
★ 625+1Sterne-Änderung der letzten 7 Tage - #24
Einfaches und effizientes Finetuning von LLMs. (Unterstützt LLama, LLama2, LLama3, Qwen, Baichuan, GLM, Falcon)
★ 621+0Sterne-Änderung der letzten 7 Tage - #25
Eine kuratierte Liste von Forschungsarbeiten zu Reinforcement Learning für die Videogenerierung
★ 590+2Sterne-Änderung der letzten 7 Tage - #26
Deep Reinforcement Learning (PPO) im autonomen Fahren (Carla) [von Grund auf]
★ 564+1Sterne-Änderung der letzten 7 Tage