Zum Hauptinhalt springen
buildradar
Sign in
Thema · ppo

ppo

Erfasste Open-Source-Repos mit dem Tag ppo, sortiert nach Sternen.

Repos
26
Sterne gesamt
86.096
Sterne im Schnitt
3.311
Anteil
0,00%

Themen, die häufig gemeinsam mit ppo am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit ppo getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • easy-rl@datawhalechina

    Chinesisches Tutorial zum Reinforcement Learning (Pilz-Buch 🍄), Online-Leseadresse: https://datawhalechina.github.io/easy-rl/

    14.592+28Sterne-Änderung der letzten 7 Tage
  • tianshou@thu-ml

    Eine elegante PyTorch-Bibliothek für Deep Reinforcement Learning.

    10.945+11Sterne-Änderung der letzten 7 Tage
  • cleanrl@vwxyzjn

    Hochwertige Ein-Datei-Implementierung von Deep-Reinforcement-Learning-Algorithmen mit forschungsfreundlichen Funktionen (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

    10.339+36Sterne-Änderung der letzten 7 Tage
  • Einfache Tutorials für Reinforcement Learning, Morvan Python Chinesischer AI-Unterricht

    9.510+7Sterne-Änderung der letzten 7 Tage
  • deep-reinforcement-learning@udacity

    Repository für das Deep Reinforcement Learning Nanodegree-Programm

    5.176+0Sterne-Änderung der letzten 7 Tage
  • ElegantRL@AI4Finance-Foundation

    Massiv paralleles Deep Reinforcement Learning. 🔥

    4.357+1Sterne-Änderung der letzten 7 Tage
  • hands-on-modern-rl@walkinglabs

    🚀 Ein Open-Source-Praxislehrplan, der die Lücke von grundlegenden RL-Konzepten bis hin zu LLM-Alignment, RLVR und fortgeschrittenen Agentensystemen schließt.

    4.145+94Sterne-Änderung der letzten 7 Tage
  • FinRL-Trading@AI4Finance-Foundation

    FinRL-X: Eine KI-native, modulare Infrastruktur für den quantitativen Handel

    3.607+25Sterne-Änderung der letzten 7 Tage
  • DeepRL@ShangtongZhang

    Modularisierte Implementierung von Deep-RL-Algorithmen in PyTorch

    3.449+2Sterne-Änderung der letzten 7 Tage
  • DRL-Pytorch@XinJingHao

    Saubere, robuste und einheitliche PyTorch-Implementierung beliebter Deep Reinforcement Learning (DRL)-Algorithmen (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)

    3.437+4Sterne-Änderung der letzten 7 Tage
  • PPO-PyTorch@nikhilbarhate99

    Minimale Implementierung von PPO (Proximal Policy Optimization) mit gekappter Zielfunktion in PyTorch

    2.376+0Sterne-Änderung der letzten 7 Tage
  • on-policy@marlbenchmark

    Dies ist die offizielle Implementierung von Multi-Agent PPO (MAPPO).

    2.087+2Sterne-Änderung der letzten 7 Tage
  • SLM-Lab@kengz

    Modulares Deep-Reinforcement-Learning-Framework in PyTorch. Begleitbibliothek zum Buch "Foundations of Deep Reinforcement Learning".

    1.362-1Sterne-Änderung der letzten 7 Tage
  • PPO-for-Beginners@ericyangyu

    Eine einfache und gut strukturierte PPO-Implementierung. Basiert auf meiner Medium-Serie: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.

    1.268+3Sterne-Änderung der letzten 7 Tage
  • LearningHumanoidWalking@rohanpsingh

    Training eines humanoiden Roboters für die Fortbewegung mittels Reinforcement Learning

    1.207+1Sterne-Änderung der letzten 7 Tage
  • purejaxrl@luchris429

    Sehr schnelle End-to-End-Jax-RL-Implementierungen

    1.100+2Sterne-Änderung der letzten 7 Tage
  • xuance@agi-brain

    XuanCe: Eine umfassende und einheitliche Deep-Reinforcement-Learning-Bibliothek

    1.081+1Sterne-Änderung der letzten 7 Tage
  • HALOs@ContextualAI

    Eine Bibliothek mit erweiterbaren Implementierungen von DPO, KTO, PPO, ORPO und anderen menschzentrierten Verlustfunktionen (HALOs).

    910+0Sterne-Änderung der letzten 7 Tage
  • rl-starter-files@lcswillems

    RL-Starterdateien zum sofortigen Trainieren, Visualisieren und Evaluieren eines Agenten ohne eine einzige Zeile Code

    728+1Sterne-Änderung der letzten 7 Tage
  • Dieses Repository enthält die meisten PyTorch-Implementierungen klassischer Deep-Reinforcement-Learning-Algorithmen, einschließlich DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO (weitere Algorithmen in Entwicklung).

    696+0Sterne-Änderung der letzten 7 Tage
  • oat@sail-sg

    OAT: Ein forschungsfreundliches Framework für das Online-Alignment von LLMs, einschließlich Reinforcement Learning, Präferenzlernen usw.

    670-1Sterne-Änderung der letzten 7 Tage
  • Eine PyTorch-Bibliothek zum Erstellen von Deep-Reinforcement-Learning-Agenten.

    657+1Sterne-Änderung der letzten 7 Tage
  • Open-AgentRL@Gen-Verse

    RLAnything (ICML 2026) & AutoTool (ICML 2026), DemyAgent: Open-Source-RL für LLMs und Agentenszenarien

    625+1Sterne-Änderung der letzten 7 Tage
  • LLamaTuner@jianzhnie

    Einfaches und effizientes Finetuning von LLMs. (Unterstützt LLama, LLama2, LLama3, Qwen, Baichuan, GLM, Falcon)

    621+0Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Forschungsarbeiten zu Reinforcement Learning für die Videogenerierung

    590+2Sterne-Änderung der letzten 7 Tage
  • Deep Reinforcement Learning (PPO) im autonomen Fahren (Carla) [von Grund auf]

    564+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen