メインコンテンツへスキップ
buildradar
ログイン

TianhongDai/reinforcement-learning-algorithms

@TianhongDai

このリポジトリには、DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPOなどの古典的な深層強化学習アルゴリズムに基づくPyTorch実装の大半が含まれています(その他のアルゴリズムも順次追加予定)

スター
697
フォーク
110
言語
Python
ライセンス
最終プッシュ
9 か月前
Pythondeep-learningdeep-reinforcement-learningpytorchalgorithmppoproximal-policy-optimizationsacsoft-actor-critica2cddpgdqnactor-criticatari2600dueling-dqnflappy-birdtrpotrust-region-policy-optimization

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。