Pular para o conteúdo principal
buildradar
Entrar

TianhongDai/reinforcement-learning-algorithms

@TianhongDai

Este repositório contém a maioria das implementações em pytorch baseadas em algoritmos clássicos de aprendizado por reforço profundo, incluindo: DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO. (Mais algoritmos ainda estão em desenvolvimento)

Estrelas
697
Bifurcações
110
Linguagem
Python
Licença
Último push
há 9 meses
Pythondeep-learningdeep-reinforcement-learningpytorchalgorithmppoproximal-policy-optimizationsacsoft-actor-critica2cddpgdqnactor-criticatari2600dueling-dqnflappy-birdtrpotrust-region-policy-optimization

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.