Tópico · trust-region-policy-optimization
trust-region-policy-optimization
Repositórios de código aberto acompanhados marcados com trust-region-policy-optimization, ordenados por estrelas.
Repositórios
1
Total de estrelas
696
Média de estrelas
696
Participação
0,00%
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de trust-region-policy-optimization no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com trust-region-policy-optimization.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Este repositório contém a maioria das implementações em pytorch baseadas em algoritmos clássicos de aprendizado por reforço profundo, incluindo: DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO. (Mais algoritmos ainda estão em desenvolvimento)
★ 697+1Variação de estrelas nos últimos 7 dias