ikostrikov

ikostrikov/pytorch-a2c-ppo-acktr-gail

PyTorch implementation of Advantage Actor Critic (A2C), Proximal Policy Optimization (PPO), Scalable trust-region method for deep reinforcement learning using Kronecker-factored approximation (ACKTR) and Generative Adversarial Imitation Learning (GAIL).

⭐ 3.9k ⑂ 840 Python MIT · 2022-05-29推送
3.9k
Watchers
0
贡献者
0
Commits
0
Releases
93
Open Issues
2022-05-29
最近推送
原文 中文
暂无 README