【发布时间】:2016-09-28 04:06:45
【问题描述】:
我在 Tensorflow 中使用了 a3c implementation 的开源版本,它非常适合 atari 2600 实验。但是,当我为 Mujoco 修改网络时,作为outlined in the paper,网络拒绝学习任何有意义的东西。有没有人设法使任何 a3c 的开源实现能够处理持续的域问题,例如 mujoco?
【问题讨论】:
-
嗨@Sahil,我也在寻找 A3C 连续控制实现。我正在尝试使用 DQN 中的视觉输入来训练代理玩与cs.stanford.edu/people/karpathy/convnetjs/demo/rldemo.html 非常相似的游戏。我想知道您是否尝试过任何使用 DQN 的 2d 运动游戏并成功了?
-
我不认为我理解您的评论。你能改写一下吗?
标签: tensorflow deep-learning reinforcement-learning