【发布时间】:2019-06-25 11:29:53
【问题描述】:
我的问题是为什么当我两次训练相同的算法时,每次训练它都会给出不同的结果? 是正常还是数据或代码有问题?
算法是deep deterministic policy gradient。
【问题讨论】:
-
您需要在问题中提供更多详细信息,包括代码 sn-ps 和数据示例。请参阅有关如何制作MCVE 的指南
-
一般来说,大多数模型、平衡方法等都有一个随机种子,您可以将其设置为固定值以获得可重复的结果
标签: python tensorflow deep-learning reinforcement-learning