【发布时间】:2022-11-10 18:55:38
【问题描述】:
from stable_baselines3 import A2C
model=A2C('MlpPolicy',env,verbose=1)
model.learn(total_timesteps=10000)
我在 CartPole-v1 上使用它
env=gym.make('CartPole-v1')
我得到
RuntimeError: Could not infer dtype of numpy.float32
【问题讨论】:
-
请澄清您的具体问题或提供其他详细信息以准确突出您的需求。正如它目前所写的那样,很难准确地说出你在问什么。
标签: python machine-learning reinforcement-learning stable-baselines