训练山地车逃脱#
来自 AI for Beginners Curriculum 的实验任务。
你的目标是训练强化学习代理来控制 OpenAI 环境中的 Mountain Car。
让我们从创建环境开始:
In [1]:
import gym
env = gym.make('MountainCar-v0')让我们看看随机实验是什么样子的:
In [2]:
state = env.reset()
while True:
env.render()
action = env.action_space.sample()
state, reward, done, info = env.step(action)
if done:
breakIn [ ]:
## Lost of code hereIn [3]:
env.close()免责声明:
本文档使用AI翻译服务 Co-op Translator 进行翻译。尽管我们努力确保翻译的准确性,但请注意,自动翻译可能包含错误或不准确之处。应以原始语言的文档作为权威来源。对于关键信息,建议使用专业人工翻译。我们不对因使用此翻译而产生的任何误解或误读承担责任。