训练山地车逃脱#

来自 AI for Beginners Curriculum 的实验任务。

你的目标是训练强化学习代理来控制 OpenAI 环境中的 Mountain Car

让我们从创建环境开始:

In [1]:
import gym
env = gym.make('MountainCar-v0')

让我们看看随机实验是什么样子的:

In [2]:
state = env.reset()
while True:
    env.render()
    action = env.action_space.sample()
    state, reward, done, info = env.step(action)
    if done:
        break
In [ ]:
## Lost of code here
In [3]:
env.close()

免责声明
本文档使用AI翻译服务 Co-op Translator 进行翻译。尽管我们努力确保翻译的准确性,但请注意,自动翻译可能包含错误或不准确之处。应以原始语言的文档作为权威来源。对于关键信息,建议使用专业人工翻译。我们不对因使用此翻译而产生的任何误解或误读承担责任。