强化学习 - OpenAI Gym初体验

本文详细介绍了如何使用Miniconda创建Python3.7.7环境,安装并配置OpenAI Gym库,解决依赖冲突,以及安装必要的系统库。通过一个简单的CartPole-v1示例演示了环境的正确设置。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

STEP 1:

miniconda新环境 python 3.7.7

 

STEP 2:

https://github.com/openai/gym

安装openai gym

pip install gym

报了两个包版本不兼容的error:

ERROR: spyder 4.1.4 requires pyqtwebengine<5.13; python_version >= "3", which is not installed.
ERROR: spyder 4.1.4 has requirement pyqt5<5.13; python_version >= "3", but you'll have pyqt5 5.15.0 which is incompatible.

指定一下版本进行安装:

pip install pyqt5==5.12
pip install pyqtwebengine==5.12

一切就绪。

 

安装其他,可能需要sudo:

apt-get install -y libglu1-mesa-dev libgl1-mesa-dev libosmesa6-dev xvfb ffmpeg curl patchelf libglfw3 libglfw3-dev cmake zlib1g zlib1g-dev swig

 

STEP3:

跑个小demo看看

import gym
env = gym.make("CartPole-v1")
observation = env.reset()
for _ in range(1000):
  env.render()
  action = env.action_space.sample() # your agent here (this takes random actions)
  observation, reward, done, info = env.step(action)

  if done:
    observation = env.reset()
env.close()

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值