腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
如何将
之前
的
状态
恢复
到
健身房
环境
deep-learning
、
reinforcement-learning
、
openai-gym
、
monte-carlo-tree-search
我正在尝试在Openai
的
atari
健身房
环境
中实现MCTS,这需要计划
的
能力:在
环境
中行动并将其
恢复
到
以前
的
状态
。我读到这可以用ram版本
的
游戏来实现: 在快照中记录当前
状态
:snapshot = env.ale.cloneState() 将
环境
恢复
到
快照中记录
的
特定
状态
:env.ale.restoreSta
浏览 39
提问于2020-06-12
得票数 1
回答已采纳
1
回答
如何在OpenAI
健身房
中列出每个
状态
的
可能后继
状态
?(严格适用于普通MDP)
python
、
machine-learning
、
artificial-intelligence
、
reinforcement-learning
、
openai-gym
有没有一种方法可以遍历每个
状态
,强制
环境
转到那个
状态
,然后执行一步,然后使用返回
的
"info“字典来查看所有可能
的
后继
状态
?或者一种更简单
的
方法来
恢复
每个
状态
的
所有可能
的
后继
状态
,可能隐藏在某个地方?我在网上看到一个叫MuJoKo或类似的东西有一个set_state功能,但我不想创建一个新
的
环境
,我只想设置openAi
健身房</
浏览 0
提问于2018-12-09
得票数 0
1
回答
如何查看gym.make('env')内部发生了什么
keras
、
controls
、
environment
、
reinforcement-learning
、
openai-gym
为了创建自己
的
环境
并使用github
的
一些代码,我需要查看gym.make('env')内部发生了什么,例如gym.make('carpole0') 在
健身房
里
的
github,我能找到它吗?如何编写“为DQN定义
环境
(env)”
的
更新部分,而DQN不在
健身房
库中?我正在寻找一个
环境
定义"env"示例上
的
github或其他资源,不是为Atari游戏设计
浏览 0
提问于2018-05-23
得票数 0
回答已采纳
1
回答
多个“连续行动”
的
深度强化学习
python-3.x
、
reinforcement-learning
、
openai-gym
下面是一个高层次
的
图表,我
的
代理人应该如何看起来,以便能够与一个定制
的
健身房
环境
,我所做
的
。该
环境
有三种
状态
( s1、s2、s3 )和6个动作( a1、a2、a3、a4、a5、a6
状态
和动作)可以是0
到
1之间
的
任意值。哪种算法适合我
的
问题?我知道有些算法擅长处理连续
的
操作空间,如DDPG、PPO等。但是,我看不出它们在每个时间步骤输
浏览 2
提问于2021-03-01
得票数 2
回答已采纳
1
回答
是否可以在训练前和训练期间修改OpenAI
健身房
状态
?
machine-learning
、
artificial-intelligence
、
openai-gym
、
openai
我想要做
的
是修改一个
环境
,例如,以Super Mario Bros
健身房
环境
为例,模糊智能体训练
的
图像,看看强化学习智能体是否仍然能够在这些“模糊”
状态
上学习。 OpenAI使这样
的
事情成为可能吗?如何添加
健身房
环境
预处理步骤?
浏览 38
提问于2020-11-11
得票数 1
回答已采纳
1
回答
在openai
健身房
中避免非法
状态
reinforcement-learning
、
openai-gym
我正在尝试为一个模拟问题创建一个
健身房
环境
。在我
的
健身房
环境
中,我有一组非法
的
状态
,我不希望我
的
经纪人进入这些
状态
。将这样
的
逻辑添加到我
的
环境
中最简单
的
方法是什么,我应该使用包装器类吗?我没有完全理解它们,我试图通过继承一个类来扩展MultiDiscrete空间,并覆盖MulriDiscrete.sample函数来阻止
环境
进入非法
状态</
浏览 13
提问于2020-04-01
得票数 0
1
回答
OpenAI-Gym中
的
定制
环境
development-environment
、
reinforcement-learning
、
openai-gym
我想试用Python中
的
强化学习。但我想为我自己
的
国家和奖励创造一个定制
的
环境
。 可能我想使用时间序列数据在这(但不像股票)。我想让我
的
系统按照时间来学习行为,给出一个
环境
。所以我首先要做一个定制
的
环境
,有人能帮我吗?
浏览 0
提问于2019-02-21
得票数 2
3
回答
脱机对等项如何更新Hyperledger Fabric中
的
状态
?
hyperledger-fabric
全,问候你,伯爵
浏览 1
提问于2017-03-30
得票数 2
1
回答
将R
环境
恢复
到
装入包
之前
的
状态
r
、
package
、
environment
、
restore
、
detach
gdistance实际上加载了几个其他
的
包,并且整体上屏蔽了tydiverse
的
一些功能(例如select)。 我尝试重新排列脚本,只在需要时加载gdistance,并将相关行放在脚本
的
末尾。无论如何,我需要
的
最后一行仍然使用函数throws::select,然后找不到它,并抛出一个错误。有没有办法在加载gdistance包
之前
复制R
环境
,这样我就可以将
环境
恢复
到
加载导致问题
的
包
之前
的</e
浏览 4
提问于2020-01-16
得票数 0
1
回答
在OpenAI
健身房
环境
中,初始
状态
是随机
的
还是特定
的
?
reinforcement-learning
、
openai-gym
是在像OpenAI
健身房
这样
的
强化学习
环境
中随机选择
的
初始
状态
。换句话说,命令env.reset()产生
的
是随机选择
的
初始
状态
还是特定
的
初始
状态
?
浏览 16
提问于2019-12-29
得票数 2
回答已采纳
1
回答
测试航班收据在应用程序重新启动后消失
ios
、
flutter
、
in-app-purchase
我们正在推出一个用于内部测试
的
测试飞行应用程序。我们
的
应用程序有应用内订阅。我们正在尝试测试我们
的
恢复
购买功能,但是在应用程序重新启动之后,收据就消失了。这是正常行为还是我们做错了什么?
浏览 4
提问于2020-04-01
得票数 0
回答已采纳
1
回答
考虑到我
的
状态
与我在
健身房
的
观察空间不同,我对探索开始
的
关注。
reinforcement-learning
、
openai-gym
我
的
状态
是一个定制
的
健身房
环境
是不一样
的
我
的
观察空间。观测是从
状态
计算出来
的
。从上面的问题你可以看到我是RL和Gym
的
newby。在上述情况下我应该使
浏览 3
提问于2021-11-23
得票数 0
1
回答
OpenAI
健身房
自定义
环境
:具有实值
的
离散观察空间
python
、
reinforcement-learning
、
openai-gym
、
discretization
我想创建自定义
的
openai
健身房
环境
,它有离散
的
状态
空间,但有浮点值。更精确地说,它应该是一个0.25步长
的
值范围: 10.0,10.25,10.5,10.75,11.0,...,19.75,20.0 有没有办法在openai
健身房
定制
环境
中做到这一点,使用离散空间,盒子
浏览 30
提问于2019-06-11
得票数 4
回答已采纳
2
回答
与开放ai
健身房
/稳定基线
的
集成
webots
开放人工智能
健身房
最有可能成为ML
的
基准测试标准,稳定基线算法是最受欢迎
的
ML库之一。有没有关于
如何将
Webots与
健身房
环境
集成
的
指南,以便可以使用稳定
的
基线?
健身房
环境
暴露了一些功能,比如step和reset,但是我不确定这些功能是如何用来控制webots
的
。如果有更多webots API/外部控制知识的人能够规划出集成
的
路径,我将非常感激-甚至为其他人写一份关于如何
浏览 2
提问于2020-01-17
得票数 0
1
回答
将PowerShell DSC与ITSM/变更管理集成
dsc
、
change-management
、
itsm
我们能够在我们
的
非生产测试
环境
中成功地创建和部署配置。 在我们在生产
环境
中实施DSC
之前
,我们
的
管理层需要将其与ITSM/变更管理相集成。现在,当LCM触发DSC配置以将服务
恢复
到
其原始
状态
时,即,“停止”。用户不知道为什么会发生这种情况,并且在LCM将服务
恢复
到
其原始
状态
之前
,我们没有任何更改票证。我们是否可以在LCM
恢复
/
恢复</e
浏览 39
提问于2020-10-22
得票数 0
2
回答
在开放式AI
健身房
中实现策略迭代方法
python
、
machine-learning
、
reinforcement-learning
、
openai-gym
我目前正在阅读Sutton & Barto
的
“强化学习”,我正在尝试自己编写一些方法。但是,对于策略迭代,我需要
状态
之间
的
转换矩阵和奖励矩阵。这些是从你在OpenAI
健身房
构建
的
‘
环境
’中获得
的
吗?如果不是,我如何计算这些
浏览 12
提问于2017-08-01
得票数 3
1
回答
JDK、Eclipse和路径变量
java
、
eclipse
因此,我按照一些说明去设置PATH变量,但发现它是由AMD设置
的
。然而,由于它存储在"Path“而不是"PATH”下,我认为它可能是大小写敏感
的
(没有太多
环境
变量
的
经验),于是创建了新
的
环境
变量。但这覆盖了AMD设置
的
Path变量,我收到一条消息,告诉我Catalyst Monitoring程序已经停止工作。那么,
如何将
Path变量
恢复
到
更改
之前
的
状态<
浏览 0
提问于2012-09-23
得票数 1
回答已采纳
1
回答
下载软件包时Conda安装被锁定
python
、
conda
我使用Anaconda
环境
来处理Python包
的
安装。我
之前
的
conda install命令在完成
之前
被中断了。如果我再次启动该命令,它现在会在下载软件包时被阻止。有没有办法在它工作时
恢复
到
以前
的
状态
?
浏览 4
提问于2017-05-09
得票数 1
2
回答
如何将
窗口取消最小化
到
精确
的
前一
状态
(
恢复
或最大化)?
windows
在Windows中,我有一个最小化
的
窗口,即前景窗口(GetForegroundWindow)。我现在想要取消最小化窗口,以便它再次可见。
如何将
窗口
恢复
到
以前
的
状态
?也就是说,如果窗口在最小化
之前
被“
恢复
”,那么它应该被
恢复
,如果它在被最小化
之前
被最大化,它应该再次被最大化,特别是不被
恢复
之类
的
。似乎我只能从{最小化,还原,最大化}中确定窗口的当前
状态
,但理论上,
浏览 5
提问于2009-08-31
得票数 0
回答已采纳
2
回答
如何在git上还原远程裸存储库
git
我已经完成了此链接中描述
的
过程我想我可能只需要在本地
恢复
并推送(结帐将正常工作),但我不确定。请注意,这不是一个最终
的
恢复
,只是一个临时
的
恢复
(把它想象成我在应该
之前
将最新
的
更改推到了生产
环境
中)
浏览 0
提问于2012-05-10
得票数 5
回答已采纳
点击加载更多
相关
资讯
如何将机器学习的模型部署到NET环境中?
美国健身品牌24 Hour Fitness再关100家店,目前已申请破产保护
精通“年轻人玩法”看格斗潮牌24KiCK如何破除“资本寒冬”
实战-MySQL定时增量备份(2)
如何将硬盘数据恢复?三种方法简单解决问题
热门
标签
更多标签
云服务器
ICP备案
对象存储
云点播
实时音视频
活动推荐
运营活动
广告
关闭
领券