合肥金星智控科技股份有限公司
宣传

位置:中冶有色 >

有色技术频道 >

> 化学分析技术

> 动态强化学习决策训练系统

动态强化学习决策训练系统

700   编辑:管理员   来源:中冶有色技术网  
2023-03-19 06:57:24
一种动态强化学习决策训练系统,包括强化学习模型、训练环境模块、强化学习模型与训练环境模块之间的数据接口;训练环境模块由环境执行引擎模块、观测构建模块、回报计算模块三个功能模块构成;环境执行引擎模块,用于维护一个底层状态数据结构,输出包含所有状态信息的底层状态数据;观测构建模块,用于负责将底层状态数据转换为适应不同算法需求的状态信息形式,在训练过程中训练环境模块通过回调或动态加载机制调用对应观测构建模块将底层状态数据重构生成状态信息;回报计算模块,用于针对多种回报生成条件设置回报检查点,训练环境模块执行步长中计算检查点回报值并输出;强化学习模型与训练环境模块之间的数据接口包括:状态信息发送接口、动作接收接口、回报发送接口;极大增强算法普适性,降低接口设计难度,同时减小环境对算法形态的限制。
声明:
“动态强化学习决策训练系统” 该技术专利(论文)所有权利归属于技术(论文)所有人。仅供学习研究,如用于商业用途,请联系该技术所有人。
我是此专利(论文)的发明人(作者)
分享 0
         
举报 0
收藏 0
反对 0
点赞 0
标签:
化学分析
全国热门有色金属技术推荐
展开更多 +

 

中冶有色技术平台微信公众号
了解更多信息请您扫码关注官方微信
中冶有色技术平台微信公众号中冶有色技术平台

最新更新技术

报名参会
更多+

报告下载

第二届关键基础材料模拟、制备与评价技术交流会
推广

热门技术
更多+

衡水宏运压滤机有限公司
宣传
环磨科技控股(集团)有限公司
宣传

发布

在线客服

公众号

电话

顶部
咨询电话:
010-88793500-807
专利人/作者信息登记