当前位置:主页 > 资源下载 > 9 > 论文研究-基于CMAC的非参数化近似策略迭代增强学习.pdf下载

论文研究-基于CMAC的非参数化近似策略迭代增强学习.pdf下载

更新：2024-11-03 17:45:14
大小：915KB
推荐：★★★★★
来源：网友上传分享
类别：其它 - 开发技术
格式：PDF

反馈 / 投诉

资源介绍

为解决在线近似策略迭代增强学习计算复杂度高、收敛速度慢的问题，引入CMAC结构作为值函数逼近器，提出一种基于CMAC的非参数化近似策略迭代增强学习（NPAPI-CMAC）算法。算法通过构建样本采集过程确定CMAC泛化参数，利用初始划分和拓展划分确定CMAC状态划分方式，利用量化编码结构构建样本数集合定义增强学习率，实现了增强学习结构和参数的完全自动构建。此外，该算法利用delta规则和最近邻思想在学习过程中自适应调整增强学习参数，利用贪心策略对动作投票器得到的结果进行选择。一级倒立摆平衡控制的仿真实验结果验证了算法的有效性、鲁棒性和快速收敛能力。

上一篇: 论文研究-改进的模糊CMAC神经网络 .pdf
下一篇: CMAC源码小脑神经网络

相关推荐

论文研究-基于CMAC的非参数化近似策略迭代增强学习.pdf下载

资源介绍

热门标签

资源声明