固定长度经验回放对Q学习效率的影响

作者：林啊; 朱纪洪; 孙增圻经验回放再励学习q学习

摘要：提出了一种固定长度经验回放的思想，并将该思想与一步Q和pengQ（λ）学习算法相结合，得到了相应的改进算法。该文采用不同的回放长度L将改进的算法应用在网格环境和汽车爬坡问题中进行了仿真。结果表明，改进的一步Q学习算法在两个例子中都比原算法具有更好的学习效率。改进的PengQ（λ）学习在马尔呵夫环境中对选择探索动作非常敏感。增大L几乎不能提高学习的效率，甚至会使学习效率变差；但是在具有非马尔可夫属性的环境中对选择探索动作比较不敏感，增大L能够显著提高算法的学习速度。实验结果对如何选择适当的L有着指导作用。

注：因版权方要求，不能公开全文，如需全文，请咨询杂志社

学术咨询在线咨询

计算机工程

《计算机工程》（CN：31-1289/TP）是一本有较高学术价值的大型月刊，自创刊以来，选题新奇而不失报道广度，服务大众而不失理论高度。颇受业界和广大读者的关注和好评。《计算机工程》特点：以最快的速度、科学求实的精神，精选刊登代表计算机行业前沿科研、技术、工程方面的高、精、尖优秀论文。

杂志详情

服务推荐

计算机工程相关期刊

固定长度经验回放对Q学习效率的影响

服务推荐

在线咨询

杂志订阅

期刊推荐

网友世界

计算机光盘软件与应用

计算机与网络

计算机仿真