作者:宋梅萍; 顾国昌; 张国印; 刘海波多agent学习一般和随机博弈nash平衡pareto占优
摘要:理性和收敛是多agent学习研究所追求的目标.在理性合作的多agent系统中提出利用Pareto占优解代替非合作的Nash平衡解进行学习,使agent更具理性.另一方面引入社会公约来启动和约束agent的推理,统一系统中所有agento决策,从而保证学习的收敛性.利用2人栅格游戏对多种算法进行验证,成功率的比较说明了所提算法具有较好的学习性能.
注:因版权方要求,不能公开全文,如需全文,请咨询杂志社