基于后悔值的多蚁协作关联强化学习模型

来源 :系统工程 | 被引量 : 0次 | 上传用户:zxjds
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
自适应蚁群算法是蚁群算法的衍生,并成功有效地解决了许多路径优化问题,但随着问题规模增大,自适应蚁群算法已不能有效快速地得到我们期盼的结果。对于大规模的路径优化问题,根据分布式的思想,引入关联强化学习和后悔值以最大限度降低每一步决策对全局解的坏影响,实现多蚁之间的协作来提高解的质量,并缩短寻优时间,并加入2-opt算法避免陷入局部最优。以TSP为例,对比了不同规模的TSP的仿真结果,并加以分析得出结论。 Adaptive ant colony algorithm is a derivative of ant colony algorithm and successfully solves many path optimization problems. However, as the scale of the problem increases, adaptive ant colony algorithm can not get the result we expect quickly and effectively. For large-scale path optimization problems, according to the distributed thought, the introduction of association reinforcement learning and regret values ​​to minimize the impact of each step of the decision-making on the global solution to achieve collaboration between multiple ants to improve the quality of the solution and shorten Find the best time, and add 2-opt algorithm to avoid falling into local optimum. Taking TSP as an example, the simulation results of TSP with different scales are compared and analyzed.
其他文献
法国政府三部委日前联合签署决议,将法国手机电视标准确定为DVB-H,并希望在20 08年北京奥运会之前将手机电视推上市场。根据决议,法国政府将开始启动手机电视的推广计划,争取
(一)“不好了,大堤发现蚁穴啦,快来抢险啊!”8月18日17时,一声惊人的呼叫打破了天空的宁静。58岁的黄保林老人闻讯赶到现场,看到碗口粗的蚁洞浑水直冒,他果断地向领导建议:“赶快打抱围。”建
在交互多模IMM的基础上,利用时变马尔可夫链切换系数对模型进行切换,实现对未知状态转移概率的自适应调节,提高了对机动目标的跟踪精度.仿真结果表明,改进后的IMM算法比IMM算
通过问卷调查的形式针对疫情期间江汉大学线上学习教学环境及平台,学生线上学习体验及态度,学生线上学习效果和线上教学需要进一步改进的地方进行了调研分析,得出了学生线上
共产党员张恩信是桦甸市第一食品厂的电工。他以厂为家,爱岗敬业,干主人活,尽主人责,在职工中威信很高,多次被评为县、市级劳动模范、优秀共产党员。张恩信家离厂七八公里,但28年中他
一、自读自改,自我提高  文章不厌百回改,修改习作要教育学生自读自改,养成良好习惯,同时教师要让出更多时间给学生,让他们反复朗读自己的习作,读中修改完善习作。读中修改,我觉得读文章最少要经过四个来回:第一遍可以高声朗读。立足全篇,要看自己想说的事有没有说清楚,叙述顺序是否正确,表达是否准确,发现问题要及时调整;第二遍默读,运用符号修改文中的错别字、表达不恰当的词语和错误的标点符号。第三遍逐句逐段轻
期刊
引言专家统计得出:中国目前约有1.34亿六十岁以上的老年人,占中国总人口的百分之十,并以年均3.2%的速度递增。在2000年至2010年间,中国成为典型的老年型人口国家,所以老年消
福洞镇位于和龙市东部,过去曾是和龙市有名的“老大难”乡镇。为了彻底改变贫穷落后面貌,镇党委针对福洞镇经济发展滞后的实际,进行了认真的反思。镇党委感到:要想带领群众脱贫致
元日【宋】王安石爆竹声中一岁除,春风送暖入屠苏。千门万户曈曈日,总把新桃换旧符。歌谣里的年俗有一首《老北京童谣》:小孩小孩你别馋,过了腊八就是年;腊八粥喝几天,哩哩啦
期刊