来源:期刊VIP网 时间:
作者:王亮;顾益铭;刘世亮;
单位:同济大学机械与能源工程学院;
摘要:针对不同规模的柔性作业车间调度问题,提出一种基于图神经网络的深度强化学习算法(GRL)。该算法采用3个异构析取子图来表征车间状态,并利用图神经网络提取车间特征,构建相应的马尔可夫决策过程,使用模仿学习与强化学习相结合的联合训练策略来更新神经网络参数。实验结果表明,所提GRL算法在不同规模订单、工序复杂程度和机器选择柔性下表现出较低的最长完工时间和较小的案例参数敏感性。将小规则案例下训练的网络泛化至大规模案例,体现相对优先调度规则较好且稳定的求解质量。研究成果为项目式教学提供典型的人工智能应用案例。
关键词:强化学习;;图神经网络;;模仿学习;;柔性作业车间调度
基金资助:同济大学“第十八期实验教学改革专项基金重点项目(1000104171)