论文题目:
A degradation assess ment method for industrial robot in flexible manufacturing systems based on multiple physics-informed neural network
论文期刊:Mechanical Systems and Signal Processing
论文日期:2025年
论文链接:
https://doi.org/10.1016/j.ymssp.2025.112793
作者:Shijie Wang (a), Jianfent Tao (a*), Qinchent Jiang (a), Wei Chen (b), Chengliang Liu (a)
机构:
a. State Key Laboratory of Mechanical Systems and Vibration, Shang Hai Jiao Tong University, Shanghai 201100, China;
b. STEP Robot Co., Ltd., Shanghai 201800, China
第一作者简介:陶建峰老师,现任上海交通大学机械与动力工程学院机电控制与物流装备研究所教授。陶老师长期致力于机电系统智能控制与故障诊断领域的研究,主要研究方向包括智能液压系统控制及基础元件设计、复杂机电系统及基础元件故障诊断等,推动智能运维技术在高端装备领域的创新应用。在科研项目方面,他主持及参与了多项国家级重要课题,包括国家重点研发计划课题“射流伺服阀性能退化机理及健康管理”,以及国家自然科学基金面上项目“类矩形盾构环臂式电液伺服管片拼装机振动机理及其预测控制方法”。相关研究成果已在《Mechanical Systems and Signal Processing》、《Journal of Intelligent Manufacturing》等国际高水平期刊上发表多篇学术论文。(来源: https://me.sjtu.edu.cn/teacher_directory1/taojianfeng.html)
1 摘要
2 引言
3.1 物理信息神经网络
3.2 机器人动力学牛顿-欧拉方程
3.3 电机控制系统响应函数
3.4 通道注意力机制
3.5 改进的KL散度
4 方法论
4.1 物理信息神经网络理论
4.2 通道注意力-Inception-Unet框架
4.3 基于改进的KL散度的退化指标
5.1 实验设置
5.2 时间序列建模实验
5.3 减速器加速老化数据集的剩余寿命预测
5.4 PICAIU鲁棒性测试
5.5 多工况退化实验
6 结论
随着工业机器人应用范围的扩大,性能退化监测对制造系统具有重要意义。本文提出了一种名为物理信息通道注意力Inception-Unet(Physical-Informed Channel-Attention-Inception-Unet, PICAIU)的框架,用于预测工业机器人的剩余使用寿命(RUL),该框架可应用于评估减速器性能退化。为提高训练效率和预测精度,该方法将机器人动力学知识和伺服控制器信息嵌入数据驱动神经网络,并在Inception-Unet中引入通道注意力机制以融合运动特征与功率特征,从而获得精确的电机电流估计值。基于机器人谐波齿轮传动的老化实验数据,建立了可适用于其他机器人的相关寿命曲线。通过系列实验验证了所提方法的鲁棒性与泛化能力:消融实验表明,物理信息约束的引入提升了训练效率与收敛精度,有效缓解了通道注意力机制对样本量的需求;RUL预测误差较最佳基线模型降低26%;在同批次条件下,PICAIU仅需基线模型42%的训练轮次即可使拟合误差低于10%,显著节约训练时间与样本成本。通过双机器人交叉验证,在从丰富数据集泛化至贫乏数据集时,预测误差仅为6.4%,这在样本量受限的实际工业场景中具有应用潜力。
关键词:性能退化评估;柔性工况;知识驱动;工业机器人
当前智能制造发展背景下,远程健康监测与故障诊断技术对保障复杂实时系统的稳定运行具有重要意义。工程师通过传感器采集现场数据,依据专业知识评估设备状态、分析损伤机理并制定维护策略。作为生产线核心装备,工业机器人的健康状况直接关系到生产安全与效率。健康指标通过单一量化参数综合反映关键部件健康水平,是确定维护时机的关键依据。例如,轴承变形会加剧偏心旋转导致磨损,减速器损坏则易引发齿轮异响。因此,利用不同损伤状态下部件的动态特性差异,实现对机器人内部健康状态的实时监测与准确评估,对保障其安全运行、延长服役寿命至关重要。
在退化评估方面,轴承等重要部件已形成较成熟的技术路线。机器人领域虽有过基于扭矩偏差的评估方法探索,但因缺乏兼顾精度与效率的动力学仿真方案,相关研究进展有限。早期健康评估依赖人工特征(如有效值、峰值),在发动机等设备中效果显著。该类设备数据完整、要求严苛,而工业机器人作为柔性制造装备,其工况多变、性能波动常被接受,为健康指标构建带来挑战。目前主流方法通过基准数据对比或电流信号拟合工作循环,但仍受限于工况适应性。
工业机器人本质上是一种柔性复杂的机电系统。如图1所示,对于轴承等在稳定工况下运行的部件,其退化过程可借助历史序列数据进行推断。然而,在柔性制造环境中,机器人常需应对前所未有的新型工况,导致难以获得可资借鉴的历史数据。传统故障诊断方法大多基于开源数据集训练时间序列分类器以区分故障模式,这类研究在工业机器人场景中适用性有限。随着研究的深入,学者们逐渐认识到退化过程与控制理论中系统观测器的内在关联。
图1. 不同工况的退化特性
近期数据驱动研究侧重从退化数据中挖掘分类或回归模型,例如通过迁移学习与卷积网络识别故障,但过度依赖数据导致模型可解释性差。当前共识是,应结合领域知识推动人工智能发展。现有剩余寿命预测方法多针对固定工况设备,而工业机器人需摆脱对运动轨迹的依赖,建立适用于任意程序的统一健康评估框架。对于工业机器人,企业期望获得不依赖运动轨迹的健康评估方法,为任意运动程序建立统一的健康指标框架。基于上述研究现状,本文提出基于知识的通道注意力机制与多尺度卷积神经网络,以学习机器人关节中多维物理信号间的潜在动态关系。通过真实数据训练网络,节点计算模型输出与实际数据间的差异以判断系统是否存在退化。本文主要贡献如下:
提出面向柔性制造系统工业机器人的健康评估框架,通过估计电流与实测电流的改进KL散度生成退化指标,实现跨轨迹的通用化健康评估;
将牛顿-欧拉动力学与伺服电机控制关系嵌入损失项,通过机器人知识增强电机电流仿真神经网络的泛化能力与可靠性;
设计基于通道注意力的多序列关系建模方法,描述多轴机械臂不同关节间的相互作用,提升电流估计精度;
通过减速器加速寿命试验,系统验证所提退化预测方法相较传统方法的泛化优势,展示其对负载与轨迹变化的适应能力。
3.1 物理信息神经网络
物理信息神经网络(PINN)通过在损失函数中引入物理约束,该技术能够利用较少数据构建出泛化能力更强的模型。物理约束通过引入人类先验知识来指导神经网络学习,这一机制不仅能提升训练效率、降低数据采集成本,对于工业机器人的退化预测研究更具重要价值。此外,知识嵌入还有助于引导神经网络聚焦于关键特征的学习,从而避免被无意义噪声干扰,最终提高模型训练精度。受此启发,本文尝试将工业机器人的多层次知识体系引入深度学习任务,其损失函数如下式所示:
损失函数由两部分构成:基于机器人领域知识推导的物理方程计算得出 物理约束损失 ;通过样本真实值与网络输出值之间的差异计算得出 数据拟合损失 。本研究的核心思路正是通过构建物理约束损失,有效提升神经网络的数据利用效率。
3.2 机器人动力学牛顿-欧拉方程
机器人动力学方程如下式所示。等式左侧表征机器人的运动学与构型参数,右侧则对应关节扭矩等动力系统信号。其中,矩阵 D 为惯性矩阵,包含转动惯量与惯性积等参数:
其中,C 为阻尼矩阵,涵盖粘滞力系数、阻尼比等系统参数;M 为质量矩阵,反映机器人位姿的初始配置及与质量分布相关的参数;τ 与 σ 则对应于摩擦力、电磁阻尼等二次效应。q 表示广义位移,本文中主要指电机的旋转位移。N 表示扭矩。此外,牛顿-欧拉方程包含一套从末端负载力到基座扭矩的迭代方程组。
其中,
其中,系数
其中,
本文引入的另一项知识约束源于工业机器人采用的伺服电机。图 2 所示为伺服驱动下机器人关节系统的拉普拉斯模型:目标位置以给定电压
图2. 伺服电机系统模型
电流信号直接反映电磁扭矩,故
若将电流作为观测指标置于等号左侧,则该方程可转换为以下形式:
表 1 汇总了本文用于退化研究的机器人关节电机参数。由于电机退化程度相较于减速器或同步带而言相对较弱,其参数可作为实际分析中的现场校准参数。
表1 电机系统方程参数表
3.4 通道注意力机制
本文采用的通道注意力机制为挤压激励模块,该模块能够动态调整特征的重要性权重,突出更具价值的信息并抑制次要信息,从而提升模型对关键特征的关注度与整体性能。其实现过程包含三个步骤,具体如下:挤压操作:对于输入特征图
激励操作:随后对
其中
缩放操作:最终将获得的通道权重
通过上述步骤,通道注意力机制实现了对不同通道的自适应加权,从而突出重要特征通道并抑制非重要通道。
3.5 改进的KL散度
概率分布间的差异常采用KL散度进行度量。然而,由于其特定计算形式,KL散度的计算过程通常较为复杂。对于两个概率分布
对于连续概率分布
尽管KL散度具有重要应用价值,但其计算复杂度较高。为缓解此问题,本文提出改进KL散度以优化传统KL散度的计算效率。对于两个概率分布
对于连续概率分布
该改进形式通过引入平方根运算替代原始对数分量,有效降低了计算复杂度。在保持对两分布差异捕捉能力的同时,显著提升了计算效率。
4.1 物理信息神经网络理论
传统研究方法通常通过对比当前与历史时序数据,采用时域或频域指标来描述系统特定特征的退化过程。然而对于柔性场景中的工业机器人,轨迹与负载的改变同样会引起关节电流形态的变化,这一直是工业机器人剩余寿命预测面临的挑战。
本文从机器人动力学仿真中获得启发,尝试以仿真数据与采集数据间的系统性偏差作为不同任务的统一退化评估框架。如图3所示,这一引入机器人仿真知识的框架称为物理信息神经网络(PINN),包含数据采集框架与深度学习转换框架。
图3. 基于物理信息神经网络(PINN)的退化指标评估框架
4.2 通道注意力-Inception-Unet框架
本文设计的跨工况评估框架利用采集的健康状态数据训练代理模型,将实际运行信号输入代理模型后获得理论健康电流,其与实际电流的偏差被视为退化参考指标。本文设计了一种基于通道注意力机制的神经网络,该网络包含通道注意力模块和改进的UNet结构,与当前主流的自编码器框架或生成对抗网络框架存在显著差异。
该框架的主要特点之一是采用并行卷积结构实现图4中所示的多尺度卷积运算。该卷积模块被定义为引入模块,可改善传统卷积核不擅长提取多尺度特征的缺陷,从而更有效地学习时间序列的潜在信息。
图4. 通道注意力模块
多关节间的耦合效应会严重影响动力学求解精度,而如何从实时数据中识别当前关节耦合效应一直是机器人领域的难点。通道注意力机制能够增强多样本中的关键信息并抑制无效信息,因此本文将其自然应用于评估多关节多信号通道间的权重对应关系。针对本文研究的六关节机器人,输入信号包含六轴的关节角度、关节速度与关节电机功率。待处理的各序列长度为2048,故通道注意力模块的输入尺寸为2048。由于后续的初始网络将进行精细特征提取,本文未压缩通道数量,因此设定参数H=2048,W=1,C=18。涉及的部分神经网络计算函数如下所示:
基于SE注意力机制,实现了图5所示的通道注意力模块。损失项d通过实际电流与估计电流的偏差计算得出。
基于双序列的损失函数计算公式如下:
神经网络输出的电流序列记为
其中
包含物理信息约束与数据标签约束的损失函数可表示为:
4.3 基于改进的KL散度的退化指标
图 6 展示了利用KL散度计算机器人关节的剩余使用寿命。经过训练的网络等效于真实机器人的个性化数字孪生体,该孪生体记录了机器人处于完全健康状态时的潜在动力学关系。通过向孪生机器人输入实际运动与振动信号,可获得设备在完全健康状态下的理论扭矩输出。在此框架下,实际扭矩信号与理论扭矩信号构成两组不同的概率分布:当前状态下的实际电流记为
图6. 基于改进KL散度的退化指标
初始的实际电流为
改进KL散度能够有效度量先验分布
5.1 实验设置
实验系统采用 JAKA Zu-12 和 JAKA Zu-16 两款机器人平台。两款机器人额定负载相差4kg且配备不同型号减速器,但末端法兰规格完全一致,可执行相同的加工任务。其中Zu-12老化速率较快,故以其数据作为主要实验样本,Zu-16 数据仅用于验证模型泛化性能。系统配备负载敏感型电主轴与激光扫描仪,可通过扫描工作台工件获取表面点云数据,并为焊缝抛光任务规划实时运动轨迹。实验系统采用JAKA Zu-12与JAKA Zu-16两台机器人平台开展验证。如图 7 所示,待加工件为高碳钢焊接构件,需对4条厚度约4cm的焊缝进行抛光处理。
图7. 机器人实验制造系统
由于工件更换耗时较长,实验选择0.1–0.15mm范围的随机进给量进行每次抛光加工。为加速部件磨损,实验前将减速器内部润滑脂全部清除,迫使齿轮以干摩擦形式啮合。该实验针对高碳钢焊缝抛光场景,机器人末端关节承受的负载力在600–1000N区间波动,经数日连续加工后可观察到减速器的显著损伤。
图8展示了某测试工况下采集的实际数据,包含关节角度、电机驱动功率与电机电流。这些数据通过PLC网络端口上传至云端数据库。实验采用的协作机器人各电机功率不超过1.5kW,驱动电流小于2A,数据采集协议采用TCP/IP,采样频率为250Hz。
图8. 实验采集的多源机器人信号
采集信号包含负载运动与空载运动两类工况。负载运动时机器人通过线激光自动规划轨迹执行焊缝抛光任务,空载运动时则随机执行各类测试动作。作业期间,执行机构通过高压气体与控制阀确保工件额定压力,通过调节压力阀开度可将磨削过程中的反作用力控制在恒定值。工件安装有三个振动传感器,用于精确判定切削过程的起止时间点。图8所示曲线为根据振动幅度剔除换刀、退刀等无效动作后的有效数据。
图9展示了更详细的硬件配置。实验采用的柔性制造系统通过可变位金属结构与差异化焊缝形态生成动态机器人作业轨迹。
图9. 机器人柔性制造系统详图
红色管路连接的高压气体为电主轴提供压力反馈与负载采集,抛光过程中的反作用力可直接通过蓝色压力表及转换系数获取。图9左下角点云图像呈现了加工过程中扫描获得的表面特征。由于焊接工艺的一致性难以保证,即便是同一工件,每次焊接后所需的磨削路径也会存在差异。
5.2 时间序列建模实验
如表2所示,本实验根据动作类型、运行速度与负载条件划分为40组(4×3×16=192种工况)。每种工况均具有不同的轨迹特征,具体体现在运动形态与电流信号上。负载重量的变化通过安装在机器人末端的气动伺服磨削主轴实现。
表2 工况类型划分
其中,运动类型根据编程特性划分,本文采用的JAKA工业机器人基本运动功能包括直线、圆弧、插补和末端位姿四种类型,通过组合这些基本运动可实现任意复杂度的末端轨迹。在抛光图9所示工件时,四种运动类型均会涉及。为便于后续深入分析,根据运动功能调用对样本进行分类。图10展示了基于机器人学知识的电流预测精度。蓝色曲线代表实际电流,橙色曲线代表利用动力学递归关系与电机伺服系统传递函数估计的电流。
图10. 传统仿真方法电流估计结果
可以看出:虽然体现机器人动力学知识的数据1估计电流与实际电流整体趋势一致,但无法准确估计高频电磁振荡;代表伺服系统知识的数据2估计电流虽不能准确反映宏观趋势,但保留了与电源和编码器相关的高频信息。由此可见,传统知识驱动的信号仿真方法只能在有限领域有效还原物理系统信息,但由于知识本身的前提假设限制,最终结果与真实信号间始终存在偏差。图11呈现了本文通道注意力模块学习得到的六路输入信号与六路输出电流间的通道权重矩阵。
图11. 通道注意力模块生成的评分矩阵
从热力图中可清晰观察到,高权重区域集中分布于主对角线附近及边界区域,且距离主对角线越远权重评分越高。当某个关节受到冲击时,距离会放大冲击产生的扭矩效应,因此沿轴向距离越远的关节承受的冲击影响越大。这表明通道注意力机制等效于学习了多关节机器人的串联特性。与预期相反的是,通道注意力获得的评分矩阵并非对称矩阵,这可能是由于机器人关节耦合效应会随传动方向产生不同形式的负载影响。
图12展示了引入动力学模型与电机伺服特性物理约束后的电流估计样本。其电流估计性能优于图10所示结果,表明该模型能准确观测健康机器人的系统特性。通过输入特定任务场景参数并估计健康电流后,可基于其与实际电流的差异来表征机器人关节的剩余使用寿命。
图12. 基于PICAIU框架的电流估计
从192种工况采集的数据按不同工况变异因素划分为三个实验组。每组实验控制某一特定工况因素的变化,记录该工况变异实验中六个关节数据的拟合指数与波动方差。图13显示,纯动作变化工况获得的拟合指数显著低于其他工况组合,表明动作变化引起的信号估计误差大于其他工况因素。
图13. 六关节电流估计效果
5.3 减速器加速老化数据集的剩余寿命预测
减速器损伤会导致关节阻力增大,并引起电流幅值上升。图14展示了150天加速寿命试验的全过程数据,主要包括关节3、4、5的电流变化。末端关节6及前两个关节1、2在加速实验期间处于固定状态。图中显示的负值表示电流方向与额定方向相反。
图14. 减速器失效过程的电流变化
随时间推移,电流整体下移趋势表明关节阻力绝对值正在增大。在干摩擦条件下,减速器若持续摆动特定角度将导致失效,因此以当日关节摆动角度作为剩余寿命的参考基准。本实验完整采集了机器人减速器从初始安装到完全失效的全过程数据,并以当日关节摆动角度作为退化参考指标。
退化预测实验旨在检验所设计指标与真实工作周期数的契合程度。图15横轴表示采样数据组编号,编号越大表示采样时间越接近完全失效时刻。每完成一次加工轨迹,减速器运行周期数将增加整数倍。为便于分析,按完整轨迹执行次数对数据进行分组,因此实际剩余寿命在图15、16中呈现为线性模型。经归一化处理后得到图15所示效果,各方法得到的RUL曲线越接近该直线,预测精度越高。
图15. 完整实验过程的退化曲线拟合效果
通过将加速寿命试验中的运动数据输入PICAIU网络,可获得健康状态下的扭矩曲线。利用改进KL散度计算实际电流与理论电流的偏差,并将其与其它常见特征量共同呈现在图15中,可发现本文提出的健康指标与退化实验中关节转动角度的累积增量具有更好的一致性。
图16通过绘制四种变工况下的真实退化曲线与预测曲线,对比了本文提出的退化指标与其他方法的性能。可以看出,常见时域特征难以在柔性工况下实现与退化曲线的准确映射。从图16可见,当轨迹发生变化时,本文方法所提RUL的预测精度下降幅度最小。
图16. 控制变量后的变工况实验结果
5.4 PICAIU鲁棒性测试
为评估运动姿态对预测精度的影响,本研究提取了不同运动类型的退化过程数据进行剩余寿命拟合测试。如表3所示,根据执行机构运动方向与重力方向的关系将测试数据分为三类。结果表明,当执行机构沿重力方向下移时拟合精度最高,基本达到表4所示水平。
表3 不同姿态下的预测精度
表4 剩余寿命预测的基线模型对比
表4将本文方法与近期剩余寿命预测研究进行了对比。在本研究采集的机器人减速器数据集上,表现最佳的基线模型为CNN-BiLSTM。PICAIU的百分比预测误差RMSE相对该模型降低26%,绝对误差范围减少4.63,表明本方法的预测性能更加稳定。此外,使误差低于10%所需的训练周期仅为PF-BiGRU-TSAM模型的42%,证明本方法具有更优的样本利用效率。
表5 跨设备泛化能力测试结果
为验证方法的泛化精度,采用JAKA Zu-12与Zu-16两款机器人进行交叉验证。分别使用两款机器人的老化数据训练减速器RUL预测模型后,将其交叉应用于另一数据集计算预测误差。由于Zu-16额定负载更高且其减速器抗退化特性更强,本研究在Zu-12上采集的数据量更大。泛化实验中的百分比误差RMSE分别为12.6与6.4,表明从Zu-12到Zu-16的泛化效果显著优于反向操作,其他指标也呈现相同趋势。
5.5 多工况退化实验
本节通过消融实验详细检验物理约束的各项特性,通过控制物理约束的作用范围,系统评估PICAIU所采用各项改进措施对前文所示剩余寿命预测精度的贡献程度,同时揭示性能局限并分析潜在原因。
实验对本文提出的健康评估方法与现有可靠性方法进行了量化对比。鉴于工业机器人系统的高度复杂性,研究领域目前缺乏针对关节退化程度的直接参考指标。因此,实验将本文提出的评估指标与航空发动机、轴承等领域的相关方法进行跨学科对比。对于这些跨领域健康评估方法,实验将其直接应用于本文关注的关节电流退化过程,最终结果如表6所示。
表6 不同序列建模方法的误差对比
从结果可以看出:在重复工况下,本文方法与其他健康评估方法相比未显现显著优势;但在柔性工况下,基于动力学观测神经网络的本文方法展现出明显的稳定性与精度提升。实验还发现一个重要现象:尽管多种机器学习回归方法能准确拟合现有数据,但其泛化能力仍显不足。即使神经网络完美拟合了输入特征与工作周期曲线的关系,仍无法准确预测新工况下的设备退化。
为验证物理约束对深度学习框架的改进效果,实验采用多种监督回归模型测试了物理损失项的增强作用。表 7 结果显示:对于常见RUL预测模型,添加物理约束仅小幅提升精度,但显著减少所需训练轮次并降低泛化误差。
表7 剩余寿命预测的消融实验
表 8 展示了消融实验结果。实验进一步比较了两类知识约束对关节电流逼近性能的影响:移除所有物理约束后,神经网络迭代速度减缓且最终精度下降;添加完整物理约束后,网络训练速度加快且最终精度显著提升;仅保留动力学约束时,网络收敛速度明显加快但最终收敛精度不及双约束条件;仅保留电机伺服约束时,网络收敛速度略有提升但最终精度改善有限。实验表明,来自不同领域的知识共同提升了数据驱动方法的效率与拟合精度,其中动力学约束起主导作用,电机伺服约束起辅助作用。
表8 两种物理损失项的消融实验
最后,通过表 9 的消融实验验证了退化曲线拟合误差。保留两类知识约束获得的扭矩偏差与退化曲线达到最佳拟合效果,而仅保留单一约束的扭矩偏差拟合效果略有下降,未使用知识约束的扭矩偏差则呈现不理想的拟合效果。实验证明,纯数据驱动方法难以从有限健康运动数据中学习真正的关节退化敏感特征。即使获得良好的电流估计效果,面对新退化数据时仍无法实现有效泛化。这印证了本文采用的PINN方法的核心优势:机器人学知识确保神经网络能从有限真实数据中学习系统本质信息,并有效外推至新的状态,从而避免过拟合陷阱。
表9 面向概率与物理约束的消融实验
本文通过物理知识嵌入,开发了一种用于机器人损伤评估的理论数字孪生框架。通过可解释的模式识别方法,可实现工业机器人的在线系统辨识。这种基于模型退化程度的可解释健康评估方法融合了数据驱动与知识驱动方法的优势,取得了传统上需要大规模数据集才能实现的效果。
该方法的优点在于借助精细化的机器人学知识降低了数据驱动模型的盲目性;其局限性在于人类经验难以推广至系统参数不透明的在役设备。对于参数标定困难或设备信息未开放的硬件,本文方法尚无法部署。下一步将深入研究机器人加工过程中的激励力传递模型,完善物理约束细节的实现,识别不同加工工艺间的差异,并探索跨个体差异的衰减过程建模理论方法。