非平衡数据下滚动轴承故障诊断的去噪扩散隐式模型与传输网相结合)
论文题目Denoising Diffusion Implicit Model Combined with TransNet for Rolling Bearing Fault Diagnosis Under Imbalanced Data非平衡数据下滚动轴承故障诊断的去噪扩散隐式模型与传输网相结合情况Sensors 2024摘要数据不平衡是智能故障诊断的一个严重问题。它们可能会导致诊断精度降低从而危及设备的可靠性和安全性。在此基础上提出了一种将去噪扩散隐式模型与卷积神经网络结构相结合的故障诊断方法。首先使用格拉米亚角度差场(GADF)生成2D图像然后使用ddim对其进行增强。然后利用卷积神经网络的权值分担特性和自注意机制以及变压器的全局数据处理能力构建了Transnet模型。将增强后的数据输入到模型中进行训练以建立故障诊断框架。最后利用CWRU轴承数据集和南昌铁路局数据集对该方法进行了验证和分析。实验结果表明该方法在两个数据集上的识别率均达到99%以上。同时与现有的故障诊断方法相比该模型具有更好的泛化性能和识别精度。DDIM TransNet用扩散模型解决轴承故障诊断中的数据不平衡难题一、引言轴承故障诊断卡在哪里滚动轴承是旋转机械中的核心部件广泛应用于车辆、航空航天、CNC机床、机电设备和精密仪器等各类场景。它被誉为工业的关节其健康状态直接关系到整台设备的性能与安全。轴承一旦出现故障往往引发异常振动和冲击威胁设备的安全性和生产效率。因此及时、准确地识别轴承故障对于预防事故、提升运营效率具有重要意义。随着深度学习DL的快速发展其在轴承故障诊断中的应用日益广泛。CNN、LSTM、DBN、RNN等模型能够从采集数据中自动提取特征显著提升了故障诊断的效率与准确性。然而这些智能诊断方法普遍依赖充足的有标签故障数据——而现实情况是机械设备绝大多数时间运行在正常状态故障样本极难获取。这就导致了一个核心矛盾正常样本充足故障样本稀缺数据严重不平衡。数据不平衡会直接抑制深度学习模型的精度和泛化能力成为智能故障诊断落地应用的最大阻碍之一。本文正是针对这一问题提出了一套结合去噪扩散隐式模型DDIM与TransNet网络的新型轴承故障诊断框架。二、现有方法的不足2.1 GAN类数据增强的固有缺陷数据增强是解决数据不平衡问题的有效手段而生成对抗网络GAN是目前最广泛使用的数据增强模型。然而GAN存在一系列难以根治的问题训练不稳定生成器与判别器的对抗博弈天然引入不稳定性易出现梯度消失和模式崩溃pattern collapse参数难以调优生成器和判别器的参数需要精细平衡任何一方过强都可能导致训练失败甚至无法收敛可解释性差GAN通过复杂对抗过程训练其内部机制和生成过程难以解释Wasserstein GANWGAN虽然用Wasserstein距离替换JS散度在理论上缓解了训练不稳定问题但在实践中仍存在收敛问题和样本质量不稳定的情况。基于梯度惩罚的改进版WGAN-GP进一步提升了模型稳定性但上述根本性缺陷并未完全消除。2.2 单一CNN模型特征捕获能力有限以ResNet50、ResNet101、VGG16为代表的CNN模型虽然在局部特征提取方面表现出色但缺乏对全局上下文信息的建模能力对复杂故障特征的区分能力有限在小样本、不平衡数据条件下泛化性能不足。三、本文提出的方法框架本文提出的整体方法由三个关键技术组成GADF信号转图像→DDIM数据增强→TransNet故障分类。Figure 2基于TransNet的故障诊断流程图从振动信号采集 → GADF预处理 → DDIM数据扩增 → TransNet训练 → 输出诊断结果的完整流程整体流程如下首先对轴承振动信号进行归一化预处理消除信号的量纲差异接着通过GADF将一维时序信号转换为二维图像然后按一定比例划分训练集与测试集对训练集使用DDIM进行数据扩增最后将扩增后的图像数据输入TransNet进行训练保存最优模型参数并在测试集上输出故障诊断结果。3.1 GADF让振动信号变成图片Gramian角差场GADF是将一维时序数据转换为二维图像的有效方法能够在保留原始信号完整信息的同时有效维持时序数据的时间依赖性。Figure 3原始振动信号 → 极坐标编码 → Gramian角差场图像的转换过程示意图转换过程分三步第一步归一化。对时间序列进行均值归一化将序列值缩放到区间第二步极坐标编码。将归一化后的时序数据表示为极坐标形式其中为编码角度的余弦r 为保持时间依赖性的半径N 为正则化系数。整个编码过程是双射的保证了信息的完整性。第三步生成Gramian角差场矩阵。通过内积运算生成二维Gramian矩阵GADF的优势在于将一维振动信号转化为二维图像后CNN能够从局部到全局提取多尺度特征从细微边缘、纹理到整体模式还能直接捕获信号的时频特性和相邻数据点的空间相关性从而有效提升故障诊断精度。3.2 DDIM稳定高效的数据增强去噪扩散隐式模型DDIM是在去噪扩散概率模型DDPM基础上改进而来的先进生成模型在保持生成质量的同时大幅提升了生成效率。前向扩散过程逐步向原始信号添加高斯噪声直至信号变为纯随机噪声。在时间步 $t$ 的条件概率分布为其中控制每步添加的噪声量。定义累积噪声系数DDIM通过直接组合原始信号与随机噪声而非递归计算简化了计算过程使其不再是马尔科夫过程反向生成过程从随机噪声出发逐步去噪恢复接近原始数据的信号。该过程是确定性的其中是去噪模型预测的噪声。模型通过最小化预测噪声与真实噪声之间的差异来训练相比GANDDIM具有更坚实的理论基础训练过程更稳定无需在生成器与判别器之间寻求脆弱的平衡且生成的样本能够保留故障特征的多样性有助于模型更好地适应不同类型的故障。3.3 TransNetCNN与Transformer的有机融合TransNet是本文提出的核心分类网络由三个主要模块组成CNN卷积块、Transformer编码器、分类器。Figure 1TransNet模型整体架构图输入图像 → ResNet50卷积层 → Class Token拼接 → 6层Transformer编码器 → 分类输出1CNN卷积块ResNet50骨干网络以ResNet50为骨干网络包含5组残差块Conv2_x到Conv5_x输出形状从 (112, 112, 64) 逐步压缩到 (7, 7, 2048)参数量共约2358万详见下方参数表。卷积层负责提取丰富的局部多尺度特征从底层的边缘、纹理到高层的故障模式。Table 1TransNet架构各层参数汇总表各层组名称、输出形状、参数量2Class Token层在ResNet50输出之后引入一个特殊设计的Class Token层将全局上下文信息链接到局部特征表示中为后续Transformer编码器提供全局感知能力这一设计借鉴自ViT架构的核心思想。3Transformer编码器6层全局建模核心由6层Transformer编码器叠加而成参数量高达约3.1亿。每层编码器包含多头自注意力机制同时关注序列中不同位置的信息捕获全局上下文依赖前馈神经网络FFN对每个位置向量进行相同的非线性变换使用GELU激活函数残差连接与层归一化保证深层网络的稳定训练4分类器最终经过一个全连接Dense层输出维度为故障类别数参数量40907输出故障诊断结果。TransNet的核心优势在于CNN负责提取丰富的局部多尺度特征Transformer编码器负责建模全局上下文依赖两者互补显著增强了图像分类系统的鲁棒性和泛化能力。四、实验验证4.1 实验设置硬件环境AMD Ryzen 7 3700X CPU32 GB RAMNVIDIA GeForce RTX 2080Ti GPU软件环境TensorFlow-GPU 2.6.0训练配置优化器Adam初始学习率0.0001学习率调度余弦衰减每10000步执行一次提升训练稳定性和收敛速度混合精度训练降低计算开销每个实验独立重复10次取平均结果以消除随机性影响4.2 案例一CWRU轴承数据集数据集介绍 实验数据来自凯斯西储大学CWRU轴承数据中心的驱动端加速度数据集。测试台由电机、扭矩编码器、功率计和控制电子设备构成采样频率12 kHz转速1797 r/min。数据集包含三类故障滚动元件故障、外圈故障、内圈故障故障尺寸分为0.007 in、0.014 in、0.021 in三级共形成9种故障类型加1种正常状态合计10类。Figure 4CWRU数据集部分图像数据示例左侧为GADF转换后的原始振动信号图像B021和IR021右侧为经DDIM扩增后的对应图像数据划分每类振动信号转换为300个GADF图像样本按4:1比例划分训练集240个和验证集60个测试集独立取60个用DDIM将训练集从240个扩增至540个正常类原始数据充足直接保持540个。Table 2CWRU轴承数据集样本构成详细表故障类型、故障尺寸、原始训练集、扩增后训练集、测试集、标签训练结果Figure 5TransNet在CWRU数据集上50轮训练的准确率变化曲线训练集与验证集准确率随epoch的变化趋势如图所示在前5个训练周期内模型训练准确率和验证准确率均快速提升体现了模型强大的特征学习能力。随着训练推进两者均稳定趋近于1.0充分证明了TransNet在训练和验证阶段均具备出色的分类性能。测试集结果Figure 6Case 1的T-SNE聚类可视化图10类故障在二维空间中的聚类分布大部分类别形成清晰簇群通过T-SNE特征可视化进一步分析模型的特征提取能力。从图中可以看出绝大多数类别在二维空间中形成清晰的聚类簇群说明模型具有强大的特征提取和类别区分能力尤其在区分正常类别与故障类别方面表现突出。仅有B2和B4的极少数样本出现误分类这是由于这两类故障对应振动信号转换为GADF图像后特征高度相似。对比实验Figure 7Case 1中TransNet与ResNet50、ResNet101、VGG16的混淆矩阵对比图(a) TransNet(b) ResNet50(c) ResNet101(d) VGG16Figure 8Case 1中各方法精确率、召回率、F1分数的均值对比柱状图与ResNet50、ResNet101、VGG16的对比结果清晰呈现了TransNet的优势TransNetB3、B5、B6、B8、B9五类达到100%正确分类总体识别准确率超过99%精确率、召回率、F1分数均优于其他方法ResNet50B0类仅93%B2类仅90%部分故障类别混淆严重VGG16B0类仅58%分类效果最差多个类别存在较大误差TransNet的分类效果全面优于其他对比模型所有评估指标均取得更好的分数进一步验证了本文方法在轴承故障诊断中的优越性和有效性。4.3 案例二南昌铁路局机车轴承数据集数据集介绍 实验数据来源于南昌铁路局机车段真实机车轴承测试台如下图所示。测试台主要由主轴箱、液压系统、电气系统和台体构成。电源为380 V、50 Hz三相四线制交流电总电机驱动功率5 kW测试转速设定为500 rpm。被测轴承为NJ2232WB系列圆柱滚子轴承内径160 mm外径290 mm使用三个加速度传感器A、B、C以20 kHz采样频率采集振动信号。Figure 9南昌铁路局机车轴承测试台实物图标注有主轴箱、传感器A/B/C、轴承等关键部件传感器B采集的数据包含7类状态正常轴承C6、3种不同程度内圈故障C0/C1/C2尺寸4/7/19 mm、2种不同程度外圈故障C3/C4尺寸7/19 mm和1种滚动元件故障C5尺寸4 mm。数据划分每类原始训练集720个样本经DDIM扩增至1620个正常类原始数据直接为1620个测试集每类180个。Table 3南昌铁路局机车轴承数据集样本构成详细表故障类型、故障尺寸、原始训练集、扩增后训练集、测试集、标签训练结果Figure 10TransNet在南昌铁路局数据集上的识别准确率变化曲线训练集准确率迅速趋近1.0验证集在轻微波动后维持高水平训练集准确率随轮次增加快速趋近于1.0验证集准确率在轻微波动后同样保持高水平表明模型在训练数据上表现出色的同时在验证集上也具备良好的泛化能力。DDIM数据扩增在此数据集上同样有效地提升了样本数量增强了模型的学习能力。测试集结果Figure 11Case 2的T-SNE聚类效果图7类故障/正常在二维空间中的聚类分布不同轴承故障类别在二维空间中呈现出清晰的聚类分布展示了TransNet出色的特征提取性能。特别是正常类C0与故障类别之间的区分更加清晰表明模型能够有效识别不同状态下的轴承信号。个别类别如C6的样本分布略显分散说明部分类别之间的特征相似度较高可能导致分类混淆。对比实验Figure 12Case 2中TransNet与ResNet50、ResNet101、VGG16的混淆矩阵对比图(a) TransNet(b) ResNet50(c) ResNet101(d) VGG16Figure 13Case 2中各方法精确率、召回率、F1分数均值对比柱状图从混淆矩阵可以看出TransNet的对角线元素主导矩阵所有类别的分类准确率均达到或超过98%TransNet所有7类中最低准确率为98%C6多数类别达到99%整体识别准确率超过99%ResNet50C0类仅84%C2类仅82%C4类仅86%多个类别存在明显误分类ResNet101C6类仅88%整体性能弱于TransNetVGG16C0类仅93%C1类仅83%C6类仅87%各类指标明显落后TransNet的整体分类效果远优于其他对比模型在所有评估指标上均取得最佳分数充分验证了本文方法在真实工业场景下轴承故障诊断的有效性和优越性。五、总结与展望本文提出的DDIM TransNet轴承故障诊断框架通过三项关键技术的协同配合系统性地解决了故障诊断中数据不平衡和特征提取能力不足两大核心难题。主要贡献总结信号表征创新GADF将一维振动信号转化为携带丰富时频信息和空间相关性的二维图像为后续图像处理技术的应用奠定了基础数据增强有效性DDIM提供了比GAN更稳定、更高质量的数据扩增方案。CWRU数据集每类样本从240扩增至540个南昌铁路局数据集从720扩增至1620个有效缓解了样本不平衡和小样本问题模型架构优势TransNet融合CNN的局部多尺度特征提取与Transformer的全局上下文建模在两个数据集上均实现了超过99%的识别准确率全面优于ResNet50、ResNet101和VGG16等基线模型局限性与未来方向本文主要关注单一工况下的故障诊断未来研究将探索更复杂的应用场景包括变负载和跨设备诊断以为工业设备健康管理与维护提供更强有力的支撑。此外未来工作也将在数据驱动研究的基础上进一步分析轴承故障特征背后的物理机制推动轴承故障诊断研究的深化。