发动机故障诊断智能体(三):特征可分性优化与加权对比投影层

简介: 在基础时序编码网络完成对正常工况的压缩表征后,尽管模型具备了提取稳态规律的能力,但在面对多种不同类型的微量气路故障时,潜在空间中的特征分布仍可能存在相互交叠的现象。该组件致力于通过引入度量对比学习机制,在特定的低维投影空间内重塑特征拓扑结构,系统性优化不同故障模式之间的几何可分性。

在基础时序编码网络完成对正常工况的压缩表征后,尽管模型具备了提取稳态规律的能力,但在面对多种不同类型的微量气路故障时,潜在空间中的特征分布仍可能存在相互交叠的现象。论文《Continual contrastive reinforcement learning: Towards stronger agent for environment-aware fault diagnosis of aero-engines through long-term optimization under highly imbalance scenarios》通过在编码器后端级联特征区分模块,构建了专门的加权对比投影层。该组件致力于通过引入度量对比学习机制,在特定的低维投影空间内重塑特征拓扑结构,系统性优化不同故障模式之间的几何可分性。

ScreenShot_2026-09-18_195407_601.png

加权对比投影层在物理结构上由两层连续的全连接神经网络与非线性激活函数级联组成。预训练时序编码器输出的多航段时序隐层向量首先进入投影层的隐藏全连接层进行高阶非线性变换,通过输出全连接层映射至标准化的低维度量空间中。该投影空间以向量方向的余弦相似度作为衡量表征相关性的核心尺度,通过量化样本向量之间的夹角大小,直接反映不同飞行状态在特征空间内的几何接近程度,为后续的梯度调整提供明确的拓扑距离度量。

在样本组织层面,该组件直接利用真实的历史飞行监测数据构建正负样本对,避免了人工时序数据增强可能引入的物理伪特征。系统将属于同一种已知故障类型的多航段真实样本组合为正样本对,而将属于不同故障类别或健康状态的样本组合为负样本对。这种完全基于真实多航段监测记录的数据组织方式,确保了投影层在学习特征拉聚与分离的过程中,尽量遵循航空发动机真实的物理退化演化路径。

在投影空间的优化机制中,该组件采用了集成正负样本加权系数的温度缩放交叉熵度量损失函数。由于不同气路故障在参数变化上仍共享基本的热力学规律,且样本数量极度不均,导致负样本对在梯度计算中占据数量优势。为了尽量消除这一不平衡干扰,度量损失函数显式提升了同类故障正样本对的拉聚权重,同时自适应调节异类负样本对的排斥力度;在温度缩放参数的调控下,损失函数驱动同类故障样本在投影空间内高度紧凑收敛,同时扩大异类故障簇之间的间隔边界。

ScreenShot_2026-09-18_195431_867.png

为了在优化特征可分性的同时防止底层基础时序规律遭到破坏,该模块在参数更新时实施了分层差异化的学习率控制。底层的长短期记忆编码器被分配了极低的学习率,以维持其在海量正常工况中学习到的通用时序滤波与压缩能力;后端的全连接投影层则采用常规学习率进行充分训练,使其集中调整映射权重以学习不同故障之间的细微差异。这种分层优化策略既在一定程度上保障了特征基底的数值稳定性,又较好地实现了对细分故障边界的有效解耦。

在加权对比投影层完成收敛后,非线性投影网络在结构上被剥离,而经过微调的时序编码器则被完整固化并输出。该编码器作为标准的特征提取前端,直接嵌入至下游的深度强化学习决策网络中。作为智能体内部负责表征优化的关键构件,特征可分性优化与加权对比投影层成功将高维重叠的时序状态转化为类内紧凑、类间清晰的低维特征向量,为执行准确的故障分类判定减轻了特征层面的模糊性。

参考文献:
Continual contrastive reinforcement learning: Towards stronger agent for environment-aware fault diagnosis of aero-engines through long-term optimization under highly imbalance scenarios[J]. Advanced Engineering Informatics, 2025, 65(C): 103297.
https://www.sciencedirect.com/science/article/pii/S1474034625001909

相关文章
|
22天前
|
人工智能 自然语言处理 API
觉得阿里云大模型价格太高怎么办?四种便宜购买与使用方法分享
本文针对阿里云大模型“能力强但调用成本高”的普遍痛点,梳理了一套可落地的全链路省钱方案。从开通百炼领取超7000万Tokens新人免费额度起步,叠加夜间错峰4折起的Night Plan活动,再搭配Token Plan订阅与AI通用型节省计划,四层优惠叠加后,实际调用成本可降至普通按量付费的三到五成,帮助个人开发者与团队大幅降低大模型落地的综合开支。
343 10
|
22天前
|
机器学习/深度学习 算法 前端开发
发动机故障诊断智能体(二):基础时序压缩与长短期记忆编码网络
在智能体完成气路多航段时序数据的采集与规整后,高维度的原始时序信号需要经过深度表征与降维处理,以消除高频测量噪声并提炼本质物理趋势。采用长短期记忆自编码器架构,在脱离人工标签监督的情况下,利用海量正常运行数据进行自监督重构训练,构建出能够压缩并表征发动机稳态工况与退化趋势的时序特征提取模型。
|
3月前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
5247 161
|
22天前
|
自然语言处理 安全 测试技术
别再只测『答得对不对』:给大模型应用建一套 Prompt 注入红队回归集,把越权/泄密挡在上线前
本文揭示RAG客服应用因缺乏Prompt注入防护而致系统提示词泄露的事故,指出问题根源在于测试只关注“答得对”,却忽视“会不会答不该答的”。提出将注入测试升级为可回归的红队用例集:结构化存于jsonl,覆盖四类注入;用pytest参数化断言输出、工具调用与拒答行为;接入CI自动拦截。安全不是模型天赋,而是靠可执行、可演进的断言守出来的。
别再只测『答得对不对』:给大模型应用建一套 Prompt 注入红队回归集,把越权/泄密挡在上线前
|
6月前
|
人工智能 监控 Kubernetes
LoongCollector + ACS Agent Sandbox:构建 AI Agent 生产级运行平台
文章介绍了阿里云ACSAgentSandbox与LoongCollector协同构建的AIAgent生产级运行平台,通过沙箱隔离保障运行时安全,并以高性能、全链路可观测能力解决Agent行为不可预测和执行风险难题。
3161 91
|
22天前
|
存储 弹性计算 人工智能
阿里云服务器ECS是什么?介绍、优势、创建流程及使用教程
阿里云ECS是高性能、高可用的弹性云服务器,支持分钟级创建、灵活升降配与全球部署。依托自研CIPU架构,单实例SLA达99.975%,网络延迟低至8微秒,适配网站托管、AI训练、数据库等全场景需求。(239字)
|
26天前
|
人工智能 监控 JavaScript
最近火爆出圈的,FDE 到底是个什么岗位?
FDE(前沿部署工程师)是AI时代新型复合岗:驻客户现场,贯通技术与业务,主导大模型在真实场景的端到端落地。需兼具AI应用开发、工程化交付与业务沟通三大能力,非单纯“调API”或售前角色。高薪热门,但重实战、重结果。
1575 2
最近火爆出圈的,FDE 到底是个什么岗位?
|
22天前
|
人工智能 自然语言处理 安全
阿里云千问办公 QwenWork详细介绍:产品核心能力、典型场景、价格及常见问题解答
在AI技术快速落地办公场景的当下,市面上绝大多数智能工具依旧停留在问答对话、文本摘要、简单文案改写层面,只能完成碎片化单点任务。企业员工处理一份完整业务工作时,往往需要同时开启多款工具,文档处理、数据分析、素材创作、网页制作分属不同软件,中间内容需要反复复制粘贴,即便借助通用大模型生成内容,输出成果还需要大量二次格式调整,才能达到交付标准。同时企业内部的数据分散在聊天记录、审批单据、本地文档、业务平台,普通AI工具无法直接读取内部业务信息,每一次任务都要人工复述背景条件,法务、财务、研发这类垂直岗位,还需要编写冗长提示词才能拿到相对可用结果,AI办公落地的实际门槛长期居高不下。千问办公Qwen
519 9
|
22天前
|
SQL 自然语言处理 数据挖掘
2026年数据分析工具推荐:帮你节省80%处理时间的利器
本文介绍2026年阿里云瓴羊Quick BI AIPro版,通过“智能小Q”四大Agent(问数、解读、报告、搭建),实现自然语言交互、秒级取数、自动归因、20分钟生成报告,助企业节省80%数据分析时间,已在能源、零售、制造等多行业落地验证。

热门文章

最新文章