发动机故障诊断智能体(四):价值解耦型决斗深度决策网络

简介: 在智能体完成特征时序压缩与可分性优化后,系统需要一个具备离散状态决策与多类辨识能力的逻辑控制中枢。该组件位于特征提取网络后端,负责接收经过对比微调的紧凑时序表征,并通过解耦状态自身价值与各候选动作的相对优势,将连续的气路特征映射为离散的故障诊断结论。

在智能体完成特征时序压缩与可分性优化后,系统需要一个具备离散状态决策与多类辨识能力的逻辑控制中枢。论文《Continual contrastive reinforcement learning: Towards stronger agent for environment-aware fault diagnosis of aero-engines through long-term optimization under highly imbalance scenarios》设计了基于决斗双重深度Q网络的类型识别模块作为智能体的决策核心组件。该组件位于特征提取网络后端,负责接收经过对比微调的紧凑时序表征,并通过解耦状态自身价值与各候选动作的相对优势,将连续的气路特征映射为离散的故障诊断结论。

ScreenShot_2026-09-18_202419_396.png

价值解耦型决策网络在物理拓扑上由主干循环层与双支路线性评估层串联构成。前序特征区分模块中输出的低维特征向量首先进入决策网络新建的长短期记忆主网络中,主网络负责进一步提取高阶决策相关的时序动态演变信息,并将最终时间步的隐层向量作为当前状态的综合决策向量。然后,该向量被并行送入两条结构独立的线性全连接支路,分别执行状态全局固有价值的解算与各个诊断动作相对优势度的独立度量。

状态价值支路与动作优势支路的结构解耦构成了决斗网络的核心机理。状态价值支路通过全连接层将决策向量压缩为一个标量,用于量化发动机当前处于某种特定健康水平或退化状态的全局基准价值,该指标独立于具体采取何种维护判断;动作优势支路则输出一个维度与诊断类别总数相等的向量,分别评估将当前状态归类为正常或某一具体故障模式相对于其他备选类别的相对优势程度。在最终的动作价值合成单元中,网络通过减去优势向量的内部均值并叠加状态价值标量,在一定程度上消除了由于状态本身价值过大对动作优劣判定造成的掩盖,提升了数值评估的稳定性。

为了在强化学习训练中彻底规避标准Q学习对动作价值的正向过估计问题,该决策组件在架构上采用了策略网络与目标网络的双网络协作机制。系统中部署了两个结构完全一致的网络实体:策略网络直接与环境交互并实时更新参数,负责在给定状态下输出具有最大Q值的候选诊断动作;目标网络则保持参数处于冻结状态,专门用于计算策略网络所选动作的目标评价值。这种将动作选择与动作评估物理隔离的设计,在一定程度上阻断了因噪声引起的误差正反馈,较好地确保了价值评估函数的平稳收敛。

在优化执行层面,决策组件依赖贝尔曼时序差分机制构建梯度反向传播回路。目标网络结合环境反馈的即时奖励与低折扣率的未来期望计算出目标Q值,由于连续两次诊断任务之间的关联性较弱,极低的折扣系数使模型专注于当前飞行特征与即时分类反馈的准确映射。系统通过计算策略网络实时估计Q值与目标Q值之间的均方误差,仅对决策长短期记忆主网络与双支路全连接层的权重进行梯度更新,而上游的特征编码器参数保持完全冻结。

在完成收敛并部署于在线诊断流程时,决策组件以确定性的前向推理模式运行。当新的多航段特征输入后,决策网络计算出所有备选健康状态与典型故障模式的动作价值向量,最大动作选择器直接提取具有最高Q值的类别索引作为故障诊断输出。作为智能体的决策大脑,价值解耦型决斗深度决策网络在结构上实现了状态评估、优势比较与误差抑制的严密闭环,为复杂多气路故障的分类识别提供了较为可靠的逻辑执行架构。

参考文献:
Continual contrastive reinforcement learning: Towards stronger agent for environment-aware fault diagnosis of aero-engines through long-term optimization under highly imbalance scenarios[J]. Advanced Engineering Informatics, 2025, 65(C): 103297.
https://www.sciencedirect.com/science/article/pii/S1474034625001909

相关文章
|
9天前
|
人工智能 自然语言处理 安全
阿里云千问办公 QwenWork详细介绍:产品核心能力、典型场景、价格及常见问题解答
千问办公是阿里云推出的一站式AI办公平台,主打"不止于对话,更注重交付",依托通义千问旗舰大模型,用户一句话即可完成数据分析、PPT生成、视频剪辑等复杂任务,直接输出可用成果。产品深度打通钉钉生态与企业OA,覆盖桌面端、网页端,提供企业标准版198元/人/月等多档订阅方案,新用户注册即赠2000积分,适配工程师、HR、财务等多职业办公场景,成为能动手干活的"全能AI同事"。
|
9天前
|
人工智能
千问办公官网入口:阿里AI办公QwenWork产品页和免费网页端链接
千问办公官网含两大入口:一是网页端(qwenwork.cn),即开即用,支持浏览器直接访问;二是阿里云产品页 https://t.aliyun.com/U/JNKJuO 提供免费/付费版详情、功能介绍及使用指南。
|
15天前
|
网络协议 Linux iOS开发
【2026实测】Wireshark下载+安装+汉化+使用教程(图文版,巨详细)
Wireshark 是一款免费开源的网络协议分析工具,可实时捕获、解析并可视化数据包,助你诊断网络故障、分析通信协议(如HTTP、DNS、TCP等)。支持Windows/macOS/Linux,含中文界面,新手入门便捷。(239字)
|
10天前
|
人工智能 API 内存技术
刚刚 DeepSeek V4.1 Flash 开启内测,1 分钟教你用上!
刚刚 DeepSeek 内测群发布了 DeepSeek V4.1 Flash 中间版本内测的消息,这次的模型采用了新的结构,原生支持多模态、能力更强、速度更快、且成本更低。
1912 15
|
8天前
|
IDE 开发工具
Qoder 上线 Sonus 模型,Computer Use 能力全面增强
Qoder国际版上线全新内置大模型Sonus(/ˈsoʊnəs/),全球领先,专精超长任务执行与电脑操作(Computer Use)。配合Qoder桌面端0.2.3版本,可自主完成编程、金融建模、科研及表格制作等复杂工作。现全面支持Qoder全系产品,效率提升3.2倍。
1034 1
Qoder 上线 Sonus 模型,Computer Use 能力全面增强
|
14天前
|
人工智能 运维 BI
阿里云千问办公QwenWork深度解析:基于Qwen3.8,六大核心能力重构企业全自动化工作流与计费选型指南
传统AI办公工具大多停留在对话问答、文档摘要、简单文案生成层面,只能完成单点碎片化任务,无法自主拆解复杂业务流程,很难串联多工具、多文档、外部业务系统完成端到端完整工作交付。很多企业在落地AI办公的时候,需要组合多款不同工具,来回切换界面,手动复制粘贴中间结果,智能化改造落地门槛居高不下。千问办公QwenWork是整合多款智能体产品能力打造的一体化企业办公智能体平台,底层基座依托Qwen3.8大模型,打通桌面端Agent、云端Agent、企业协同Agent三种运行形态,不再局限简单问答,接收业务目标之后自主拆解任务步骤,调用各类工具,处理文档、表格、浏览器自动化、数据查询,直接输出可交付的办公
1670 4
|
10天前
|
缓存 人工智能 自然语言处理
阿里云qwen3.8-flash大模型介绍:模型能力、模型价格、免费额度与最新活动
本文是阿里云百炼平台Qwen3.8-Flash大模型的选型接入指南,作为兼顾性能与响应速度的高性价比多模态模型,它支持百万级上下文窗口、全场景多模态输入与完整智能体能力矩阵,适配编程辅助、智能体协作等核心场景。文中同步梳理了最新下调的阶梯定价、夜间4折等优惠活动,搭配OpenAI兼容流式调用示例,帮助开发者低成本快速落地高并发AI应用。
阿里云qwen3.8-flash大模型介绍:模型能力、模型价格、免费额度与最新活动
|
16天前
|
缓存 数据可视化 开发工具
DeepSeek Harness 怎么更新?dsh 更新完整指南:更新本体(npx、npm、源码)与更新插件两种方式
DeepSeek Harness 的更新分两层:本体更新(npx 自动最新、npm update -g、源码 git pull)与插件更新(插件市场点更新、命令行覆盖安装)。本文按「准备 → 更新本体 → 更新插件 → 更新后检查」四步走,覆盖新手常见疑问。
1831 1
DeepSeek Harness 怎么更新?dsh 更新完整指南:更新本体(npx、npm、源码)与更新插件两种方式
|
11天前
|
SQL 人工智能 前端开发
QoderWake 1.0 正式发布:从桌面里的 Agent,到工作现场的数字员工
QoderWake v1.0正式发布:企业级数字员工团队平台。支持“一句话建岗”,预置10类特训岗位;Waker常驻钉钉/飞书群,@即响应、自动协作、跨任务记忆;具备定时/事件/API多触发方式与统一任务看板;已沉淀27.6万条记忆、12.3万项技能,助力组织实现人机协同增效。
829 2
|
9天前
|
缓存 测试技术 API
DeepSeek V4.1 Flash 内测接入:改个模型名即可调用(附代码)
DeepSeek V4.1 Flash 内测不用申请,base_url 不变、改个模型名就能调,9/10 到期。本文讲清接入、计费限流与多模态注意点。
832 0
DeepSeek V4.1 Flash 内测接入:改个模型名即可调用(附代码)

热门文章

最新文章