从 Context 到 Graph:Agent 工程的四个层次

简介: 本文系统解析AI Agent工程演进的四大层次:Context(上下文管理)、Harness(执行环境构建)、Loop(目标驱动的持续执行)与Graph(多Agent协作编排)。以Qoder CLI和Qoder Cloud Agents为例,阐明各层如何随模型能力提升而动态迁移工程重心,体现“本质未变、瓶颈转移”的演进逻辑。

63F6E5BD-16AF-4295-BFC2-94F6D9ADC00E.png


过去几年,AI 圈不断出现新的 Engineering:Prompt、Context、Harness、Loop,最近 Graph Engineering 也开始被频繁讨论。可以把今天的 Agent 工程理解为多个相互嵌套、但边界并不绝对的关注层次。随着模型能力提升,工程重心也逐渐从单次调用扩展到运行环境、持续执行与多 Agent 协作。下面我们用 Qoder CLI 和 Qoder Cloud Agents 举例,看清 Context、Harness、Loop 与 Graph 各自解决什么问题。


本质从没变,变化的是工程瓶颈


多数 tool-using Agent 都可以抽象成一个循环:模型读取当前上下文,推理并决定下一步,调用工具执行,再把结果写回上下文,直到本次任务完成、失败或被外部打断。真实产品会更复杂,但这个简化模型足以解释这些概念。

早期模型指令跟随能力弱,Prompt 的措辞稍有变化,结果就可能明显不同,于是 Prompt Engineering 成为焦点。后来模型能够理解更复杂的指令,瓶颈转向上下文:该给什么信息、何时给、如何压缩。当模型开始连续调用工具,工程关注点又扩展到承载一次 Agent 运行的 Harness。再往外,如何围绕目标反复触发、验证并持续执行,成为 Loop Engineering 关心的问题;当多个 Agent 或 Loop 需要分工协作,Graph 又被推到台前。

每一种 Engineering,都在解决当前最突出的系统瓶颈。随着模型能力提升,旧问题不会消失,而会被模型吸收、被框架固化,或被平台做成默认能力。


配图1-四个演进阶段.png


下面具体看看,它们在本地 CLI 和云端 Agent 平台中分别长什么样。


image.png


Context Engineering:管理上下文,就是管理注意力


以 Qoder CLI 为例,任务开始时不会把所有资料一股脑塞进上下文。系统先加载必要的项目指令,以及可用 Skill 的名称和简介;只有任务命中某个 Skill 时,才完整读取,这也就是渐进式披露(progressive disclosure)。

AGENTS.md 的作用域机制也是同一思路:全局层保存个人偏好,项目层保存仓库约定,更具体的规则只在对应目录生效。Subagent 则提供上下文隔离,让代码探索、文件阅读和试错过程留在子上下文中,主上下文只接收必要证据和结论。

因此,Context Engineering 的重点不是“塞得更多”,而是管理有限的注意力预算:什么应该常驻,什么按需加载,什么需要压缩,什么应该丢弃。到了云端,Qoder Cloud Agents 用持久化 Session 保存可继续的工作状态和事件历史,调用方不必在每次请求中重新拼装全部运行上下文。


配图2-上下文预算示意图.png


Harness Engineering:构建模型的执行环境


同一个模型,直接调用 API 和放进成熟的 Qoder CLI,表现可能相差很大。通常把模型之外、但直接影响执行质量的环境称为 Harness,包括上下文组装、工具、权限、文件系统、沙箱、状态反馈、测试和可观测性。

Qoder CLI 本身就是一个 Harness。Plan Mode 约束会话处于分析和规划状态,Permission Mode 决定权限检查的松紧——工具调用是自动放行、询问确认还是直接拒绝;受信目录和工具白名单限制能力边界,settings 与 Hooks 则注入项目约束和确定性检查。安全不只靠 Prompt,还依赖运行时权限和可执行规则。

云端 Harness 还要处理本地单用户环境没有的多租户问题。在 Qoder Cloud Agents 的核心运行时里,Agent 定义能力,Environment 提供运行环境,Session 承载一次具体任务;面向业务交付的 Forward Mode 构建在这之上,用 Template 定义可复用的配置基线,用 Identity 区分终端用户,为每个用户合成各自的运行配置。每个 Session 都运行在隔离的 Sandbox 中,Vault 负责安全注入凭证。无论在本地还是云端,Harness Engineering 解决的都是同一个问题:怎样让模型在边界清楚、反馈及时的环境里稳定工作。


配图3-Harness对比图.png


Loop Engineering:让系统持续运行到目标达成


Loop Engineering 关注的是一次 Agent 运行之外的闭环:谁触发下一轮,完成条件是什么,结果由谁验证,失败后应该重试、恢复还是交给人,以及状态如何跨会话多次运行延续。

在本地 CLI 中,人通常仍是外层循环的一部分:提出目标、观察进展、检查结果,再决定继续、修改还是停止。当目标、验证、重试和停止条件被固化成可重复执行的机制,系统就开始从“人不断提示 Agent”转向“人设计一个能够持续推进的循环”。

到了云端,这个外层循环不再依赖有人盯着终端。Qoder Cloud Agents 用持久化 Session 保存状态,用 Event 和 SSE 暴露执行过程,并允许外部系统取消当前 Turn 或继续下一轮。Schedule 和 IM Channel 负责按时间或外部消息触发,Batch 则让同一类任务批量运行。控制者可以是业务系统、监控规则或审批流程,Loop Engineering 关心的正是怎样让这些运行持续推进,又能在正确的条件下停下来。


配图4-外层循环图.png


Graph Engineering:连接多个 Agent 或 Loop


Graph Engineering 的基础仍然是 state、nodes 和 edges。节点可以是一段确定性代码、一次模型调用,也可以是一段完整的 Agent 运行;边决定任务如何流转,state 则承载节点之间需要共享的信息。

主会话把不同模块交给多个 Subagent 排查,就可以抽象为:Subagent 是节点,委派与结果反馈是边,任务说明、证据和结论是流动的 state。Loop 决定一个运行过程如何返回、验证和继续,Graph 则进一步决定多个执行单元之间的依赖、路由和协作关系。一个 Loop 可以看成最简单的循环图,一张 Graph 里也可以包含多个 Loop。

Qoder CLI 中的 Graph 通常在一次会话里动态形成,适合开发、调试和探索。Qoder Cloud Agents 则原生支持 Coordinator Agent 向多个 Child Agent 并行或串行委派任务,形成运行时的动态协作图;对于包含固定依赖、条件路由和跨 Session 状态的显式 Graph,上层系统还可以基于 Agent、Session、Thread 与 Event API 进一步编排。此时需要处理的不只是单个 Agent 能否完成任务,还包括节点之间的状态传递、权限边界、失败恢复和整体可观测性。


配图5-Agent协作图.png


四种 Engineering,一套 Agent 系统


回到最初的 Agent 系统,四个概念回答了不同层次的问题:Context 决定一次模型调用看见什么,Harness 决定一次 Agent 在什么环境中运行,Loop 决定多次运行如何持续推进到目标,Graph 决定多个 Agent 或 Loop 如何连接。

它们不是四套彼此替代的方法,而是同一套 Agent 系统由内向外的四个工程层次。模型能力还会继续变化,新的 Engineering 也会不断出现;需要关注的,始终是系统当前最需要工程化解决的那一层。


配图6-平台能力分层图-v2.png


把 Agent 托管到云端


文中的四个层次,Qoder Cloud Agents 都做成了平台默认能力。核心运行时里,Agent 与 Session 负责定义和运行,Sandbox 与 Vault 划定边界,Event 与 SSE 暴露过程,Managed Agents 提供原生的多 Agent 委派;面向业务交付的 Forward Mode 再往上一层,用 Template 与 Identity 管理多租户配置,用 Schedule、Batch 和 IM Channel 决定执行从哪里发起。开发者要做的只是通过 API 描述自己的 Agent,把它接进业务场景——剩下的持久化、隔离和观测都由平台承担。人可以离开终端,把循环留在云端。


了解 Qoder Cloud Agents

目录
相关文章
|
2天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1716 1
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
10天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2422 12
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
10天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
1108 2
|
10天前
|
人工智能 自然语言处理 数据挖掘
最新版通义千问(Qwen3.8-Max-Preview)功能介绍
2026年,通义千问正式推出全新旗舰级大模型 **Qwen3.8-Max-Preview 预览版**,作为首款突破万亿参数规格的新一代基座模型,该模型总参数量达到**2.4万亿**,采用全新迭代的MoE混合专家架构,综合推理性能、长文本处理、多模态理解、复杂任务规划能力全面超越前代Qwen3.7-Max版本,整体实力跻身全球第一梯队,可对标海外顶级旗舰模型,是当前面向复杂工程开发、多智能体协同、超长文档解析、专业办公自动化场景的最优国产基座模型。
1154 0
|
12天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
1101 46
|
8天前
|
自然语言处理 测试技术 API
通义千问Qwen3.8-Max-Preview全功能解析:2.4万亿参数旗舰模型深度使用指南
在大模型技术持续迭代的当下,通义千问推出的Qwen3.8-Max-Preview作为新一代旗舰预览版模型,凭借2.4万亿参数的超大规模、多模态融合能力与全场景适配特性,成为开发者与企业用户探索AI应用的核心工具。该模型采用稀疏混合专家(MoE)架构,是通义千问首个突破万亿参数的多模态模型,可同时处理文本、图像、视频与文档等多种数据形态,在全栈代码开发、复杂逻辑推理、长文档分析与多智能体协作等场景实现跨越式升级。本文将全面拆解Qwen3.8-Max-Preview的核心功能,详解API调用流程与配置方法,覆盖多场景实战技巧,帮助用户快速掌握这款旗舰模型的使用方法,充分释放其性能潜力。
567 1
|
8天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
742 0
|
11天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南
Qwen3.8-Max-Preview是通义千问Qwen3系列旗舰MoE大模型,参数达2.4万亿,综合推理能力居行业第一梯队。支持思考/快速双模式,擅长大模型五大高难场景。现于阿里云百炼Token Plan、Qoder及QoderWork上线体验,个人版低至39元/月。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
736 1
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南

热门文章

最新文章