Agent 工程里,上下文工程为什么比 Prompt 更重要?

简介: 本文解读《Hello-Agents》第9章“上下文工程”,指出其比单纯Prompt工程更贴近真实Agent开发:核心是在有限token内,科学筛选、组织并注入系统规则、历史对话、RAG结果、工具输出等多元信息,提升模型决策质量。

今天看了 Hello-Agents 第9章「上下文工程」,感觉这一章比单纯讲 prompt 更贴近真实 Agent 工程。

以前我会觉得,模型回答不好,可能是提示词没写好。但放到真实 Agent 系统里看,问题往往不是一句 prompt 能解决的,而是每次调用模型前,我们到底给它看了什么。

对一个 Agent 来说,上下文不只是用户当前问题,还可能包括系统规则、历史对话、知识库召回内容、工具调用结果、任务状态、用户偏好、临时笔记等。如果这些内容没有经过筛选和组织,全部塞给模型,反而可能让模型抓不到重点,甚至产生错误判断。

所以我现在理解的上下文工程,核心不是“把信息尽量塞满”,而是“在有限 token 预算里,构造高质量输入”。

比如在企业客服 Agent 场景里,上下文里可能需要包含:用户当前问题、最近几轮有效对话、知识库召回的关键片段、当前业务信息、工具调用结果、是否已经转人工、系统回答规则和边界。

这些信息的优先级其实不一样。比如用户已经转人工了,那这个状态就应该优先于自动回复;知识库召回内容太多时,也需要排序、裁剪和压缩;历史对话太长时,也不能无脑保留,否则会污染当前回答。

这章让我意识到,Agent 工程不只是“模型 + 工具 + RAG”,更重要的是把模型每次决策前看到的信息管理好。

一句话总结:Prompt 工程更像是“怎么说”,上下文工程更像是“让模型基于什么信息来判断”。

后续如果继续做 Agent/RAG 项目,我会更关注上下文构建这块,比如历史对话怎么保留、RAG 结果怎么组织、工具结果怎么结构化、状态信息怎么参与模型决策。感觉这部分才是 Agent 从 demo 走向真实工程系统时很关键的一环。

(顺便吐槽一下今天在公司上班好无聊捏)

相关文章
|
11天前
|
人工智能 运维 监控
AI Agent开发平台的技术架构探索与功能设计
2026年,企业级AI Agent市场规模预计达449亿元,但仍有60%的企业停留在试点阶段——规模化落地的核心障碍并非模型能力,而是可观测性、管控粒度与层级治理的缺失。 本文从技术架构视角出发,对比分析了Dify、Coze、LangChain及主流云厂商平台在监控深度、管控粒度、编排耦合、层级抽象和声明式管理五个维度的共性不足。 在此基础上,我们提出并实践了一套七层递进式治理架构(工具库→Skill→工作流→Agent→编排→项目→安全策略),实现了六层穿透式监控能力——成本可从项目逐级下钻到单次工具调用,解决了“钱花在哪、谁花的、值不值”的核心问题。同时支持可视化拖拽与声明式YAML双
186 1
|
1月前
|
机器学习/深度学习 人工智能 应用服务中间件
别再被误导了!一文讲透 MCP 与 Function Calling 的真实关系
AI圈热议MCP能否取代Function Calling?实则二者定位迥异:Function Calling是大模型的“决策层”,负责选工具、生成参数;MCP是后端与工具间的“执行协议”,统一调用标准。二者分属不同链路环节,非替代关系,而是协同互补的“黄金搭档”。
|
9天前
|
安全 Ubuntu Linux
Codex 完整避坑指南(2026 版):沙箱、权限、AGENTS.md、Worktree 七类坑一次讲清
Codex用不好,多因配置而非模型——本文提炼官方文档21个高频坑,按国内开发者踩坑频率归为七类:环境、沙箱、Worktree、提示词、AGENTS.md、上下文、自动化,每坑附官方修复+防坑规则,10分钟读完省时以天计。(239字)
324 3
|
10天前
|
人工智能 前端开发 程序员
Gemini 3.5 Pro 泄露刷屏!前端一次成型赶超 Fable 5,7 月 17 日或将亮相
Gemini 3.5 Pro是谷歌2026年旗舰大模型,传闻7月17日发布。前端生成能力跃升:设计更专业、UI更简洁、SVG一次精准成型,被指赶超Fable 5;但硬核推理、长程任务仍弱于Fable 5与GPT-5.6。全新底座预训练,将同步推出对标GPT-Image 2的Nano Banana Pro。(239字)
442 3
|
1月前
|
人工智能 JSON API
MCP 从入门到实战:让大模型真正「动手」
本文系统讲解MCP(模型上下文协议)原理与实战,厘清Host、Server、Tool角色分工,解析AI如何基于描述与Schema智能选工具,并提供可直连Cherry Studio的Python监控服务示例,助你让大模型真正“动手”。
MCP 从入门到实战:让大模型真正「动手」
|
20天前
|
Shell API 开发工具
Claude Code 实战:Agent Skills
面向已用 Claude Code 写代码的开发者,讲清 Skills 三层结构与完整实操路径,帮你把重复工作流封装成可复用、可 Review 的技能包。
Claude Code 实战:Agent Skills
|
1月前
|
人工智能 运维 安全
语义压缩,才是提示词工程的底层心法
提示词工程的底层心法是**语义压缩**:剔除寒暄、情绪与模糊期待,精准锚定角色、任务、约束与格式。它不是写短,而是压缩冗余、提升信噪比、明确边界、适度留白——让AI像执行协议般可靠输出。Agent时代,语义压缩关乎执行安全。
324 19
语义压缩,才是提示词工程的底层心法
|
23天前
|
存储 人工智能 测试技术
Hermes Agent:深度技术剖析报告
Hermes Agent 是Nous Research于2026年开源的自主AI智能体框架,首创“闭环学习回路”,通过五层记忆系统、自主技能生成(Skill)、辩证式用户建模(Honcho)与FTS5跨会话搜索,解决LLM“失忆症”。MIT许可,Python构建,支持多平台、多模型Provider及MCP双向集成,GitHub星标超1.7万。
671 1
|
17天前
|
人工智能 监控 自动驾驶
Loop Engineering 实战:/goal 命令让 AI 自己写完整项目
Loop Engineering 让 AI 自己循环干活。本文用 Claude Code /goal 带你从零搭项目,跑通自动开发全流程——设定目标,循环搞定。
Loop Engineering 实战:/goal 命令让 AI 自己写完整项目
|
13天前
|
JSON 人工智能 数据可视化
Claude Code 四大定制机制完全指南:CLAUDE.md、Hooks、Skills、Subagents 怎么选怎么用
本文详解Claude Code四大定制机制:CLAUDE.md(持久记忆)、Hooks(硬约束执行)、Skills(按需流程)、Subagents(隔离分工),涵盖配置模板、选型决策表及团队工程化分层实践,全部基于2026年7月2日官方文档。
459 1

热门文章

最新文章