MCP 重回 HTTP 范式,再次证明架构设计和工程实践才是稀缺资源

简介: Higress 正在开发对 MCP 最新版的支持,将于本周发布。

作者:王晨(望宸)


Higress 在国内率先支持过 MCP Server 的管理,也一直在关注 MCP 的发展。比如MCP 在2024年11月开源后,我们就预感这是相比 Function Calling 更加容易被广泛使用的 Agent 接入外部系统的协议,加速模型的货币化

但 MCP 爆火后,也遇到了一系列挑战,尤其当主流 Agent 客户端开始将 CLI 作为连接外部系统的技术方案时,MCP 被沦为弃子的说法甚嚣尘上。社区对 MCP 的吐槽集中在上下文拥挤和费钱。

AI 时代,造软件简单,但是一旦遇到规模化落地,架构设计和工程质量就成了稀缺资源,这是 AI Coding 很难直接替代的。

这次升级,解决了什么问题?

最新版的核心改动,是把 MCP 从一个有状态、依赖长连接的协议,改回了无状态的请求/响应模型。这也是文章标题所说的“重回 HTTP 范式”的由来,HTTP 协议的无状态是 Web 架构里最基础、最成熟的做法。

过去 MCP 依赖 initialize/initialized 握手和 Mcp-Session-Id 会话标识来维持上下文。这意味着同一会话的多次请求必须落到同一个服务端实例,否则上下文就会丢失。

以高德地图的 MCP Server 为例。用户问“从公司到最近的充电桩怎么走”,Agent 在一次会话里往往要连着调用这个 Server 暴露的多个 tool:先用地理编码工具把地址换成坐标,再用 POI 搜索工具找到附近的充电桩,最后用路径规划工具计算出路线。地理编码、POI 搜索、路径规划这三个 tool 共享同一个会话上下文,在有状态模式下就必须由同一个实例来承载。

可当调用量涨上来、后端部署了多个实例时,负载均衡就不能简单地把请求打散,而要保证同一会话始终回到最初那个实例,也就是会话亲和性。要维持这种亲和性,要么让负载均衡记住会话与实例的绑定关系,要么在实例之间共享会话状态,这些都是横向扩容时额外的架构成本。

新版本把这套握手和会话标识退役了(SEP-2575、SEP-2567),改为每个请求自描述,协议版本、客户端身份和能力都随请求携带,即任何请求都可以落到普通轮询负载均衡后面的任意实例,不再需要共享存储。

原先那些需要服务端主动发起、依赖长连接的交互(elicitation、sampling、roots),被替换成了多轮请求 MRTR:服务端返回 input_required,客户端带上答案重试。Streamable HTTP 请求也开始强制携带 Mcp-Method 和 Mcp-Name 两个 header(SEP-2243),网关、限流器可以直接按 header 路由和计量,无需解析请求体。

社区并非一面倒的支持,新版本是否解决了最痛的槽点?

无状态化解决的是部署和扩展的问题,降低的是运维复杂度,但社区对 MCP 最集中的抱怨是上下文拥挤和费钱,是开发者体验问题,而新版本几乎没有正面回应它们。

上下文拥挤的根源,在于工具定义是前置加载的。Agent 在干活之前,要先把所有可用工具的说明读进上下文,工具数量一多,光这些定义就会占掉相当一部分窗口,真正留给任务本身的空间被压缩。

新版本里和这个问题最接近的改动,是 tools/list、prompts/list、resources/list 的返回结果开始携带 ttlMs 和 cacheScope(SEP-2549),客户端可以缓存工具目录、在重连后保持上游 prompt 缓存稳定。此外还新增了一个可选的 server/discover,让能力发现更前置。但这里需要区分清楚的是:缓存优化的是不要反复重新拉取工具清单,它并没有降低单轮对话里工具定义占用的 token。该占的上下文仍然要占,只是重复获取的次数减少了。因此,对上下文拥挤这个核心槽点来说,缓存是外围的改善,不是本质的解法。

费钱是上下文拥挤的直接结果。token 占用没有下降,调用成本自然也降不下来。新版本没有任何一条改动是来优化压缩工具的。开发者们真正想要的是:工具可以按需加载,只在需要时把相关工具的定义喂进上下文。

新版本自身还带来了一笔新成本,就是迁移。无状态化是一次破坏性变更,对那些依赖会话标识的实现来说,需要改造代码。配套的弃用清单也不短:Dynamic Client Registration 被正式弃用,转向 CIMD;Roots、Sampling、Logging 被弃用;Legacy HTTP+SSE 传输进入退场倒计时。

扎实的架构设计和丰富的工程实践才是稀缺资源

回过头看,这次升级没有引入什么新颖的机制,无状态、请求自描述、按 header 路由,都是 Web 架构里用了很多年的老办法。MCP 之所以要绕一圈再回到这些做法上,是因为爆火之后真正的考验不再是“是否定义了 Agent 连接外部系统的新标准”,而是“能不能在规模化的流量下,保障调用方和维护方的体验”。

前者靠一个 idea 就能解决,后者则是对可扩展性、部署形态和治理成本的通盘考量。这需要扎实的架构设计和丰富的工程实践。这恰恰是 AI 时代最容易被低估、也最稀缺的东西。

Higress 正在开发对 MCP 最新版的支持,将于本周发布:https://github.com/higress-group/higress/pull/4059

相关文章
|
7天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1741 116
|
8天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
1229 8
|
14天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1956 9
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
8天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
542 112
缓存 安全 IDE
904 2
|
20天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
2922 4
|
8天前
|
人工智能 JSON Shell
2026AI漫剧本地全开源方案(附各个软件模型链接),8G显卡也能流畅运行
这是一套完全本地化部署的AI漫剧生成技术链路:涵盖LLM剧本分镜生成、FLUX文生图(IP-Adapter人脸锁定)、StoryDiffusion时序连贯控制、LTX-2.3唇形同步视频生成,及ComfyUI全流程调度。零云端费用,仅耗硬件算力,单集2–4小时可产出竖屏短视频,适配抖音/B站分发。
|
5天前
|
编解码 弹性计算 云计算
MiniMax-H3 视频生成模型 — 一键部署与使用指南
MiniMax-H3是MiniMax开源的33B全模态视频生成模型,支持文生视频、图生视频、参考生视频三种模式,原生输出2K/15秒带立体声音频视频,已原生适配ComfyUI,并可通过阿里云计算巢一键部署。(239字)
|
12天前
|
存储 人工智能 关系型数据库
阿里云AI产品与云产品最新组合套餐:Token Plan、AI coding及云服务器和建站等组合优惠价
阿里云推出全新“算力+模型+应用”一站式云与AI组合套餐活动,覆盖从个人开发者到中大型企业的全场景需求。核心亮点为分三档定价的Token Plan订阅服务,支持Qwen3.8-Max-Preview大模型调用,错峰时段最低可享0.2折优惠。活动同步推出AI Coding、智能体部署、云电脑托管、0代码建站等十余类场景化组合,搭配99元/年的普惠云服务器、88元/年的入门数据库等经典特惠产品,还为企业提供1V1定制化AI转型方案,大幅降低了不同用户群体拥抱AI的技术门槛与采购成本。
745 111

热门文章

最新文章