Claude Code 装了 MCP 工具还没调用,账单已经在算钱了(2026年7月更新)

简介: Claude Code账单突增?主因是会话过长+缓存前缀被意外打断(如改CLAUDE.md、换模型、恢复中断会话)。判断是否/new,关键看任务是否需延续上下文,而非凭感觉。/compact用于未完成任务的主动压缩,/new用于完全无关的新任务。

Claude Code 账单突然变高?会话开多久合适,什么时候该 /new(2026年7月更新)

一句话结论:Claude Code 账单突然变高,大概率不是模型变贵了,是会话开太久、又恰好在某一轮做了打断 Prompt Cache 前缀的操作(改 CLAUDE.md、换模型、恢复中断的会话),两件事撞在一起导致的。判断该不该开新会话,看任务是否需要延续之前的上下文,不看感觉。

最近看到不少人在抱怨同一件事。Claude Code 前几天用着挺顺,突然某天账单跳了一大截,任务也没变复杂,钱却多花了不少。Reddit、Discord 上这段时间在问同一个问题的人不少。

排查原因的帖子列了一堆:文件读太多,CLAUDE.md 写太长,测试日志刷屏,MCP 工具返回的数据量太大。这些都对,但很少人讲清楚一件事:这些问题基本都指向同一根线,就是会话开得太久,前缀越拖越重。

一次对话不是"一次对话"

Claude Code 每一轮请求,都会把这次会话到目前为止的所有历史内容重新发一遍。你说过的话,它读过的文件,跑过的命令输出,全都在里面。会话越长,这份"包袱"越重,而它是每一轮都要花钱重新处理的。

Anthropic 的 Prompt Cache 能省掉这部分钱,前提是前缀不能变。中间只要有一处不一样,改了 CLAUDE.md、换了模型、或者用不太规矩的方式恢复会话,前缀从那个点往后全部要重新算。会话进行到第几轮,代价就是这几轮的量级。

不是哪天模型突然变贵了。是那天的会话已经积累了不少历史,又恰好在这个点上做了一次会打断缓存的操作,两件事撞在一起,账单就显得离谱。

那到底该开多久

没有固定数字,但可以按任务类型来判断。

修完一个 bug,接下来要做的是完全不相关的另一件事,就别接着往下聊了。历史包袱在这种情况下没有价值,只有成本。开新会话这个动作本身是免费的,真正花钱的是把不该粘在一起的东西粘在了一起。

反过来,如果在处理一个需要多轮上下文的重构,中途反复开新会话反而不划算,每次重新建立上下文都要花一遍成本,让会话完整跑下去比频繁打断更省钱。

任务做完了但对话还没结束,可以考虑 /compact。这个命令会把已有历史压缩成摘要,触发时那一次要按全价重新计算,所以最好在上下文还不算太长的时候就做。攒到很晚才压缩,代价只会更大。

恢复中断的会话,能不用就尽量不用。中断后再接上的方式,序列化和反序列化过程中很容易和原来的前缀产生细微差异,前缀一旦不一致,之前积累的缓存基本就废了。真要接续,宁可开个新会话,用一两句话把上下文说清楚,成本比接续失败要低。

怎么知道自己现在处在哪种情况

看请求返回里的 usage 字段,具体是 cache_read_input_tokensinput_tokens 这两个数。一个进行中的会话,正常情况下 cache_read_input_tokens 应该远大于 input_tokens,大部分内容在吃缓存,只有新增的一小块按全价算。

如果哪一轮突然反过来,input_tokens 变得很大而 cache_read_input_tokens 掉到接近零,说明前缀在这一轮被打断了。回想一下上一步做了什么,通常就能找到原因。

我现在的习惯是,做完一个明确的子任务就看一眼这两个数字。如果发现历史已经堆得不轻,就会决定这轮之后要不要开新会话,而不是等账单出来才想起来钱花在哪了。

顺带说一句,如果是通过第三方接入 Claude API,这两个字段同样能验证对方是不是把 cache_control 老老实实转发给了官方。像灵眸AI(api.lmuai.com)这类平台,usage 里能看到完整的 cache_read_input_tokens;如果一个平台的返回里始终没有这个字段,那么前面讲的所有省钱思路,在它身上基本都用不上。

会话该开多久,其实不是靠感觉,是有具体机制可以验证的。判断的关键在于想清楚接下来的任务是不是需要之前的上下文,需要就让它继续,不需要就开新的。

常见问题

Claude Code 一天没做什么大改动,账单为什么突然翻倍?
大概率是会话积累了不少历史(Prompt Cache 前缀已经很长),又恰好在这个点上做了一次会打断缓存的操作(改了 CLAUDE.md、换了模型、或者恢复了中断的会话)。前缀一旦被打断,之前攒的历史全部要按全价重新算一遍,会话进行到第几轮,代价就是这几轮的量级。

什么时候该用 /compact,什么时候该用 /new?
/compact 适合"这个任务还没做完,但对话已经很长了"的情况,把历史压缩成摘要继续往下做;/new 适合"接下来要做的事和前面完全不相关"的情况,历史包袱在这种场景下没有价值,只有成本。

恢复中断的会话安全吗?
不建议依赖这种方式继续正在进行的任务。中断后重新接续,序列化和反序列化过程容易和原来的前缀产生细微差异,前缀一旦不一致,之前积累的缓存基本就废了。真要接续,开个新会话用一两句话说清楚上下文,成本比接续失败要低。

相关文章
|
2月前
|
缓存 人工智能 API
CLAUDE.md 不只是写规则,写法本身决定你的 token 账单
CLAUDE.md 不只是项目说明文档,它被注入到每次请求的缓存链条里,排在历史对话之前。Anthropic 的 Prompt Cache 用精确前缀匹配:内容不变才能按 10% 价格命中缓存,哪怕改一个字,后面所有历史对话都要按 125% 重新计算。会话越长,中途改动的代价越大。文章从这个机制出发,讲清楚"CLAUDE.md 要简洁""别在会话中途改""别写临时易变内容"这些常见建议背后的真实原因,并给出通过 API 返回的 usage 字段验证缓存是否真正生效的方法。
|
2月前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
3722 141
|
前端开发 Java 数据安全/隐私保护
聊聊 OAuth 2.0 的 Token 续期处理
Token 校验逻辑 // CheckTokenEndpoint.checkToken @RequestMapping(value = "/oauth/check_token") @ResponseBody public Map checkToken(@RequestPara.
2663 0
一张图看懂Agent Skills运行流程
Agent Skills 并非简单调用插件,而是包含请求进入、能力路由、技能准备、执行调用、结果返回五大阶段的精密链路。需经目标理解、Skill 检索、Schema 校验、上下文注入与权限装载等关键步骤。理清此流程,方能深入理解 Agent、RAG、MCP 等核心机制。
|
3月前
|
人工智能 边缘计算 文字识别
端侧AI+云边协同:工业AR巡检系统的架构设计与实践
本文介绍安之眼科技在大型能源企业的实践:基于AR眼镜与边缘AI,构建“端侧智能+云边协同”巡检系统。通过轻量化模型、MNN推理引擎、三层架构与数字孪生,实现毫秒级响应、断网续巡、自动迭代,使巡检效率提升40%,漏检率下降80%以上。(239字)
411 0
|
6月前
|
存储 人工智能 自然语言处理
AI 英语学习 APP的开发
本项目聚焦2026年AI英语学习APP开发,区别于数字孪生,核心在于NLP与语音交互。涵盖智能对话陪练、音素级纠音、自适应路径及情境翻译四大功能;技术采用GPT-4o/Whisper/Vector DB等;费用10万–300万+,分MVP/专业/企业三级。重运营、强内容、防幻觉。
|
7月前
|
Linux 数据安全/隐私保护 iOS开发
2026年OpenClaw(Clawdbot)阿里云轻量服务器及本地搭建流程详解
2026年,OpenClaw(曾用名Clawdbot、Moltbot)完成品牌整合与重大版本升级,凭借跨平台适配、部署便捷性和功能扩展性的全面优化,成为个人与轻量团队搭建专属AI助手的首选工具,被用户称为“私人AI员工”。其核心价值在于“用自然语言指令实现任务自动化”,无需手动编写脚本,即可完成文档处理、日程管理、文件读写、跨工具协同、代码生成等各类重复性工作,彻底打破技术壁垒,让零基础用户也能轻松拥有专属智能助手。
904 13
|
8月前
|
人工智能 自然语言处理 运维
2026年企业建设智能客服系统多少钱?选型与成本控制全攻略
本文解析2026年智能客服系统建设成本,围绕功能复杂度、渠道覆盖、系统集成等五大影响因素,结合主流产品如瓴羊Quick Service的能力特点,提供选型逻辑与成本控制四大策略,并强调ROI评估与科学选型原则,助力企业以务实路径实现智能服务升级。
2026年企业建设智能客服系统多少钱?选型与成本控制全攻略
|
供应链 物联网 计算机视觉
如何选择合适RFID读写器产品?
选择合适的RFID读写器需综合考虑应用需求、性能指标、环境适应性、接口兼容性和品牌服务等因素。工作频率(低频、高频、超高频)决定适用场景,识别距离和速度满足具体要求;性能上关注发射功率、接收灵敏度和数据准确性;恶劣环境需高防护等级与抗干扰能力;接口兼容确保系统联动。知名品牌与优质售后为项目护航。RFID技术作为非接触式自动识别工具,已在多领域展现价值,合理选型是项目成功的关键。
|
9月前
|
机器学习/深度学习 安全 算法
基于yolov8的安全帽检测系统
本研究基于YOLOv8目标检测算法,构建安全帽佩戴智能识别系统,针对建筑、矿山等高危作业场景,实现对人员头部防护的实时监控与预警。系统结合深度学习与计算机视觉技术,通过高效标注数据集、优化模型结构,提升检测精度与速度,在1080P图像下可达35FPS以上,满足工业级实时性需求。相比传统人工巡查,显著降低漏检率,提高监管效率,助力高危行业向智能化安全管理转型,具有重要应用价值与推广前景。