大家好,我是晚安code。
DeepSeek 涨价了,8 月 17 日零点生效,最高涨幅冲到 1100%。消息一出,调接口的群里哀嚎一片。别急着骂,这篇把峰谷计价规则掰开揉碎,再给你一个现成的省钱平替方案,看完你就不慌了。
一、DeepSeek 涨价了:最高 1100%,但别只盯着涨幅
DeepSeek 涨价这事,是 2026 年 8 月国产大模型圈最大的新闻,没有之一。
8 月 13 日官方发公告,17 号零点新价生效。按新规则,V4-Pro 高峰时段的输出价从 6 块涨到 27 块(每百万 tokens),涨了 350%;缓存命中的输入价更是从 0.025 涨到 0.30,涨幅 1100%。数字一出来,开发者群就炸了。
不过我先把最重要的一件事说清楚:这次只涨 API 的价格,你在网页端、App 端跟 DeepSeek 聊天,还是免费的。真正被涨价砸到的是我们这些调接口的人。
情绪上我完全理解大家的失落。知名 AI 博主「数字生命卡兹克」那句话被转疯了,大意是理智上知道训练贵、推理也贵,涨价合理,情感上却还是忍不住嘀咕「你小子怎么也叛变了」。这感觉,就像看着一直请你吃饭的老朋友,某天突然递来一张 AA 账单——不是给不起,是心里咯噔一下。

可冷静下来算笔账:摩根士丹利 8 月的研报说,过去一年国产大模型 API 平均输入价涨了约 48%、输出价涨了约 80%,Kimi、智谱、混元都调了价。DeepSeek 不是第一个涨的,也不会是最后一个。放到全球看,V4-Pro 高峰 27 块的输出价,还不到 Claude Fable 5 的 1/12。所以我的态度是:涨得疼,但不算离谱,重点是怎么跟它相处。

二、峰谷计价看懂规则:错峰用,价格直接砍半
DeepSeek 这次调价最值得琢磨的,不是涨了多少,而是它头一回把电力行业的峰谷电价搬进了大模型 API。
算力峰谷分级计价(峰谷计价):把一天按算力紧张程度分成高峰、空闲两档收费的计费方式,灵感来自电力行业的峰谷电价。你可以理解成「大模型 API 的电费峰谷表」——白天高峰贵,夜里错峰便宜。
具体规则很简单:北京时间每天 9:00–12:00、14:00–18:00 是高峰时段,一共 7 小时;剩下 17 个小时都是空闲时段,包括夜间、周末和节假日。空闲时段的价格统一是高峰价的一半。换句话说,同样一批 token,你挪到夜里跑,账单直接砍半。
这就给了我们一个很实在的省钱空间。把手头一个批量代码补全的任务改成了夜间定时跑,跑了一周,账单肉眼可见地缩水——白天偶尔开几个实时对话用高峰价,批量活全丢给后半夜。
错峰的具体玩法,供你参考:
- 批量任务(数据处理、评测、代码批量生成)排到 22:00 后或周末;
- 对延迟不敏感的业务(邮件摘要、日志分析)走定时任务;
- 能开缓存的场景尽量开缓存,缓存命中的输入价只有 0.05 元,比高峰的未命中价便宜 60 倍。


三、预算还紧?小米 MiMo 多模态模型是现成的平替
要是错峰了还觉得贵,我这几个月关注下来,小米的 MiMo 系列是目前最值得试的平替——尤其你需要处理图片、视频的时候。
多模态大模型(Multimodal LLM):能同时理解文字、图片、视频、音频等多种输入的大模型,而不只会读文字。就像同事既能看文字汇报,也能直接对着图表说话。
MiMo-V2.5:小米自研的原生全模态大模型,2026 年 4 月发布,5 月 27 日官方宣布永久降价、最高降 99%,并把价格直接对标 DeepSeek。可以理解成「便宜、又认识图的那种 DeepSeek 平替」。
这里有个关键点你可能没注意到:DeepSeek V4 现在的 API 是纯文本的,官方多模态版本据 InfoQ 报道要 2026 年 Q3 才上。也就是说,你要是想让模型看图理解截图,DeepSeek 现在根本接不了这个活,得靠别的模型。
而小米 MiMo-V2.5 原生就支持图像、视频、音频、文本四种输入,还带 1M 上下文。价格上,5 月降价后它的输入(未命中缓存)只要 1 元、输出 2 元每百万 tokens,比 DeepSeek V4-Flash 空闲时段还便宜一截。
| 对比项 | DeepSeek V4-Flash(空闲) | 小米 MiMo-V2.5 |
|---|---|---|
| 输入(缓存未命中) | 1.5 元/百万 tokens | 1.0 元/百万 tokens |
| 输出 | 4.5 元/百万 tokens | 2.0 元/百万 tokens |
| 多模态 | 纯文本为主(多模态预计 2026 Q3) | 原生全模态:图/视频/音频/文本 |
| 上下文 | 384K | 1M |
| 擅长的活 | 文本、代码补全、工具调用 | 文本、代码 + 识图、视频、音频 |
我最近拿它跑图文理解的任务,把截图丢进去问「这页报错是什么意思」,回答得挺靠谱。论生态成熟度 DeepSeek 还是老大哥,但单论「便宜 + 能识图」,MiMo 的性价比是真打。不想按量付费的话,小米还有 Token Plan 订阅,39 元/月起。

四、别只看便宜:按场景选模型才不踩坑
大模型 API 没有「永远最便宜」的答案,只有「适合当前场景」的答案。
我的建议是三个原则:
- 低延迟、实时交互(聊天、Agent 在线推理):对延迟敏感,错峰意义不大,直接走 DeepSeek,价格涨了也还是国内性价比靠前的那一档;
- 批量、离线、能排队(评测、数据处理、批量代码生成):优先 DeepSeek 空闲时段,或者干脆换小米 MiMo,怎么便宜怎么来;
- 要识图、要视频、要音频:这活 DeepSeek 现在接不了,直接上小米 MiMo-V2.5,它便宜且原生支持。
可能有人会问:换到小米 MiMo,原来 DeepSeek 的代码要怎么改?
基本不用大改。小米 MiMo 走的是 OpenAI 兼容的接口,base_url 换一下、模型 ID 改成 MiMo-V2.5,大多数封装好的代码直接跑通。接之前去官网核对最新的模型 ID 和端点,以官方文档为准。
说句掏心窝的话:把「只能多花钱」换成「错峰省钱 + 平替不贵」,DeepSeek 涨价这事就没那么吓人了。说白了,要么错峰,要么换模型,还能怎么办?

我的判断:实时对话用 DeepSeek 没毛病,批量任务错峰跑,识图这种它暂时接不了的活直接交小米 MiMo——以 2026 年 8 月的定价为准,这是目前最省钱、又不用降级的组合。
我是晚安code,持续分享编程干货。觉得有用的话记得点赞收藏和关注~也欢迎在评论区聊聊:DeepSeek 涨价之后,你是打算错峰用还是换到小米 MiMo?踩过什么坑?