DeepSeek 涨价后怎么办:峰谷错峰省一半,小米多模态模型可平替

简介: DeepSeek 涨价 8 月 17 日生效,最高涨 1100%。看懂峰谷计价、错峰调用能省一半;预算还紧,小米 MiMo 多模态模型可以平替。

大家好,我是晚安code。

DeepSeek 涨价了,8 月 17 日零点生效,最高涨幅冲到 1100%。消息一出,调接口的群里哀嚎一片。别急着骂,这篇把峰谷计价规则掰开揉碎,再给你一个现成的省钱平替方案,看完你就不慌了。

一、DeepSeek 涨价了:最高 1100%,但别只盯着涨幅

DeepSeek 涨价这事,是 2026 年 8 月国产大模型圈最大的新闻,没有之一。

8 月 13 日官方发公告,17 号零点新价生效。按新规则,V4-Pro 高峰时段的输出价从 6 块涨到 27 块(每百万 tokens),涨了 350%;缓存命中的输入价更是从 0.025 涨到 0.30,涨幅 1100%。数字一出来,开发者群就炸了。

不过我先把最重要的一件事说清楚:这次只涨 API 的价格,你在网页端、App 端跟 DeepSeek 聊天,还是免费的。真正被涨价砸到的是我们这些调接口的人。

情绪上我完全理解大家的失落。知名 AI 博主「数字生命卡兹克」那句话被转疯了,大意是理智上知道训练贵、推理也贵,涨价合理,情感上却还是忍不住嘀咕「你小子怎么也叛变了」。这感觉,就像看着一直请你吃饭的老朋友,某天突然递来一张 AA 账单——不是给不起,是心里咯噔一下。

可冷静下来算笔账:摩根士丹利 8 月的研报说,过去一年国产大模型 API 平均输入价涨了约 48%、输出价涨了约 80%,Kimi、智谱、混元都调了价。DeepSeek 不是第一个涨的,也不会是最后一个。放到全球看,V4-Pro 高峰 27 块的输出价,还不到 Claude Fable 5 的 1/12。所以我的态度是:涨得疼,但不算离谱,重点是怎么跟它相处。

二、峰谷计价看懂规则:错峰用,价格直接砍半

DeepSeek 这次调价最值得琢磨的,不是涨了多少,而是它头一回把电力行业的峰谷电价搬进了大模型 API。

算力峰谷分级计价(峰谷计价):把一天按算力紧张程度分成高峰、空闲两档收费的计费方式,灵感来自电力行业的峰谷电价。你可以理解成「大模型 API 的电费峰谷表」——白天高峰贵,夜里错峰便宜。

具体规则很简单:北京时间每天 9:00–12:00、14:00–18:00 是高峰时段,一共 7 小时;剩下 17 个小时都是空闲时段,包括夜间、周末和节假日。空闲时段的价格统一是高峰价的一半。换句话说,同样一批 token,你挪到夜里跑,账单直接砍半。

这就给了我们一个很实在的省钱空间。把手头一个批量代码补全的任务改成了夜间定时跑,跑了一周,账单肉眼可见地缩水——白天偶尔开几个实时对话用高峰价,批量活全丢给后半夜。

错峰的具体玩法,供你参考:

  1. 批量任务(数据处理、评测、代码批量生成)排到 22:00 后或周末;
  2. 对延迟不敏感的业务(邮件摘要、日志分析)走定时任务;
  3. 能开缓存的场景尽量开缓存,缓存命中的输入价只有 0.05 元,比高峰的未命中价便宜 60 倍。

同样一批 token,白天跑和夜里跑,价差一倍

三、预算还紧?小米 MiMo 多模态模型是现成的平替

要是错峰了还觉得贵,我这几个月关注下来,小米的 MiMo 系列是目前最值得试的平替——尤其你需要处理图片、视频的时候。

多模态大模型(Multimodal LLM):能同时理解文字、图片、视频、音频等多种输入的大模型,而不只会读文字。就像同事既能看文字汇报,也能直接对着图表说话。

MiMo-V2.5:小米自研的原生全模态大模型,2026 年 4 月发布,5 月 27 日官方宣布永久降价、最高降 99%,并把价格直接对标 DeepSeek。可以理解成「便宜、又认识图的那种 DeepSeek 平替」。

这里有个关键点你可能没注意到:DeepSeek V4 现在的 API 是纯文本的,官方多模态版本据 InfoQ 报道要 2026 年 Q3 才上。也就是说,你要是想让模型看图理解截图,DeepSeek 现在根本接不了这个活,得靠别的模型。

而小米 MiMo-V2.5 原生就支持图像、视频、音频、文本四种输入,还带 1M 上下文。价格上,5 月降价后它的输入(未命中缓存)只要 1 元、输出 2 元每百万 tokens,比 DeepSeek V4-Flash 空闲时段还便宜一截。

对比项 DeepSeek V4-Flash(空闲) 小米 MiMo-V2.5
输入(缓存未命中) 1.5 元/百万 tokens 1.0 元/百万 tokens
输出 4.5 元/百万 tokens 2.0 元/百万 tokens
多模态 纯文本为主(多模态预计 2026 Q3) 原生全模态:图/视频/音频/文本
上下文 384K 1M
擅长的活 文本、代码补全、工具调用 文本、代码 + 识图、视频、音频

我最近拿它跑图文理解的任务,把截图丢进去问「这页报错是什么意思」,回答得挺靠谱。论生态成熟度 DeepSeek 还是老大哥,但单论「便宜 + 能识图」,MiMo 的性价比是真打。不想按量付费的话,小米还有 Token Plan 订阅,39 元/月起。

把截图丢给 MiMo-V2.5,它连图带字一起看懂

四、别只看便宜:按场景选模型才不踩坑

大模型 API 没有「永远最便宜」的答案,只有「适合当前场景」的答案。

我的建议是三个原则:

  • 低延迟、实时交互(聊天、Agent 在线推理):对延迟敏感,错峰意义不大,直接走 DeepSeek,价格涨了也还是国内性价比靠前的那一档;
  • 批量、离线、能排队(评测、数据处理、批量代码生成):优先 DeepSeek 空闲时段,或者干脆换小米 MiMo,怎么便宜怎么来;
  • 要识图、要视频、要音频:这活 DeepSeek 现在接不了,直接上小米 MiMo-V2.5,它便宜且原生支持。

可能有人会问:换到小米 MiMo,原来 DeepSeek 的代码要怎么改?

基本不用大改。小米 MiMo 走的是 OpenAI 兼容的接口,base_url 换一下、模型 ID 改成 MiMo-V2.5,大多数封装好的代码直接跑通。接之前去官网核对最新的模型 ID 和端点,以官方文档为准。

说句掏心窝的话:把「只能多花钱」换成「错峰省钱 + 平替不贵」,DeepSeek 涨价这事就没那么吓人了。说白了,要么错峰,要么换模型,还能怎么办?

我的判断:实时对话用 DeepSeek 没毛病,批量任务错峰跑,识图这种它暂时接不了的活直接交小米 MiMo——以 2026 年 8 月的定价为准,这是目前最省钱、又不用降级的组合。


我是晚安code,持续分享编程干货。觉得有用的话记得点赞收藏和关注~也欢迎在评论区聊聊:DeepSeek 涨价之后,你是打算错峰用还是换到小米 MiMo?踩过什么坑?

目录
相关文章
|
1月前
|
人工智能 缓存 API
阿里云Qwen3.8-Max首发上线:API服务与Token Plan同步开放
阿里云于2026年8月正式推出了其最新一代旗舰基座大模型——Qwen3.8-Max。这款模型不仅在参数规模上实现了新的突破,更在推理效率、多模态处理及长周期任务执行上展现了卓越的性能,标志着通义千问系列模型迈入了一个全新的智能体时代。本文将深入解析Qwen3.8-Max的技术特性、应用场景、价格体系及接入方式,为开发者和企业提供一份详尽的参考指南。
|
24天前
|
人工智能 安全 前端开发
GLM 5.3 硬刚 Kimi K3:不换基座的极限压榨,能否打赢 3 万亿参数的新王者
JeecgBoot AI专题研究 国产开源大模型双雄对决深度解析:GLM 5.3 后训练 Scaling 路线 vs Kimi K3 超大新基座路线8 月的国产大模型圈,热闹得像春运火车站。8 月 13 日凌晨 DeepSeek V4 Pro 刚刚刷屏,8 月 14 日智谱就接过了接力棒:正式发
631 0
GLM 5.3 硬刚 Kimi K3:不换基座的极限压榨,能否打赢 3 万亿参数的新王者
|
17天前
|
Web App开发 人工智能 API
16 个超火的 DeepSeek Harness 插件,大肥鱼已经落后 N 个版本了。。。
DeepSeek Harness 精选插件推荐合集,从图片识别、浏览器操控、多 Agent 协作到手机远程控制,一口气带你看完 DSH 社区热门的十几个插件,覆盖技能扩展、UI 界面增强、整活玩法三大类,让你的鲸鱼变得更强。
1964 5
|
22天前
|
开发工具 Swift git
DeepSeek Harness 插件推荐:4 款开源神器让写代码直接起飞
DeepSeek Harness 插件推荐:ModLens 视觉、Web UI 全家桶、Mac 原生与 GenUI 渲染,4 款开源插件给纯文本模型补齐短板。
2193 7
DeepSeek Harness 插件推荐:4 款开源神器让写代码直接起飞
|
Ubuntu Docker 容器
如何在Ubuntu上安装Docker?
【2月更文挑战第10天】
1410 0
|
18天前
|
人工智能 缓存 前端开发
智谱GLM-5.3+ZCode Agent,真实项目第一手实测!
智谱推出ZCode智能体开发环境,与旗舰模型GLM-5.3深度协同,实现“原生模型+原生Agent”高效配合。实测显示,ZCode提升任务通过率2.39%,缓存命中率超98%,显著降本增效。零配置、多平台、支持SSH/Docker,真实项目重构验证其开箱即用与工程落地能力。
722 0
智谱GLM-5.3+ZCode Agent,真实项目第一手实测!
|
1月前
|
人工智能 缓存 API
阿里云百炼Night Plan全解析:夜间22:00-08:00错峰AI算力2折起深度指南
阿里云百炼Night Plan是百炼平台推出的**夜间错峰专属优惠计划**,核心价值是在夜间低峰时段为用户提供旗舰模型的超低折扣调用,帮助开发者、创作者与企业大幅降低AI算力成本。该计划覆盖Qwen3.7-Max、Qwen3.7-Plus等核心模型,在每晚22:00至次日08:00(北京时间)自动生效,无需手动切换配置,即可享受最高2折的专属价格,且服务质量、响应速度与白天完全一致。Night Plan深度适配Qoder CN、秒悟Meoo等百炼生态产品,与Token Plan、Coding Plan等订阅方案无缝兼容,是平衡AI算力成本与性能的最优选择。本文将从核心定位、适用范围、计费规则、
238 4
|
6月前
|
人工智能 自然语言处理 API
OpenClaw(Clawdbot)阿里云部署图文教程,+Claude Code Skill 搭建自动化内容生产线,一键出稿出图推送!
一人运营公众号,40天实现5000+关注者、单篇文章万+阅读——这样的冷启动成绩,并非依赖高强度人工创作,而是借助OpenClaw+Claude Code Skill搭建的自动化内容生产线:仅需一行指令,即可完成出稿、出图、排版、推送全流程,将创作者从重复劳动中解放,专注选题与创意打磨。
2314 8
|
25天前
|
机器学习/深度学习 人工智能 缓存
Grok 4.6:追平 GPT-5.6 Sol 的半价旗舰,但别只看跑分
Grok 4.6是xAI于2026年8月发布的1.5万亿参数大模型,专注长程智能体任务,AI指数61分追平GPT-5.6 Sol;回合效率领先(仅需53步),定价$2/$6(百万Token),但超20万Token即翻倍。

热门文章

最新文章