DeepSeek 涨价后怎么办:峰谷错峰省一半,小米多模态模型可平替

简介: DeepSeek 涨价 8 月 17 日生效,最高涨 1100%。看懂峰谷计价、错峰调用能省一半;预算还紧,小米 MiMo 多模态模型可以平替。

大家好,我是晚安code。

DeepSeek 涨价了,8 月 17 日零点生效,最高涨幅冲到 1100%。消息一出,调接口的群里哀嚎一片。别急着骂,这篇把峰谷计价规则掰开揉碎,再给你一个现成的省钱平替方案,看完你就不慌了。

一、DeepSeek 涨价了:最高 1100%,但别只盯着涨幅

DeepSeek 涨价这事,是 2026 年 8 月国产大模型圈最大的新闻,没有之一。

8 月 13 日官方发公告,17 号零点新价生效。按新规则,V4-Pro 高峰时段的输出价从 6 块涨到 27 块(每百万 tokens),涨了 350%;缓存命中的输入价更是从 0.025 涨到 0.30,涨幅 1100%。数字一出来,开发者群就炸了。

不过我先把最重要的一件事说清楚:这次只涨 API 的价格,你在网页端、App 端跟 DeepSeek 聊天,还是免费的。真正被涨价砸到的是我们这些调接口的人。

情绪上我完全理解大家的失落。知名 AI 博主「数字生命卡兹克」那句话被转疯了,大意是理智上知道训练贵、推理也贵,涨价合理,情感上却还是忍不住嘀咕「你小子怎么也叛变了」。这感觉,就像看着一直请你吃饭的老朋友,某天突然递来一张 AA 账单——不是给不起,是心里咯噔一下。

可冷静下来算笔账:摩根士丹利 8 月的研报说,过去一年国产大模型 API 平均输入价涨了约 48%、输出价涨了约 80%,Kimi、智谱、混元都调了价。DeepSeek 不是第一个涨的,也不会是最后一个。放到全球看,V4-Pro 高峰 27 块的输出价,还不到 Claude Fable 5 的 1/12。所以我的态度是:涨得疼,但不算离谱,重点是怎么跟它相处。

二、峰谷计价看懂规则:错峰用,价格直接砍半

DeepSeek 这次调价最值得琢磨的,不是涨了多少,而是它头一回把电力行业的峰谷电价搬进了大模型 API。

算力峰谷分级计价(峰谷计价):把一天按算力紧张程度分成高峰、空闲两档收费的计费方式,灵感来自电力行业的峰谷电价。你可以理解成「大模型 API 的电费峰谷表」——白天高峰贵,夜里错峰便宜。

具体规则很简单:北京时间每天 9:00–12:00、14:00–18:00 是高峰时段,一共 7 小时;剩下 17 个小时都是空闲时段,包括夜间、周末和节假日。空闲时段的价格统一是高峰价的一半。换句话说,同样一批 token,你挪到夜里跑,账单直接砍半。

这就给了我们一个很实在的省钱空间。把手头一个批量代码补全的任务改成了夜间定时跑,跑了一周,账单肉眼可见地缩水——白天偶尔开几个实时对话用高峰价,批量活全丢给后半夜。

错峰的具体玩法,供你参考:

  1. 批量任务(数据处理、评测、代码批量生成)排到 22:00 后或周末;
  2. 对延迟不敏感的业务(邮件摘要、日志分析)走定时任务;
  3. 能开缓存的场景尽量开缓存,缓存命中的输入价只有 0.05 元,比高峰的未命中价便宜 60 倍。

同样一批 token,白天跑和夜里跑,价差一倍

三、预算还紧?小米 MiMo 多模态模型是现成的平替

要是错峰了还觉得贵,我这几个月关注下来,小米的 MiMo 系列是目前最值得试的平替——尤其你需要处理图片、视频的时候。

多模态大模型(Multimodal LLM):能同时理解文字、图片、视频、音频等多种输入的大模型,而不只会读文字。就像同事既能看文字汇报,也能直接对着图表说话。

MiMo-V2.5:小米自研的原生全模态大模型,2026 年 4 月发布,5 月 27 日官方宣布永久降价、最高降 99%,并把价格直接对标 DeepSeek。可以理解成「便宜、又认识图的那种 DeepSeek 平替」。

这里有个关键点你可能没注意到:DeepSeek V4 现在的 API 是纯文本的,官方多模态版本据 InfoQ 报道要 2026 年 Q3 才上。也就是说,你要是想让模型看图理解截图,DeepSeek 现在根本接不了这个活,得靠别的模型。

而小米 MiMo-V2.5 原生就支持图像、视频、音频、文本四种输入,还带 1M 上下文。价格上,5 月降价后它的输入(未命中缓存)只要 1 元、输出 2 元每百万 tokens,比 DeepSeek V4-Flash 空闲时段还便宜一截。

对比项 DeepSeek V4-Flash(空闲) 小米 MiMo-V2.5
输入(缓存未命中) 1.5 元/百万 tokens 1.0 元/百万 tokens
输出 4.5 元/百万 tokens 2.0 元/百万 tokens
多模态 纯文本为主(多模态预计 2026 Q3) 原生全模态:图/视频/音频/文本
上下文 384K 1M
擅长的活 文本、代码补全、工具调用 文本、代码 + 识图、视频、音频

我最近拿它跑图文理解的任务,把截图丢进去问「这页报错是什么意思」,回答得挺靠谱。论生态成熟度 DeepSeek 还是老大哥,但单论「便宜 + 能识图」,MiMo 的性价比是真打。不想按量付费的话,小米还有 Token Plan 订阅,39 元/月起。

把截图丢给 MiMo-V2.5,它连图带字一起看懂

四、别只看便宜:按场景选模型才不踩坑

大模型 API 没有「永远最便宜」的答案,只有「适合当前场景」的答案。

我的建议是三个原则:

  • 低延迟、实时交互(聊天、Agent 在线推理):对延迟敏感,错峰意义不大,直接走 DeepSeek,价格涨了也还是国内性价比靠前的那一档;
  • 批量、离线、能排队(评测、数据处理、批量代码生成):优先 DeepSeek 空闲时段,或者干脆换小米 MiMo,怎么便宜怎么来;
  • 要识图、要视频、要音频:这活 DeepSeek 现在接不了,直接上小米 MiMo-V2.5,它便宜且原生支持。

可能有人会问:换到小米 MiMo,原来 DeepSeek 的代码要怎么改?

基本不用大改。小米 MiMo 走的是 OpenAI 兼容的接口,base_url 换一下、模型 ID 改成 MiMo-V2.5,大多数封装好的代码直接跑通。接之前去官网核对最新的模型 ID 和端点,以官方文档为准。

说句掏心窝的话:把「只能多花钱」换成「错峰省钱 + 平替不贵」,DeepSeek 涨价这事就没那么吓人了。说白了,要么错峰,要么换模型,还能怎么办?

我的判断:实时对话用 DeepSeek 没毛病,批量任务错峰跑,识图这种它暂时接不了的活直接交小米 MiMo——以 2026 年 8 月的定价为准,这是目前最省钱、又不用降级的组合。


我是晚安code,持续分享编程干货。觉得有用的话记得点赞收藏和关注~也欢迎在评论区聊聊:DeepSeek 涨价之后,你是打算错峰用还是换到小米 MiMo?踩过什么坑?

目录
相关文章
|
12天前
|
人工智能 缓存 API
阿里云Qwen3.8-Max首发上线:API服务与Token Plan同步开放
阿里云于2026年8月正式推出了其最新一代旗舰基座大模型——Qwen3.8-Max。这款模型不仅在参数规模上实现了新的突破,更在推理效率、多模态处理及长周期任务执行上展现了卓越的性能,标志着通义千问系列模型迈入了一个全新的智能体时代。本文将深入解析Qwen3.8-Max的技术特性、应用场景、价格体系及接入方式,为开发者和企业提供一份详尽的参考指南。
开发工具 Swift git
1295 1
机器学习/深度学习 人工智能 缓存
420 0
|
2月前
|
人工智能 缓存 自然语言处理
阿里云百炼接入DeepSeek-V4全解析:大模型能力、计费优惠、节省计划与全行业AI开发实战落地指南
2026年阿里云百炼正式接入DeepSeek-V4系列大模型,同步推出DeepSeek-V4-pro旗舰版、DeepSeek-V4-Flash轻量化版两套规格,API基础定价与模型官方完全统一,百万Tokens输入最低1元、输出最低2元,叠加平台专属活动包季最低4.5折。该系列原生支持百万级超长上下文,依托MoE稀疏架构降低推理算力消耗,覆盖电商、广告、短剧、AI编程、智能客服、企业办公等几乎全部AI落地场景,同时配套全模型通用节省计划,一次购买可通用于平台150余款大模型,简化多模型项目成本管控。
774 0
|
2月前
|
Apache 芯片 异构计算
刚发布的 Gemma4 12B 能打吗?三款最新顶流开源模型跑分全解读,堪比跟去年主流闭源模型
Gemma4 12B(6月3日刚发布)、Gemma4 26B A4B、Qwen3.6-35B-A3B,三款近期开源模型在 MMLU-Pro、GPQA Diamond、AIME 等评测中全面对标 Claude Sonnet 4 和 GPT-4.1 这两款 2025 年中闭源旗舰 ,数学科学推理甚至大幅领先。一文看懂跑分、架构差异和使用场景。
794 0
|
Java Android开发 开发者
1024程序节|Android框架之一 BRVAH【BaseRecyclerViewAdapterHelper】使用demo
BRVAH是一个强大的RecyclerAdapter框架(什么是RecyclerView?),它能节约开发者大量的开发时间,集成了大部分列表常用需求解决方案。为什么会有它?请查看「Android开源框架BRVAH由来篇」该框架于2016年4月10号发布的第1个版本到现在已经一年多了,经历了800多次代码提交,140多次版本打包,修复了1000多个问题,获得了9000多star,非常感谢大家的使用以及反馈。
731 0
|
5月前
|
SQL 人工智能 BI
AI + Data中的 Semantic View:从语义层到 AI 可用的“业务语言”
本文面向数据平台/数仓/湖仓架构师等角色,深入解析AI时代数据平台的刚需——Semantic View(语义视图)。它并非普通SQL视图,而是将业务指标、维度、关系、口径规则等结构化沉淀为可治理、可复用、AI-ready的平台级资产,统一BI、Notebook与Agent的数据“真相接口”,解决多工具口径不一、LLM幻觉、治理难落地等核心痛点。(239字)
1183 0
|
数据安全/隐私保护
Excel中如何设置随机密码
Excel中如何设置随机密码
|
缓存 监控 供应链
当当平台商品详情接口开发指南:从接入到实战
当当网开放平台提供商品详情接口(dangdang.item.get),支持获取图书商品的基础信息、价格、库存、多媒体等数据,适用于价格监控、库存管理、推荐系统等场景。开发者需注册账号、创建应用并申请接口权限,通过API调用实现商品数据获取与管理。
|
存储 数据采集 人工智能
AllData数据中台架构全览:数据时代的智慧中枢
杭州奥零数据科技有限公司成立于2023年,专注于数据中台业务,维护开源项目AllData并提供商业版解决方案。AllData提供数据集成、存储、开发、治理及BI展示等一站式服务,支持AI大模型应用,助力企业高效利用数据价值。
AllData数据中台架构全览:数据时代的智慧中枢

热门文章

最新文章