连微软都嫌AI太贵:正测试 DeepSeek V4 平替 Copilot 昂贵底层模型

简介: 微软因Copilot Cowork智能体调用成本过高(GPT/Claude账单“不可持续”),拟引入中国开源模型DeepSeek V4作为低成本选项,并转向按Token计费。此举标志AI行业从“模型崇拜”转向“成本工程”。

时间:美东时间 2026年6月16日(对应北京时间6月17日),信源来自美国数字媒体 Axios 的专访报道。

地点 / 主体:美国——微软(Microsoft),具体由微软 Copilot、智能体与平台业务执行副总裁查尔斯·拉曼纳(Charles Lamanna) 出面披露。

涉事第三方:中国AI公司 深度求索(DeepSeek / 幻方量化旗下) 于2026年4月发布的开源大模型 DeepSeek V4

发生了什么?

微软旗下企业AI智能体产品线 Copilot Cowork(自主执行多步骤任务的代理式AI工具)长期依赖 OpenAI 的 GPT 系列Anthropic 的 Claude 系列 作为推理底层。但智能体的工作模式意味着——一旦用户把任务"委派"出去,模型会被持续、密集地反复调用,单次任务可能跑数小时、每周完成数百项任务。结果是:算力账单飙升到了连微软自己都觉得"商业上不可持续"的程度


拉曼纳的原话很直白:

"我们有用户每周完成数百项任务,这固然很好——他们的生产力大幅提升——但代价是成本可能变得非常高。"

为此微软同步打出 两张牌

  1. 计费模式切换:Copilot Cowork 从原来的 固定订阅 / "无限畅用" 模式,转向 按实际使用量(Token消耗)计费,让重度使用者按真实消耗付费。  
  2. 模型降阶探索:微软正在内部 测试和精调 DeepSeek V4 的微调版本(同时也看其他开源模型),考虑将其作为驱动 Copilot Cowork 的 低成本可选方案 提供给企业客户——并非一刀切替换,而是加入一个更便宜的选项让用户按需自选。  

为什么是 DeepSeek V4?核心就一个数字:价差。

据公开定价统计,DeepSeek V4 Flash 的报价约 输入 0.14/百万Token、输出0.28 / 百万Token,而 Anthropic 同级模型输出定价动辄数十美元/百万Token——两者价差可达 约20~57倍。对大量"不需要顶级推理"的常规办公自动化场景来说,开源模型能力已经够用,综合成本可压降九成以上

安全与地缘顾虑怎么回应?

微软强调:即便最终选 DeepSeek,也只会作为 客户可选方案,且模型将 完全托管在微软自己的 Azure 云平台 上运行,客户数据始终留在微软云环境内,受 Azure 企业级安全、合规与数据驻留机制保护;微软还表示已对模型做了额外精调及防护层(含降偏见等安全措施)。

时间线:微软预计在 未来数周内 确认最终选型并推出低成本模型选项。

有什么影响?

维度

含义

对微软–OpenAI关系

这不是"分手声明",但信号强烈——连最大金主(累计投超130亿美元)都要开始对冲,说明"单一闭源高端模型捆绑"的商业脆弱性已被成本曲线击穿

对企业采购

Copilot 从"订阅制豪华套餐"走向"自助餐按盘结账 + 平价套餐可选",中小企业上手门槛有望下降

对大模型市场

开源/高性价比模型的议价权骤升,价格战将从API层打到平台层,西方高价模型被迫重新自证"贵的那部分到底值不值"

对DeepSeek / 中国AI

进入全球最大企业软件分销渠道的评估名单本身已是标志性背书,但最终能否落地仍受安全审查、合规与客户接受度制约

一句话总结

当"每月每座位数十美元随便用AI"撞上"智能体每天烧几百万次Token",账单赢了——微软的选择本质上是整个行业从『模型崇拜』向『成本工程』的一次公开转向。 DeepSeek V4 是否真进 Copilot,未来几周见分晓;但"多模型 + 按量计费"这条路线,微软已经明牌打出来了。  

目录
相关文章
|
9月前
|
小程序 机器人 开发工具
飞书文档自动更新到百炼知识库
计算巢AppFlow支持定时自动同步飞书文档至百炼知识库,实现RAG检索。通过创建飞书应用、配置权限与凭证,结合AppFlow流程模板,可高效完成知识库自动化更新,大幅降低人工维护成本。
1373 4
|
2月前
|
人工智能 安全 前端开发
阿里云Qoder CN AI编程智能体:重塑开发全流程的智能助手
在软件开发领域,AI技术正从简单的代码补全工具,进化为能够贯穿需求分析、代码编写、测试验证、项目管理全流程的智能体。阿里云推出的Qoder CN AI编程智能体,正是这一趋势下的核心产品,它脱胎于通义灵码,完成了从传统AI集成开发环境到智能体全自动自主开发工作台的跨越,为个人开发者、技术团队及企业级项目提供了全方位的智能开发支持。Qoder CN不再局限于单一的代码辅助,而是以智能体为核心,构建了一套完整的开发生态,通过多模型融合、多智能体协作、全流程自主执行等能力,彻底改变传统开发模式,大幅提升开发效率与代码质量。
328 3
|
26天前
|
人工智能 缓存 算法
ZCode大更新!GLM最佳Harness隆重登场!
今日GLM-5.3正式发布:编程能力跃升,内部体感评测较5.2提升50%,TerminalBench3.0、Agents' Last Exam(CLI)等开源基准登顶第一。同期ZCode上线Goal/Subagents/闲时任务等重磅功能,以98.1%缓存命中率与智能Harness大幅提效,推动AI从“辅助执行”迈向“自主闭环”。
|
2月前
|
存储 云安全 人工智能
“千问云”是什么?与“阿里云”定位有何差异?一文读懂二者区别
阿里云是提供计算、存储等基础设施的云计算服务商;千问云则是阿里云旗下专为AI Agent时代打造的MaaS(模型即服务)平台,聚合480+主流大模型,支持模型调用、推理与智能体构建,面向AI开发者。定位不同,互补协同。阿里云官方活动:https://t.aliyun.com/U/OTnSAH
253 2
|
3月前
|
存储 人工智能 缓存
智谱 GLM 5.2自托管深度实操:硬件选型、vLLM/SGLang部署与成本测算
GLM 5.2作为开源的旗舰大模型,支持完整自托管部署,可实现数据不出环境、自定义调度与私有化审计,适配企业级代码开发、长文档推理、智能体任务等场景。以下从硬件选型、vLLM与SGLang部署、成本盈亏测算三大核心维度,详解全流程实战方案。
678 1
|
3月前
|
人工智能 运维 Linux
终端AI编程助手Claude Code全解:安装配置、百炼Token Plan接入与多智能体联动
在AI开发工具生态快速完善的当下,终端原生编程工具Claude Code凭借轻量、任务驱动、多模型兼容的特性,成为开发者主流辅助工具。区别于传统IDE插件类代码补全工具,Claude可直接在终端完成项目分析、批量文件修改、脚本生成、Git运维、自动化测试等全流程操作,无需频繁切换图形界面。同时它完整兼容国产大模型接口,可无缝对接阿里云百炼Token Plan订阅服务,解决海外模型网络延迟、计费成本高的痛点。
559 0
|
3月前
|
存储 人工智能 监控
Hermes Agent+Obsidian完整闭环:让笔记从死文件变为可复用AI工作资产全解
Hermes Agent搭配Obsidian的核心价值,彻底解决传统第二大脑“笔记存而不用”的死文件困境,通过本地Markdown标准化存储+可执行AI智能体,构建“读取历史知识→执行当前任务→沉淀新增经验”永久闭环。
479 0
|
5月前
|
人工智能 监控 Kubernetes
hermes + ollama 本地模型实践分享
想把 AI 跑在自己的电脑上?其实没那么难。本文介绍如何用 Ollama 配合 hermes-agent,只需一条命令,就能在本地启动。数据全程不离开自己的硬盘,断网也能用。通过 Java 和 k8s 日志案例,展示了 hermes-agent 自动创建并改进技能的全过程,一行代码都不用写。
2655 0
hermes + ollama 本地模型实践分享
|
3月前
|
存储 人工智能 小程序
做一个校园外卖跑腿小程序需要多少钱?开发成本详细分析
随着校园即时配送市场快速发展,校园外卖跑腿小程序成为越来越多创业团队和高校服务平台的热门选择。本文详细分析校园外卖跑腿小程序开发成本、源码部署价格、定制开发费用、功能模块组成以及后期运营支出。