阿里云AI模型收费价格:百炼API按量付费、Token Plan、Coding Plan和节省计划四种计费方式指南

简介: 阿里云百炼AI模型提供四种计费方式:①按量付费(默认,按Token计费);②Token Plan(个人/团队订阅,含月度Credits额度);③Coding Plan(专为编程场景设计,90,000次/月);④AI节省计划(承诺消费享最高5.3折)。新用户开通即赠超7000万免费Tokens,覆盖主流大模型如Qwen、DeepSeek等。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens

阿里云AI模型如何收费?在阿里云百炼AI大模型平台调用API,默认是按量付费使用Token,也可以通过订阅Token Plan或Coding Plan计划使用Token更省钱,还有一种方式是购买AI模型的节省计划,阿小云整理详细的百炼AI模型四种计费方式,还有开通百炼先免费领取超7000万Tokens,免费Token领取 👉️ 阿里云百炼AI模型免费领取千万Tokens  如下图:

阿里云百炼AI模型收费.jpg

付费方式一、按量付费(默认)

阿里云模型是在百炼AI模型平台API调用的,默认开通百炼后的token计费方式就是按量付费,模型不同价格不同,根据实际使用的Tokens,然后乘以模型的单价,计算出费用。阿小云整理部分模型如千问Max和DeepSeek的收费价格表,以华北2(北京)地域为例,大家可以参考下:


千问Max 模型收费标准

  • 计费规则:按输入Token和输出Token计费。
  • 影响计费的因素:若模型支持Batch调用,其输入和输出Token单价均按实时推理价格的50%计费;若模型支持上下文缓存,仅输入Token享有折扣。两者不能同时生效。


模型 ID(Model ID) 模式 单次请求的输入Token数 输入单价(每百万Token) 输出单价(每百万Token)
思维链+回答

免费额度(注)

有效期:自开通百炼/模型发布/申请通过之日起90天内(以较晚者为准)

qwen3.8-max-prime

更多详情参考优速模式(Prime)

非思考和思考模式

0<Token≤1M

24元

72元

无免费额度

qwen3.8-max

Batch调用半价

上下文缓存享有折扣

非思考和思考模式

0<Token≤1M

12元

36元

100万Token

qwen3.8-max-0902

上下文缓存享有折扣

非思考和思考模式

0<Token≤1M

12元

36元

100万Token

qwen3.7-max

当前能力等同于qwen3.7-max-2026-05-20

Batch调用半价

上下文缓存享有折扣

非思考和思考模式

0<Token≤1M

12元

36元

100万Token

qwen3.7-max-2026-06-08

非思考和思考模式

0<Token≤1M

12元

36元

100万Token

qwen3.7-max-2026-05-20

非思考和思考模式

0<Token≤1M

12元

36元

100万Token

qwen3.7-max-preview

当前能力等同于qwen3.7-max-2026-05-17

仅思考模式

0<Token≤1M

12元

36元

100万Token

qwen3.7-max-2026-05-17

仅思考模式

0<Token≤1M

12元

36元

100万Token

qwen3.6-max-preview

上下文缓存享有折扣

非思考和思考模式

0<Token≤128K

9元

54元

100万Token

128K<Token≤256K

15元

90元

qwen3-max

当前能力等同于qwen3-max-2026-01-23

Batch调用半价

上下文缓存享有折扣

非思考和思考模式

0<Token≤32K

2.5元

10元

100万Token

32K<Token≤128K

4元

16元

128K<Token≤256K

7元

28元

qwen3-max-2026-01-23

非思考和思考模式

0<Token≤32K

2.5元

10元

100万Token

32K<Token≤128K

4元

16元

128K<Token≤256K

7元

28元

qwen3-max-2025-09-23

仅非思考模式

0<Token≤32K

6元

24元

100万Token

32K<Token≤128K

10元

40元

128K<Token≤256K

15元

60元

qwen3-max-preview

上下文缓存享有折扣

非思考和思考模式

0<Token≤32K

6元

24元

100万Token

32K<Token≤128K

10元

40元

128K<Token≤256K

15元

60元


DeepSeek模型收费标准

  • 计费规则:按输入Token和输出Token计费。
  • 影响计费的因素:若模型支持Batch调用,其输入和输出Token单价均按实时推理价格的50%计费。


模型 ID(Model ID) 输入单价(每百万Token) 输出单价(每百万Token)
思维链+回答

免费额度

有效期:自开通百炼/模型发布/申请通过之日起90天内(以较晚者为准)

deepseek-v4.1-flash

上下文缓存享有折扣

忙时 2元

闲时 1元

忙时 8元

闲时 4元

100万Token

deepseek-v4-pro

上下文缓存享有折扣

12元

24元

100万Token

deepseek-v4-pro-0813

上下文缓存享有折扣

忙时 9元

闲时 4.5元

忙时 27元

闲时 13.5元

100万Token

deepseek-v4-flash-0731

上下文缓存享有折扣

忙时 3元

闲时 1.5元

忙时 9元

闲时 4.5元

100万Token

deepseek-v4-flash

上下文缓存享有折扣

1元

2元

100万Token

deepseek-v3.2

上下文缓存享有折扣

2元

3元

100万Token

deepseek-v3.2-exp

2元

3元

100万Token

deepseek-v3.1

4元

12元

100万Token

deepseek-r1

Batch调用半价

4元

16元

100万Token

deepseek-r1-0528

4元

16元

100万Token

deepseek-v3

Batch调用半价

2元

8元

100万Token

deepseek-r1-distill-qwen-1.5b

限时免费

deepseek-r1-distill-qwen-7b

0.5元

1元

100万Token

deepseek-r1-distill-qwen-14b

1元

3元

100万Token

deepseek-r1-distill-qwen-32b

2元

6元

100万Token

deepseek-r1-distill-llama-8b

已下线

该模型已下线,推荐使用深度思考、DeepSeek-阿里云、Kimi-阿里云作为替代模型。

deepseek-r1-distill-llama-70b

目前仅供免费体验

免费额度用完后不可调用,推荐使用深度思考、DeepSeek-阿里云、Kimi-阿里云作为替代模型

100万Token



另外,在北京地域,阿里云百炼也是提供免费的Tokens额度的,每个模型免费100万Tokens,总额度超7000万Tokens,开通百炼会自动领取,不需要手动领取,移步到:阿里云百炼AI模型平台,开通是免费的,进入平台即开通,开通后阿里云系统会自动为你发送免费Tokens额度,领取后,在阿里云百炼控制台可以查询免费额度,如下图:

image.png


付费方式二、Token Plan订阅计划

Token Plan 是阿里云百炼推出的 AI 大模型订阅服务,以 Credits 作为统一计量单位,支持文本生成、图像生成、视频生成、语音识别及实时语音对话等多种模型,并兼容 Claude Code、Cursor、Qwen Code 等主流 AI 编程和智能体工具。Token Plan 分为个人版和团队版两个版本,即个人版和团队版,最低39元一个月,详细查看:阿里云百炼Token Plan官网订阅入口,如下图:


阿里云百炼TokenPlan.jpg


Token Plan 分为个人版和团队版两个版本:


  • 个人版:面向个人开发者,提供 Lite、Essential、Standard、Pro 四档套餐,设有月度 Credits 限额,档位越高额度越大。月额度用完后暂停服务,可购买用量包补充或等待下一订阅月重置。
  • 团队版:面向团队和企业,提供标准座席、高级座席、尊享座席三个档位,支持多席位管理和用量分析,承诺不使用对话数据进行模型训练。


个人版Token Plan收费价格表如下:

阿里云百炼Token Plan个人版是新推出的,适合个人开发者使用,最低39元1个月,详细Credits额度、7天和5小时Credits限制如下表,个人版支持一次性购买1个月、3个月和一年:


TokenPlan(个人版)收费价格 Lite 套餐 Standard 套餐 Pro 套餐
收费价格 39元/月 139元/月 499元/月
7天 Credits 2,500 Credits/7天 10,000 Credits/7天 40,000 Credits/7天
5小时 Credits 700 Credits/5小时 3,000 Credits/5小时 12,000 Credits/5小时
支持AI模型 支持文本、视觉等多模态模型 支持文本、视觉等多模态模型 支持文本、视觉等多模态模型
支持功能 支持联网搜索、知识检索等harness 工具 支持联网搜索、知识检索等harness 工具 支持联网搜索、知识检索等harness 工具
Agent并发运行数量 可同时支持1~2个Agent并发运行 可同时支持3~4个Agent并发运行 可同时支持6~8个Agent并发运行


团队版Token Plan收费价格表如下:

百炼团队版的Token Plan目前有活动,之前最低是198元1个月,现在是150元1个月,团队版面向企业和团队,采用月度总额度制,无7天窗口限额(个人版有7天限制),承诺不使用数据训练模型,TokCost整理企业版Token Plan收费价格表,团队版只能按月订阅:


坐席类型 价格 额度 适用场景
标准坐席 优惠价格150元1个月(原价198元/坐席/月) 25,000 Credits/坐席/月 轻度使用 AI 辅助的团队成员
高级坐席 550元1个月(原价698元/坐席/月) 100,000 Credits/坐席/月 日常高频使用 AI 编码的团队成员
尊享坐席 1398元/坐席/月 250,000 Credits/坐席/月 重度依赖 AI 编码的核心开发者


付费方式三、Coding Plan 订阅计划

Coding Plan 是阿里云百炼推出的 AI 编码场景包月订阅计划,采用固定月费模式,提供月度请求额度,按次计费,支持在 Qwen Code、Claude Code、Cline、OpenClaw 等主流 AI 编程工具中使用。详细查看:阿里云Coding Plan官网订阅链接,如下图:

阿里云百炼CodingPlan.jpg


当前在售套餐 目前仅 Pro 高级套餐可订阅,Coding Plan Pro 高级套餐配置如下:


1、收费价格:200元/月

2、每月请求额度至高 90,000 次

  • 最多 6,000 次,每 5 小时
  • 最多 45,000 次,每周
  • 最多 90,000 次,每月


3、完美兼容 Cline、OpenClaw、Claude Code 及 Qwen Code

  • 推荐模型:qwen3.7-plus(支持图片理解)、qwen3.6-plus(支持图片理解)、kimi-k2.5(支持图片理解)、glm-5、MiniMax-M2.5
  • 更多模型:qwen3.5-plus(支持图片理解)、qwen3-max-2026-01-23、qwen3-coder-next、qwen3-coder-plus、glm-4.7


付费方式四、AI模型节省计划

AI模型节省计划是阿里云百炼提供的成本优化方案,通过承诺每月消费金额换取阶梯式折扣,用于抵扣大模型按量付费产生的调用费用。主推的是AI 通用型节省计划,在:阿里云权益中心,购买AI 通用型节省计划,如下图:


  • 核心机制:承诺在一定期限内(3个月、6个月、12个月或24个月)的月消费金额,即可享受阶梯式折扣,最高可享5.3折优惠。
  • 抵扣范围:可抵扣阿里直供的绝大部分模型(A/B/C三类),包括模型调用、原生工具调用、上下文缓存、批量推理等费用;不支持抵扣模型调优、模型部署、联网搜索插件等费用。
  • 额度规则:以动态月为周期分配额度,当月未用完的额度自动过期,不可累积到下一周期。
  • 购买门槛:每月承诺消费金额1000元起,以10元为单位调整,不设上限。


更多关于阿里云AI模型节省计划的说明,请查看官方文档:https://help.aliyun.com/zh/model-studio/savings-plan-and-resource-package


以上是阿小云整理的关于阿里云模型收费价格及四种计费方式,AI模型是在阿里云百炼AI模型平台调用的,用户可以根据自身应用实际情况选择合适的计费方式,别忘了领取免费千万的Tokens额度。

相关文章
|
10天前
|
人工智能 JSON API
全网刷屏的 Jev 模型正式开放!一手实战测评 + 保姆级教程
全网爆火的 Jev 模型是什么?有什么用?怎么使用?怎么接入 AI 编程工具?效果真的好么?傻子可懂的 Jev 保姆级实战教程 + 项目实战测评来啦
7740 13
|
8天前
|
人工智能 测试技术 API
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
Jev是TypeSafe AI推出的“系统一模型”,不生成文本,专做毫秒级结构化决策:Choice(多选)、Score(打分)、Noul(是非概率)。响应快193倍、成本低444倍,适合工单路由、内容审核、测试定级等高频判断场景。
1668 4
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
|
5天前
|
人工智能 JavaScript 芯片
DeepSeek 官方偷偷上传 Harness 桌面端安装包,我已经用上了。。附最新下载地址
DeepSeek Harness 官方的桌面端安装包被网友扒出来了,2 分钟讲明白如何使用,体验如何,适合作为 AI 编程工具么?附最新 Windows 和 Mac 双端的下载地址
1445 1
|
8天前
|
人工智能 并行计算 PyTorch
秋叶 ComfyUI 2026 整合包 v3.2 完整部署教程:Python 3.13 + Torch 2.13 全栈升级
秋叶aaaki ComfyUI 2026年8月整合包v3.2正式发布!全面升级Python 3.13.11、PyTorch 2.13.0+cu130及ComfyUI v0.30.2,原生支持MiniMax H3、Wan 2.2、Qwen-Image-2.1等2026主流音视频/图像模型,解压即用,无需环境配置。
1302 11
|
22天前
|
人工智能 自然语言处理 安全
阿里云千问办公 QwenWork详细介绍:产品核心能力、典型场景、价格及常见问题解答
千问办公是阿里云推出的一站式AI办公平台,主打"不止于对话,更注重交付",依托通义千问旗舰大模型,用户一句话即可完成数据分析、PPT生成、视频剪辑等复杂任务,直接输出可用成果。产品深度打通钉钉生态与企业OA,覆盖桌面端、网页端,提供企业标准版198元/人/月等多档订阅方案,新用户注册即赠2000积分,适配工程师、HR、财务等多职业办公场景,成为能动手干活的"全能AI同事"。
3694 10
|
7天前
|
人工智能 编解码 并行计算
MiniMax-H3 一键整合包技术文档:8G 显存运行 AI 漫剧制作 —— 角色替换 / 动作迁移 / 文图生视频部署与调参指南
MiniMax H3 是 MiniMax 开源的全模态视频生成模型,支持文/图/音/视多条件输入,输出最高2K、15秒带双声道音频视频。本文档详述其Int8量化版在8GB显存下的本地一键部署、三段式工作流(EDIT/REPLACE/CONTINUE)、参数调优及常见问题排查。(239字)
|
16天前
|
缓存 IDE Java
【保姆级】Android Studio下载、安装和汉化教程(2026最新)
Android Studio 是 Google 官方推出的免费 Android 应用开发集成环境,基于 IntelliJ IDEA,内置模拟器、调试器、性能分析及 Compose 界面工具,功能全面,文档丰富,是安卓开发首选工具。(239字)
1784 1

热门文章

最新文章