在阿里云百炼平台上使用大模型服务时,如何有效管理和优化调用成本是每位用户都需要面对的问题。阿里云百炼提供了多种计费优惠方案,包括 AI 通用型节省计划、其他模型节省计划以及资源包等,帮助用户在保留灵活性的同时显著降低使用成本。本文将从选型指南、各类方案的详细说明到常见问题解答,系统梳理这些计费优化方案的核心差异与使用方法,帮助您根据自身业务需求做出最优决策。

一、选型指南:快速找到适合您的方案
1.1 三种方案概览
| 方案 | 核心特点 | 推荐场景 |
|---|---|---|
| AI 通用型节省计划(推荐) | 承诺每月消费金额换取阶梯式折扣,最高可享 5.3 折,覆盖阿里直供的绝大部分模型 | 绝大多数场景下的首选,灵活性最高 |
| 其他模型节省计划 | 一次性购买固定金额,仅适用于特定模型系列(如语音模型、向量模型等) | 用量较小或需求高度集中于某一特定模型系列 |
| 资源包 | 一次性购买具体资源量(如 Tokens、图片张数等),仅适用于单个特定模型 | 短期集中使用单一模型的场景 |
建议: 为最大化成本效益,优先了解并选择 AI 通用型节省计划。
1.2 核心维度对比
| 维度 | 节省计划 | 资源包 | Token Plan |
|---|---|---|---|
| 计费模式 | 承诺月消费换阶梯折扣 | 一次性购买固定 Token 量 | 一次性购买 Credits 额度 |
| 模型覆盖 | 覆盖绝大部分模型(阿里直供) | 仅适用单个特定模型 | 仅支持部分模型 |
| 适用场景 | 长期稳定使用 | 用量小或集中特定模型 | 团队协作使用 |
1.3 选型建议总结
- 长期稳定使用大模型服务 → 选择节省计划
- 用量较小或调用集中在特定模型 → 选择资源包
- 需要团队协作共享额度 → 选择 Token Plan
补充说明: 百炼平台默认采用按量后付费模式,不支持直接提前赠送 Token 额度。如需提前锁定额度或降低使用成本,可选择购买资源包(一次性购买固定 Token 额度,立即生效抵扣)或节省计划(承诺每月消费金额换取阶梯折扣)。
二、AI 通用型节省计划详解
2.1 什么是 AI 通用型节省计划?
AI 通用型节省计划是针对大模型按量付费使用场景设计的折扣方案。用户只需承诺在一定期限内(3 个月、6 个月、12 个月或 24 个月)的月消费金额,即可在保留按量付费灵活性的基础上,享受阶梯式折扣,优化模型调用成本。更多大模型节省计划详情可参考:https://help.aliyun.com/zh/model-studio/savings-plan-and-resource-package
此外,阿里云推出入门型AI通用节省计划(新客专享),活动详情可参考:https://www.aliyun.com/benefit/scene/ai-discount

2.2 核心优势
- 覆盖全面: 可抵扣阿里直供的绝大部分模型,一次购买即可跨模型使用。
- 成本优化显著: 承诺消费金额越高、周期越长,折扣力度越大,最高可享 5.3 折优惠。
- 管理流程便捷: 购买后可立即或按指定时间生效,无需手动激活或绑定,自动抵扣,支持自动续费。
2.3 使用说明
生效时间
可按需选择"下单后立即生效"或"指定时间(按小时)生效"。
承诺周期说明
节省计划以动态月为周期分配额度——从购买日/生效日起算,每满一个月为一个周期,非自然月月初重置;订购日次日 0 点重置为当月满额。月承诺周期结束时,剩余额度自动过期,不可累积到下一周期。
举例: 如果一次性订阅了 3 个月的节省计划(月承诺额度 1,000 元),并非在 3 个月内获得 3,000 元总额度,而是每月独立获得 1,000 元额度,当月未使用完的部分自动清零,不可累积到下个订阅月。
关于包季/包月套餐:
- 包季套餐(如 27 元抵 60 元):总额度 60 元分 3 个月按月发放(每月 20 元),不一次性到账。
- 包月套餐:一次性发放当月全额额度,仅限购买日起动态月内使用。
出账延迟注意事项:
节省计划额度的扣减基于实际出账时间,而非任务提交时间。系统出账通常存在 2~10 分钟延迟,控制台数据刷新也存在延迟。若任务提交时账户显示仍有额度,但实际出账时节省计划已过期或额度已耗尽,仍会产生按量计费费用。建议设置较高的消费预警阈值以监控费用,避免因出账延迟导致意外欠费。
调用方式
百炼控制台模型体验、API 代码调用、接入第三方工具(如 OpenClaw 等,填写按量计费接入凭证)。
2.4 抵扣范围
支持抵扣的费用:
- 模型调用(输入和输出 Tokens)
- 模型原生工具调用(如 Function Call、网页抓取等)
- 上下文缓存
- 批量推理
节省计划的抵扣与调用方服务器所在地域无关(包括通过 ECS 等实例调用百炼 API 的场景)。只要服务器位于国内,且调用百炼 API 时选择华北2(北京)地域的 Base URL,产生的调用费用即可正常被节省计划抵扣,不受跨区域调用影响。
不支持抵扣的费用:
- 模型调优、模型部署的费用
- 联网搜索插件(独立计费,以实际账单为准)、MCP 广场、通义深度搜索、案例检索等插件或工具产生的费用
- Qoder CN 产品(当前仅支持通过 Credits 调用,不支持使用 AI 通用型节省计划抵扣)
- 第三方工具中的联网搜索费用(通过百炼 API 调用模型产生的费用仍属于支持抵扣范围)
知识库(RAG)费用说明:
- 知识库使用过程中产生的向量模型(Embedding)和排序模型(Rerank)调用费用,属于 A 类模型调用范畴,可被 AI 通用型节省计划抵扣。
- 知识库的规格费用(运行时长,标准版 0.03 元/知识库/小时、旗舰版 0.2 元/RCU/小时)不属于模型调用费用,不在节省计划抵扣范围内,需通过资源包或按量付费结算。
2.5 抵扣逻辑
抵扣顺序: 免费额度 资源包 其他模型节省计划 AI 通用型节省计划 按量付费
多个同类型节省计划: 优先抵扣先到期的节省计划。若到期时间相同,则优先抵扣先购买的节省计划。
超出部分处理: 如果同类节省计划全部到期或额度全部抵扣完后,仍有超出部分,自动转为按量付费。
多套餐并存场景: 当同时拥有新订阅套餐(如尊享坐席)和原有加油包(资源包)时,优先使用新订阅套餐内的额度,待该套餐额度耗尽后,才使用加油包(资源包)额度。
安心模式注意事项:
若在模型设置中开启了"免费额度用完即停"功能(即安心模式),当该模型的免费额度耗尽时,服务将自动停止,不产生后续按量计费账单,节省计划因此无法进行抵扣。如需继续使用节省计划抵扣调用费用,请在免费额度用尽后,进入模型设置手动关闭该功能,服务即可恢复并切换至节省计划正常抵扣。
2.6 购买指引
| 项目 | 说明 |
|---|---|
| 适用地域 | 华北2(北京)、美国(弗吉尼亚)、新加坡、德国(法兰克福)、日本(东京)。不同地域的节省计划独立计费,不可跨地域抵扣。建议选择与业务服务器地理位置最近的地域。如需在多个地域调用模型服务,需为每个地域分别购买节省计划。 |
| 模型分类 | A 类: 千问(不含 qwen3.6-max-preview)、千问-开源、文本向量、多模态向量、排序模型、行业模型、模型原生工具调用等。B 类: 图像生成、语音合成、语音识别与翻译、视频生成与编辑。C 类: qwen3.6-max-preview、DeepSeek、Kimi、GLM、MiniMax、HappyHorse(仅阿里直供版本支持抵扣)。 |
| 每月承诺消费金额 | 1000 元起,以 10 元为单位调整,不设上限。 |
| 购买时长 | 3 个月、6 个月、1 年、2 年 |
| 分期付费类型 | 全预付: 一次性支付全部承诺消费金额,可享最大折扣。零预付: 购买时无需支付,按月支付承诺消费金额(需联系商务经理申请开通)。 |
| 支付方式限制 | 仅支持现金支付。通过充值卡充值到账的金额不可用于购买节省计划、资源包等预付费套餐。 |
2.7 折扣信息
不同模型、不同档位、承诺周期和付款方式享受不同的折扣。
示例: 选择了为期 12 个月、每月承诺消费 10,000 元的节省计划,采用全预付方式支付,调用千问文本生成模型(A 类)时享受 8 折优惠,即一次原价 1 元的模型调用,实际从节省计划额度中抵扣 0.8 元。
全预付折扣表:
| 月承诺金额(元) | A 类 3个月 | A 类 6个月 | A 类 12个月 | A 类 24个月 | B 类 3个月 | B 类 6个月 | B 类 12个月 | B 类 24个月 | C 类 |
|---|---|---|---|---|---|---|---|---|---|
| 1,000 - 5,000 | 8.8折 | 8.6折 | 8.4折 | 8.2折 | 8.3折 | 8折 | 7.7折 | 7.4折 | 无折扣 |
| 5,000 - 10,000 | 8.6折 | 8.4折 | 8.2折 | 8折 | 8折 | 7.7折 | 7.4折 | 7.1折 | 无折扣 |
| 10,000 - 30,000 | 8.4折 | 8.2折 | 8折 | 7.8折 | 7.7折 | 7.4折 | 7.1折 | 6.8折 | 无折扣 |
| 30,000 - 50,000 | 8.2折 | 8折 | 7.8折 | 7.6折 | 7.4折 | 7.1折 | 6.8折 | 6.5折 | 无折扣 |
| 50,000 - 100,000 | 8折 | 7.8折 | 7.6折 | 7.4折 | 7.1折 | 6.8折 | 6.5折 | 6.2折 | 无折扣 |
| 100,000 - 300,000 | 7.8折 | 7.6折 | 7.4折 | 7.2折 | 6.8折 | 6.5折 | 6.2折 | 5.9折 | 无折扣 |
| 300,000 - 1,000,000 | 7.6折 | 7.4折 | 7.2折 | 7折 | 6.5折 | 6.2折 | 5.9折 | 5.6折 | 无折扣 |
| 1,000,000+ | 7.4折 | 7.2折 | 7折 | 6.8折 | 6.2折 | 5.9折 | 5.6折 | 5.3折 | 无折扣 |
零预付折扣表(需联系商务经理开通):
| 月承诺金额(元) | A 类 3个月 | A 类 6个月 | A 类 12个月 | A 类 24个月 | B 类 3个月 | B 类 6个月 | B 类 12个月 | B 类 24个月 | C 类 |
|---|---|---|---|---|---|---|---|---|---|
| 1,000 - 5,000 | 9折 | 8.8折 | 8.6折 | 8.4折 | 8.5折 | 8.2折 | 7.9折 | 7.6折 | 无折扣 |
| 5,000 - 10,000 | 8.8折 | 8.6折 | 8.4折 | 8.2折 | 8.2折 | 7.9折 | 7.6折 | 7.3折 | 无折扣 |
| 10,000 - 30,000 | 8.6折 | 8.4折 | 8.2折 | 8折 | 7.9折 | 7.6折 | 7.3折 | 7折 | 无折扣 |
| 30,000 - 50,000 | 8.4折 | 8.2折 | 8折 | 7.8折 | 7.6折 | 7.3折 | 7折 | 6.7折 | 无折扣 |
| 50,000 - 100,000 | 8.2折 | 8折 | 7.8折 | 7.6折 | 7.3折 | 7折 | 6.7折 | 6.4折 | 无折扣 |
| 100,000 - 300,000 | 8折 | 7.8折 | 7.6折 | 7.4折 | 7折 | 6.7折 | 6.4折 | 6.1折 | 无折扣 |
| 300,000 - 1,000,000 | 7.8折 | 7.6折 | 7.4折 | 7.2折 | 6.7折 | 6.4折 | 6.1折 | 5.8折 | 无折扣 |
| 1,000,000+ | 7.6折 | 7.4折 | 7.2折 | 7折 | 6.4折 | 6.1折 | 5.8折 | 5.5折 | 无折扣 |
注:以上金额范围含起始值、不含结束值。例如 1,000 - 5,000 表示金额大于等于 1,000 且小于 5,000。
2.8 生命周期管理
管理入口: 访问节省计划总览页面管理节省计划。也可通过阿里云 App 查看剩余额度、使用率等基本信息,但退订、配置变更等详细操作建议使用网页端控制台完成。
续订说明:
登录费用与成本控制台,左侧菜单选择"费用 我的订阅",查看并管理节省计划的订阅状态、生效时间、自动续费状态等。
到期处理:
节省计划(含入门型 AI 通用节省计划)到期后会自动失效/作废,无需手动释放、退订或查找关联实例,也不会因到期本身产生额外费用。若后续不再使用大模型服务,建议删除对应的 API Key,避免因服务未停用而产生按量付费账单。
入门型续费规则: 入门型 AI 通用节省计划为新客专享活动,到期后不支持续费;再次购买时无法再享受首购优惠价格。
查询折扣:
在节省计划总览页面的"价格折扣详情表"页签,可按适用商品、计费项、节省计划类型、订购时长和支付方式筛选查询。
| 适用商品 | 计费项 |
|---|---|
| 百炼大模型推理 | 文本:全局文本生成Token用量;图片:全局图片生成张数用量等;视频:全局视频生成时长用量;语音:全局语音合成字数用量等;向量:全局多模态向量模型用量等;批量调用:全局Batch模型用量等;工具调用:全局计次用量 |
| 百炼大模型-垂类模型 | 文本生成Token用量 |
| 阿里云百炼大模型-向量排序模型 | 多模态向量模型用量 |
| 百炼大模型-千问语音模型 | 语音合成字数用量、语音识别时长用量 |
| 百炼大模型-百聆语音模型 | 语音合成字数用量、语音识别时长用量 |
查询华北2(北京)地域的调用费用折扣时,选择非全局计费项;查询其他地域时,选择对应的全局计费项。
查询账单:
进入费用与成本控制台,左侧菜单选择"账单详情",产品名称选择"大模型服务平台百炼",商品名称选择"AI 通用型节省计划"。
余量预警与到期提醒:
- 节省计划不支持自定义余量预警阈值:系统默认在剩余额度降至 20% 时发送一次提醒,该阈值不可更改。
- 如需自定义消费预警阈值,可前往费用中心的"可用额度预警"功能中设置消费金额阈值。
- 到期提醒:系统会在节省计划到期前通过短信发送 3 次提醒;到期后不再发送提醒。
三、其他模型节省计划
与 AI 通用型节省计划相比,其他模型节省计划更适合用量较小或需求高度集中于某一特定模型的场景。
3.1 使用说明
- 生效时间: 购买后立即生效。
- 有效期: 根据购买套餐而定。超出有效期后,剩余金额将无法使用,不支持退款。
- 抵扣范围: 支持抵扣模型调用费用(输入和输出 Tokens)。不支持抵扣工具调用、上下文缓存、批量推理等产生的费用,也不支持抵扣模型调优、模型部署产生的费用。
- 抵扣顺序: 免费额度 资源包 其他模型节省计划 AI 通用型节省计划 按量付费。
3.2 大语言模型推理节省计划
| 项目 | 说明 |
|---|---|
| 档位 | 20元、100元、1,000元、5,000元、10,000元、20,000元、50,000元、100,000元、200,000元、300,000元、500,000元 |
| 折扣 | 上述档位均无折扣,按模型调用价格进行扣费 |
| 有效期 | 20元档:1个月;100元档:3个月;1,000元档:6个月;5,000元及以上:1年 |
| 适用地域 | 华北2(北京) |
| 适用模型 | 已上架百炼平台并以 Token 计费的文本生成模型,包括:千问系列(Max、Plus、Flash、Turbo、QwQ、Long)、开源版(Qwen3.5、Qwen3 等)、第三方模型(DeepSeek、GLM、Kimi、MiniMax)、多模态模型(千问Omni、QVQ、千问VL、千问OCR 等)、领域模型(千问Coder、翻译模型等)。不支持向量模型和排序模型。 |
3.3 千问语音模型节省计划
| 项目 | 说明 |
|---|---|
| 档位与折扣 | 20元(9.8折)、100元(9.6折)、500元(9折)、1,000元(8.5折)、5,000元(8折) |
| 有效期 | 20元、100元档:6个月;500元、1,000元、5,000元档:可选6个月或12个月 |
| 适用地域 | 华北2(北京)、新加坡 |
| 适用模型 | 实时语音合成(CosyVoice、Qwen-TTS-Realtime)、语音合成(Qwen-TTS)、实时语音识别(Paraformer、Fun-ASR、Qwen-ASR-Realtime)、录音文件识别(Paraformer、Fun-ASR、Qwen-ASR)等 |
优惠示例: 以 1,000 元档位为例,假设消费 1 元,实际将从节省计划中抵扣 1×0.85=0.85 元。
3.4 向量及排序模型节省计划
| 项目 | 说明 |
|---|---|
| 档位与折扣 | 100元(无折扣)、500元(9折)、2,000元(8折)、5,000元(7.5折)、10,000元(7折) |
| 有效期 | 100元、500元档:3个月;2,000元档:6个月;5,000元、10,000元档:12个月 |
| 适用地域 | 华北2(北京) |
| 适用模型 | 文本向量:text-embedding-v4/v3/v2/v1 等;多模态向量:qwen2.5-vl-embedding、multimodal-embedding-v1 等;文本排序:qwen3-rerank、gte-rerank-v2 |
3.5 万相模型节省计划
| 项目 | 说明 |
|---|---|
| 档位与折扣 | 20元(无折扣)、100元(无折扣)、1,000元(9.8折)、10,000元(9.5折)、30,000元(9折) |
| 有效期 | 20元、100元档:3个月;1,000元、10,000元、30,000元档:6个月 |
| 适用模型 | 图像生成:wan2.6-image、wan2.5-t2i-preview、wanx2.1-t2i-plus 等;视频生成:wan2.6-t2v、wan2.5-t2v-preview、wan2.2-t2v-plus 等 |
注意: wan2.7-r2v 等模型属于「百炼大模型-万相模型」商品,不在本节省计划抵扣范围内。如需抵扣百炼全量模型,建议购买 AI 通用型节省计划。
四、资源包详解
资源包是预先购买具体 Token 数量或资源量的产品,用于抵扣特定模型超出免费额度后产生的实时推理用量。
4.1 使用说明
- 生效时间: 购买后立即生效,无需手动"激活"或"绑定"。
- 有效期: 根据购买套餐而定。超出有效期后,资源包中剩余的 Tokens 自动作废。
- 抵扣顺序: 免费额度 资源包 其他模型节省计划 AI 通用型节省计划 按量付费。
- 多个同类型资源包: 优先抵扣先到期的资源包。若到期时间相同,则优先抵扣先购买的。
- 超出部分处理: 资源包全部到期或额度全部抵扣完后,自动转为按量付费。
余量监控与预警:
- 查看余量:点击资源包管理页面查看剩余量和使用明细。
- 设置预警:建议设置资源包余量预警,当使用量低于预设阈值时,系统将通过短信、邮件及站内信自动触发通知。
退订说明:
- 预付费商品未发生使用的部分,可按未使用额度费用申请退款;已使用的部分无法退款。退款原路返回至支付账户。
- 若账号下存在未到期的节省计划或资源包,无法直接完成账号注销。建议等待自然到期失效后再申请注销,或在符合退订条件时先完成退订操作。
- 节省计划一旦生效并发生过抵扣,通常不支持退订,只能等待自然到期。
使用限制: 资源包按模型名称严格匹配,跨版本或子型号不通用。例如,qwen-plus 资源包不支持抵扣 qwen-max 的调用费用。若需同时覆盖多个模型版本的调用费用,建议选择 AI 通用型节省计划。
4.2 大语言模型推理资源包
| 项目 | qwen-plus 资源包 | qwen-max 资源包 |
|---|---|---|
| 适用地域 | 华北2(北京) | 华北2(北京) |
| 适用模型 | qwen-plus 及 qwen-plus-latest 的实时推理服务(非思考模式) | qwen-max 的实时推理服务(非思考模式) |
| 包含总 Tokens | 1,200万 / 1.1亿 | 1,800万 / 3,900万 / 3.9亿 / 11.7亿 / 19.5亿 |
| 价格(元) | 11.66 / 114.4 | 57.6 / 125 / 1250 / 3750 / 6250 |
| 有效期 | 可选 3 个月、6 个月或 1 年 | 1 年 |
| 使用限制 | 仅支持抵扣单次请求输入在 0<Token≤128K 阶梯范围内的实时推理费用;不支持 Batch 调用、上下文缓存、模型调优、模型部署费用 | 仅支持抵扣实时推理费用;不支持 Batch 调用、上下文缓存、模型调优、模型部署费用 |
4.3 图像生成模型资源包
| 项目 | qwen-image 资源包 | qwen-image-plus 资源包 |
|---|---|---|
| 适用地域 | 华北2(北京) | 华北2(北京) |
| 适用模型 | 文生图:qwen-image;图像编辑:qwen-image-edit | 文生图:qwen-image-plus;图像编辑:qwen-image-edit-plus |
| 容量(图片张数) | 80 / 400 | 100 / 1,000 / 10,000 / 100,000 / 500,000 |
| 价格(元) | 20 / 100 | 20 / 196(9.8折)/ 1,900(9.5折)/ 18,000(9折)/ 85,000(8.5折) |
| 有效期 | 3 个月 | 100、1,000张:3个月;10,000、100,000张:6个月;500,000张:12个月 |
| 额度消耗规则 | 文生图消耗 1 张/次;图片编辑消耗 1.2 张/次 | 生成或编辑一张图片消耗 1 张/次 |
资源包容量耗尽后,将自动转为按量付费模式。
五、常见问题
Q1:节省计划和资源包是否支持退订?
节省计划: 自 2026 年 04 月 03 日 10:00:00(UTC+8)起,符合以下条件的节省计划支持自助退订:
- 未生效的全预付节省计划
- 已生效但未发生任何抵扣的全预付节省计划
若购买的节省计划已发生抵扣,暂不支持退订。
资源包: 未发生使用的部分,可按未使用额度费用申请退款;已使用的部分无法退款。
Q2:资源包和节省计划如果同时存在,怎么扣费?
系统的抵扣优先级为:免费额度 资源包 其他模型节省计划 AI 通用型节省计划 按量付费。即先用免费额度,用完后扣资源包,资源包不够或不适用时扣节省计划,最后才使用账户余额。
Q3:为什么购买了节省计划,但没有抵扣?
常见原因如下:
- 模型不匹配: 购买了其他节省计划,但调用的模型不在适用范围内。例如:购买了大语言模型节省计划,却调用了万相系列模型或向量模型。
- 使用了不支持的功能: AI 通用型节省计划和其他节省计划均不支持抵扣模型调优、模型部署费用。只有 AI 通用型节省计划支持抵扣上下文缓存、批量推理、工具调用等费用。
- 免费额度未用完: 节省计划仅抵扣免费额度用尽后产生的账单。
- 按分钟出费: 百炼按分钟计费,购买节省计划后,自下一分钟产生的用量起开始抵扣,购买时刻正在计量的那个分钟区间可能仍按按量付费出账。
- 起效时间对齐整点: 节省计划的起效时间会自动对齐至购买时刻所在的整点。例如 14:56 购买,起效时间为 14:00,该整点之内已产生的用量会被回溯抵扣;早于该整点产生的费用不在抵扣范围内。
- 额度已用完: 可在节省计划总览页面查看剩余金额确认。
- 抵扣设置已关闭: 在节省计划管理页面检查各计费项的抵扣开关是否开启。
- 商品 code 不在抵扣范围: 在节省账单使用明细中查看该笔账单的商品 code,并与所购节省计划的抵扣范围比对。
Q4:三方直供模型支持抵扣 AI 通用型节省计划吗?
C 类模型中,阿里直供的模型支持抵扣,三方直供的模型不支持抵扣。您可以在百炼模型广场中通过模型卡片右上角标识("阿里直供"或"三方直供"标签)确认模型的供应方式。
Q5:购买节省计划后如何使用?
节省计划在生效后无需重新配置 API Key 或 Base URL,购买后自动生效。您通过百炼控制台模型体验、API 代码调用或接入第三方工具调用模型时,产生的费用会按抵扣顺序自动抵扣。节省计划仅对生效后产生的费用进行抵扣,购买前已产生的费用无法追溯抵扣。
Q6:为什么购买了资源包,但没有抵扣?
常见原因如下:
- 模型不匹配: 调用的模型与购买的资源包不一致。
- 使用了不支持的功能: 资源包不支持抵扣批量推理(Batch)、上下文缓存、模型调优、模型部署费用。
- Token 长度超限: 对于 qwen-plus 资源包,单次请求输入超过 128K Token 的部分无法抵扣。
- 免费额度未用完: 资源包仅抵扣免费额度用尽后产生的账单。
Q7:如果先购买了资源包但未开通阿里云百炼服务,应该如何使用?
请先开通阿里云百炼的模型服务。服务开通后,优先会抵扣免费额度,待免费额度消耗完后,才会开始抵扣资源包。
Q8:购买了大语言模型节省计划,能抵扣向量模型和排序模型吗?
不能。大语言模型推理节省计划仅适用于文本生成模型,不支持抵扣向量模型(embedding)和排序模型(rerank)。如果业务同时涉及大语言模型与向量、排序模型(例如 RAG 场景),建议选择 AI 通用型节省计划,或单独购买向量及排序模型节省计划。
Q9:入门型 AI 通用节省计划和 AI 通用型节省计划有什么区别?
| 对比项 | AI 通用型节省计划 | 入门型 AI 通用节省计划 |
|---|---|---|
| 购买入口 | 通过 AI 通用型节省计划购买页购买 | 通过 AI 优惠活动页的"全模型通享"模块购买 |
| 活动限制 | 无首购限制 | 活动价格仅限首购 |
| 适用模型 | 覆盖全部阿里直供模型 | 与 AI 通用型基本相同,但月承诺金额 1000 元以下的档位不支持抵扣 kimi-k3 |
| 折扣方式 | 不同档位对应不同按量付费折扣,档位越高折扣越大 | 按量计费,无按量付费折扣;仅首次购买时有优惠(如 10 元抵 20 元、27 元抵 60 元、135 元抵 300 元) |
入门型注意事项:
- 每月额度按动态月独立发放,当月未使用完自动清零,不累积。
- 一经支付,不支持退订。
- 仅支持抵扣阿里直供模型产生的调用费用。
- 月承诺金额 1000 元以下不支持抵扣 kimi-k3。
Q10:退订节省计划后,关联权益是否受影响?
- 新客优惠: 入门型活动优惠仅限首次购买,退订后无法再次以优惠价格参与。
- 赠品处理: 若购买时附带赠品(如代金券、优惠券等),退订后赠品自动作废清零。
- 余额与转移: 节省计划余额及订单不支持跨账号转移,也不支持转换为账户现金余额。
Q11:节省计划是否有独立的 API 接口?
节省计划没有独立的 API 接口,也不需要调用接口开启或查询。它是一种计费优惠权益,在账单结算时自动抵扣模型调用产生的费用。您只需按常规方式调用百炼的模型 API,系统会自动使用节省计划的额度进行抵扣,无需额外配置或调用特定方法。
友情提示:购买之前,个人和企业用户均可免费一键领取折扣优惠券:https://www.aliyun.com/minisite/goods,优惠券金额不固定。折扣优惠券在结算订单时自动抵扣。以选购AI 通用型节省计划为例,系统会根据订单自动匹配可使用的优惠券金额。

总结
| 使用场景 | 推荐方案 |
|---|---|
| 长期稳定、多模型混合调用 | AI 通用型节省计划(最高 5.3 折) |
| 用量较小,集中使用某一特定模型 | 其他模型节省计划或资源包 |
| 短期试用、零门槛体验 | 按量付费 + 免费额度 |
| 团队协作、多人共享额度 | Token Plan |
选择计费方案时,建议综合考虑使用时长、模型覆盖范围、用量规模和团队需求,优先选择 AI 通用型节省计划以获得最大折扣和最高灵活性。