阿里云AI模型的Token如何计费?输入、输出及免费100 Tokens费用说明

简介: 2026年阿里云通义千问(Qwen)系列模型Token收费标准公布:按输入/输出分别计价,覆盖Qwen3-Max、Qwen3.5-Plus、Qwen-Long、Qwen3-Omni-Flash(多模态)、通义点金及全妙轻应用等。支持Batch调用5折、上下文缓存优惠及90天内免费额度(各100万Token起),精准报价以阿里云百炼官网为准。(239字)

阿里云千问Token价格怎么收费?2026年最新手动整理AI大模型收费标准,阿里云千问(Qwen)系列模型的 Token 计费按 输入 Token 和 输出 Token 分别计价,具体价格因模型类型、部署区域、上下文长度、是否启用 Batch 调用或上下文缓存等因素而异。以下是主要模型在中国内地(北京地域)的收费标准(单位:元/百万Token),精准报价查询:阿里云通义千问AI大模型官网  如下图: 阿里云通义千问大模型.png


1. Qwen3-Max


输入 Token 范围 输入单价 输出单价 免费额度
0 < Token ≤ 32K 2.5 10 各100万Token(90天内)
32K < Token ≤ 128K 4 16 各100万Token
128K < Token ≤ 252K 7 28 各100万Token
  • Batch 调用:输入/输出单价均为实时推理的 50%
  • 上下文缓存:仅输入 Token 享折扣(创建为125%,命中为10%)
  • Batch 与缓存不可叠加

开通阿里云百炼免费领取千万tokens

免费领取Tokens:阿里云百炼AI模型官网领取超7000万Tokens  开通百炼免费领取超7000万tokens,如下图:

百炼.jpg 2. Qwen3.5-Plus


输入 Token 范围 输入单价 输出单价(非思考/思考) 免费额度
0 < Token ≤ 128K 0.8 4.8 各100万Token
128K < Token ≤ 256K 2 12 各100万Token
256K < Token ≤ 1M 4 24 各100万Token
  • Batch 调用:输入/输出单价 5折

3. Qwen-Long

  • 输入:0.5 元/百万Token
  • 输出:2 元/百万Token
  • 支持 Batch 调用(5折)
  • 免费额度:各100万Token(90天内)

在阿里云权益中心查询AI活动

最新AI模型活动查看:阿里云权益中心,权益中心提供最新AI活动,企业和个人都可以领取的,如下图:

阿里云权益中心AI活动.png


4. Qwen3-Omni-Flash(多模态)


模态 输入单价 输出单价(场景)
文本 1.8 6.9(纯文本) / 12.7(多模态输入)
音频 15.8 62.6(仅音频计费)
图片/视频 3.3 —
  • 免费额度:各100万Token(90天内)

5. 通义点金(金融领域应用)

  • 标准版:0.01 元/千Token
  • 高级版:0.1 元/千Token
  • 按输入+输出总 Token 后付费

6. 全妙轻应用系列(如电商文案、VOC挖掘等)


模型 输入(元/千Token) 输出(元/千Token)
千问-Max / Max-Latest 0.0024 0.0096
千问-Plus / Plus-Latest 0.0008 0.002
Qwen-Long 0.0005 0.002
千问-Q-Plus-Latest 0.0016 0.004
DeepSeek-R1 0.002 0.008
全妙可控式LLM(高级版) 0.003 0.009

注:所有计费均基于实际消耗 Token,失败任务若返回 task-failed 则不计费


更多关于阿里云AI大模型的收费价格,请移步到阿里云百炼官方平台查询精准报价及免费额度:https://www.aliyun.com/product/bailian

相关文章
|
10天前
|
人工智能 JSON API
全网刷屏的 Jev 模型正式开放!一手实战测评 + 保姆级教程
全网爆火的 Jev 模型是什么?有什么用?怎么使用?怎么接入 AI 编程工具?效果真的好么?傻子可懂的 Jev 保姆级实战教程 + 项目实战测评来啦
7740 13
|
8天前
|
人工智能 测试技术 API
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
Jev是TypeSafe AI推出的“系统一模型”,不生成文本,专做毫秒级结构化决策:Choice(多选)、Score(打分)、Noul(是非概率)。响应快193倍、成本低444倍,适合工单路由、内容审核、测试定级等高频判断场景。
1668 4
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
|
5天前
|
人工智能 JavaScript 芯片
DeepSeek 官方偷偷上传 Harness 桌面端安装包,我已经用上了。。附最新下载地址
DeepSeek Harness 官方的桌面端安装包被网友扒出来了,2 分钟讲明白如何使用,体验如何,适合作为 AI 编程工具么?附最新 Windows 和 Mac 双端的下载地址
1445 1
|
8天前
|
人工智能 并行计算 PyTorch
秋叶 ComfyUI 2026 整合包 v3.2 完整部署教程:Python 3.13 + Torch 2.13 全栈升级
秋叶aaaki ComfyUI 2026年8月整合包v3.2正式发布!全面升级Python 3.13.11、PyTorch 2.13.0+cu130及ComfyUI v0.30.2,原生支持MiniMax H3、Wan 2.2、Qwen-Image-2.1等2026主流音视频/图像模型,解压即用,无需环境配置。
1302 11
|
22天前
|
人工智能 自然语言处理 安全
阿里云千问办公 QwenWork详细介绍:产品核心能力、典型场景、价格及常见问题解答
千问办公是阿里云推出的一站式AI办公平台,主打"不止于对话,更注重交付",依托通义千问旗舰大模型,用户一句话即可完成数据分析、PPT生成、视频剪辑等复杂任务,直接输出可用成果。产品深度打通钉钉生态与企业OA,覆盖桌面端、网页端,提供企业标准版198元/人/月等多档订阅方案,新用户注册即赠2000积分,适配工程师、HR、财务等多职业办公场景,成为能动手干活的"全能AI同事"。
3694 10
|
7天前
|
人工智能 编解码 并行计算
MiniMax-H3 一键整合包技术文档:8G 显存运行 AI 漫剧制作 —— 角色替换 / 动作迁移 / 文图生视频部署与调参指南
MiniMax H3 是 MiniMax 开源的全模态视频生成模型,支持文/图/音/视多条件输入,输出最高2K、15秒带双声道音频视频。本文档详述其Int8量化版在8GB显存下的本地一键部署、三段式工作流(EDIT/REPLACE/CONTINUE)、参数调优及常见问题排查。(239字)
|
16天前
|
缓存 IDE Java
【保姆级】Android Studio下载、安装和汉化教程(2026最新)
Android Studio 是 Google 官方推出的免费 Android 应用开发集成环境,基于 IntelliJ IDEA,内置模拟器、调试器、性能分析及 Compose 界面工具,功能全面,文档丰富,是安卓开发首选工具。(239字)
1784 1

热门文章

最新文章