阿里云Qwen3.8-Max首发上线:API服务与Token Plan同步开放

简介: 阿里云于2026年8月正式推出了其最新一代旗舰基座大模型——Qwen3.8-Max。这款模型不仅在参数规模上实现了新的突破,更在推理效率、多模态处理及长周期任务执行上展现了卓越的性能,标志着通义千问系列模型迈入了一个全新的智能体时代。本文将深入解析Qwen3.8-Max的技术特性、应用场景、价格体系及接入方式,为开发者和企业提供一份详尽的参考指南。

Qwen3.8总参数量2.4万亿,在编程(Coding)和专业协作(Cowork)方面能力大幅提升,整体性能处于全球大模型前列。得益于模型架构、后训练方案和软硬一体化的协同创新,Qwen3.8在实际推理中能以更快的速度产出智能,可以独立自主编程16天,全程稳定可靠。
目前,Qwen3.8-Max的API服务已首发上线千问AI平台,全球开发者可直接调用,国内每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元,而输入与输出的国际价格仅为Opus5的40%与24%,实现相近智能更高性价比。在构建Coding Agent、搭建多模态应用以及接入企业级智能体流程等场景,开发者都能通过千问AI平台一站式获取模型能力,灵活适配各类主流智能体框架。
千问AI平台也为Token Plan用户带来Qwen3.8-Max 的专属限时优惠:夜间时段使用新模型享5折Credits消耗;8月5日前所有已购买个人版Token Plan的用户本周可获取1次7天额度重置权益。

Qwen3.8Max发布.png

一、阿里云 Qwen3.8-Max 模型是什么?

Qwen3.8-Max 是通义千问系列中当前能力最强的多模态旗舰大模型,于 2026 年 8 月正式发布。该模型具备 2.4 万亿参数,采用 MoE(Mixture of Experts)架构,在文本生成、深度推理、视觉理解等多方面展现出与全球顶尖模型相媲美的性能。

其核心定位是面向高复杂度、高精度要求的专业任务,可端到端交付生产级成果,适用于法律、金融、UI/UX 设计、芯片设计、量化交易、教育解题、三维创作等数百种高价值场景。
此外,Qwen3.8-Max 支持自主编程,能独立完成跨越数天的真实项目开发,并通过反馈闭环实现自我进化。

二、Qwen3.8-Max 的模型能力

Qwen3.8-Max的能力边界远超传统对话机器人,它被定义为一个能够处理复杂、长周期任务的智能体基座。

在编程与开发领域,Qwen3.8-Max展现了惊人的自主性。它不仅能进行代码补全和生成,更能独立完成长达16天的真实软件工程项目开发。在内部测试中,它成功构建了一个名为“oh-my-cli”的自进化智能体框架,实现了从需求分析、代码生成、测试到日志分析的工程闭环,在FrontendCodeArena榜单中排名第四。

在长文本与多模态处理方面,该模型支持长达100万Token的上下文窗口。这意味着它可以一次性读取并理解整部电视剧集、长达100小时的直播内容或数百页的技术文档,并将其转化为可交互的知识库。其视觉智能能力(VisionArena排名第二)允许用户通过上传UI截图来重建完整的前端网页项目,或将2D平面图转换为3D室内效果图。

此外,在科学研究与复杂逻辑推理上,Qwen3.8-Max也表现优异。它不仅能复现已有的研究实验,还能设计出优于原始论文的新方法,并在WWW2025多模态对话意图识别挑战赛中超越了人类参赛者的表现。

1. 多模态输入与输出

  • 输入模态:支持 文本(Text)、图像(Image)、视频(Video),其中视频最长支持 2 小时或 2GB,图像最高支持 1600 万像素。
  • 输出模态:仅输出 文本(Text)。

2. 上下文与长度限制

  • 最大上下文长度:1,000,000 tokens
  • 最大输入长度:991,808 tokens
  • 最大输出长度:131,072 tokens
  • 最大思维链(CoT)长度:262,144 tokens

3. 高级功能支持情况(以华北2 北京区域为例)

功能项 支持情况
Function Calling(函数调用) 支持
结构化输出(如 JSON Schema) 支持
联网搜索(Web Search) 支持(仅限华北2 北京;其他国际区域如新加坡、东京、法兰克福、弗吉尼亚均不支持)
前缀续写(Prefix Completion) 支持
上下文缓存(Context Caching) 支持
批量推理(Batch Inference) 仅华北2 北京支持;其他区域不支持
模型调优(Fine-tuning) 全区域均不支持

4. 核心能力亮点

  • 长程任务系统级规划:可在数千轮交互中重构算法与策略(如商业模拟、芯片设计)。
  • 原生视觉生产力:贯穿任务全流程的视觉理解与行动能力,支持教育解题、视频语义解析、3D 创作等。
  • 内置工具链(Harness):自动调用联网搜索、代码解释器、网页抓取、以图搜图、文搜图等工具。

三、Qwen3.8-Max 的模型价格(以华北2 北京为例)

对于企业级用户和开发者而言,成本是选择模型的重要考量。Qwen3.8-Max依托其MoE架构,在推理成本上相比同量级的密集模型具有显著优势。

根据官方披露的数据,Qwen3.8-Max的每百万输出Token成本约为6美元。这一价格远低于业内其他同类标杆模型(部分高达50美元/百万Token),极大地降低了高性能AI的使用门槛。

在阿里云百炼平台上,Qwen3.8-Max主要提供两种计费模式:

  1. 按量计费(标准API):适用于临时测试或低频调用场景,用户根据实际消耗的输入和输出Token数量付费,用多少付多少,灵活便捷。
  2. Token Plan订阅制:适用于高频协作团队。用户通过购买预付费套餐(如团队版),获得固定的Credits额度。这种方式不仅单价更低,还能享受多模型统一管理的便利。
计费项 价格
输入 Token 12 元 / 百万 tokens
输出 Token 36 元 / 百万 tokens
缓存命中输入(使用上下文缓存) 1.5 元 / 百万 tokens

重要提示:不同地域的价格可能略有差异,建议以百炼控制台实时报价为准。

四、Qwen3.8-Max 的工具调用价格

在智能体(Agent)应用场景中,模型往往需要调用外部工具(如搜索引擎、代码解释器、API接口等)来完成任务。Qwen3.8-Max具备强大的工具调用与长周期自主执行能力。

关于工具调用的具体计费,通常遵循阿里云百炼平台的统一标准。在大多数情况下,模型在思考过程中产生的内部推理Token(包括工具调用的指令生成和结果分析)会纳入总Token消耗量进行计费。

值得注意的是,阿里云经常针对特定功能推出优惠活动。例如,在Token Plan团队版中,针对Qwen3.7-Max等模型曾推出过Credits消耗减半的优惠。虽然Qwen3.8-Max作为最新旗舰,其具体折扣需以百炼控制台实时公告为准,但开启enable_thinking参数以发挥其长周期推理与智能体能力,是其核心使用场景之一。

五、Qwen3.8-Max 的免费额度

阿里云为新用户提供丰富的免费试用资源:

  • 百炼平台新用户:开通即赠 超 7000 万 tokens;
  • 千问 AI 平台新用户:赠送 1 亿+ tokens 额度;
  • Token Plan 个人版:首发体验 Qwen3.8-Max,提供基础额度用量充裕,且夜间调用更省钱。

免费额度可用于包括 Qwen3.8-Max 在内的多种模型,具体可用额度请登录阿里云百炼大模型服务平台查看:https://www.aliyun.com/product/bailian

重磅发布Qwen3.8Max.png

六、Qwen3.8-Max 的 API 代码示例

虽然知识库未提供完整代码片段,但明确指出:

  • Qwen3.8-Max 兼容主流 AI 编程框架的 Responses API;
  • 可通过 阿里云百炼 CLI 一行命令调用;
  • 在百炼平台中,只需指定 modelId: "qwen3.8-max" 即可启用全部能力(包括内置工具)。

典型调用逻辑如下:

1、Completions API

from openai import OpenAI
import os
client = OpenAI(

# 如果没有配置环境变量,请用阿里云百炼API Key替换:api_key="sk-xxx"
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://llm-fltqd30d7x9rrh4v.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",

)
messages = [{"role": "user", "content": "你是谁"}]
completion = client.chat.completions.create(
model="qwen3.8-max", # 您可以按需更换为其它深度思考模型
messages=messages,
extra_body={"enable_thinking": True},
stream=True
)
is_answering = False # 是否进入回复阶段
print("\n" + "=" 20 + "思考过程" + "=" 20)
for chunk in completion:
if not chunk.choices:
continue
delta = chunk.choices[0].delta
if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
if not is_answering:
print(delta.reasoning_content, end="", flush=True)
if hasattr(delta, "content") and delta.content:
if not is_answering:
print("\n" + "=" 20 + "完整回复" + "=" 20)
is_answering = True
print(delta.content, end="", flush=True)

2、Responses API

import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://llm-fltqd30d7x9rrh4v.cn-beijing.maas.aliyuncs.com/api/v2/apps/protocols/compatible-mode/v1",
)
response = client.responses.create(
model="qwen3.8-max",
input="9.9和9.11哪个大?",
extra_body={
"enable_thinking": True # 启用思考模式
}
)# 遍历输出项
for item in response.output:
if item.type == "reasoning":

    # 打印推理过程摘要
    print("【推理过程】")
    for summary in item.summary:
        print(summary.text[:500])  # 截取前500字符
    print()
elif item.type == "message":
    # 打印最终答案
    print("【最终答案】")
    print(item.content[0].text)

七、Qwen3.8-Max 支持的模型订阅计划有哪些?

目前 Qwen3.8-Max 主要通过以下方式提供服务,采用 按量付费 + 额度抵扣模式:

1、Token Plan(令牌计划)

  • 个人版Token Plan:针对独立开发者、学生及AI爱好者。提供灵活的月度订阅档位,价格亲民。用户可以根据每月的预估Token消耗量选择合适的套餐,享受比按量计费更优惠的单价,适合个人项目开发和日常学习使用。
  • 团队版Token Plan:专为中小企业及高频协作团队设计。提供更高额度的Credits和更高的并发限制。团队版支持多成员共享额度,并提供企业级的技术支持和数据安全保障。购买团队版后,系统会生成专属的API Key,用户可以在百炼控制台统一管理团队成员的使用情况,非常适合需要稳定、高频调用Qwen3.8-Max的商业应用场景。
  • 可使用免费额度或购买 Token 包抵扣调用费用;
  • Qwen3.8-Max 明确支持 TokenPlan 抵扣。活动详情可参考:https://www.aliyun.com/benefit/scene/tokenplan

Lite版本39.png

2、夜间错峰0.2折特惠(22:00 - 次日08:00)
这是当前最值得关注的福利。在北京时间每晚22:00至次日08:00期间,Qoder、Meoo以及TokenPlan的客户使用Qwen3.8-Max模型,可享受0.2折的超低折扣(计费系数降至0.01x)。这意味着,原本昂贵的旗舰模型调用成本将降低98%,用户可以用极低的预算完成大规模的数据处理、代码训练或长文本分析任务。活动详情可参考:https://www.aliyun.com/benefit/client/nightplan

Qwen3.8Max5折.png

3、百炼平台标准计费

  • 按实际输入/输出 token 数量计费;
  • 支持上下文缓存以降低重复输入成本。

综上,Qwen3.8-Max作为通义千问系列的新一代旗舰大模型,凭借2.4万亿参数规模、百万级超长上下文、16天自主编程能力和全球领先的多模态表现,重新定义了智能体基座的性能标杆。依托阿里云百炼平台极具竞争力的定价体系、新用户超亿级免费额度,以及Token Plan用户专属的夜间5折、额度重置等限时福利,开发者与企业无需承担过高成本,即可快速接入这款顶尖模型,在Coding Agent搭建、多模态应用开发、企业级智能体落地等场景中,以更低门槛释放AI生产力,抢占智能体时代的技术先机。

相关文章
|
2天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1313 108
|
9天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1931 8
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
3天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
507 112
|
7天前
|
存储 人工智能 关系型数据库
阿里云AI产品与云产品最新组合套餐:Token Plan、AI coding及云服务器和建站等组合优惠价
阿里云推出全新“算力+模型+应用”一站式云与AI组合套餐活动,覆盖从个人开发者到中大型企业的全场景需求。核心亮点为分三档定价的Token Plan订阅服务,支持Qwen3.8-Max-Preview大模型调用,错峰时段最低可享0.2折优惠。活动同步推出AI Coding、智能体部署、云电脑托管、0代码建站等十余类场景化组合,搭配99元/年的普惠云服务器、88元/年的入门数据库等经典特惠产品,还为企业提供1V1定制化AI转型方案,大幅降低了不同用户群体拥抱AI的技术门槛与采购成本。
686 111
|
3天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
|
17天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2611 13
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
15天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
2064 2
|
4天前
Qoder 一周年 × Qwen3.8-Max 正式上线,多重好礼限时领
8月3日,Qwen3.8-Max 正式上线Qoder,迎来Qoder一周年。新老用户可领800次免费调用,下单再赠2000次;夜间(22:00–08:00)调用5折;邀请好友双方得积分与调用额度。
319 0
|
17天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
1494 3

热门文章

最新文章