Qwen3.8总参数量2.4万亿,在编程(Coding)和专业协作(Cowork)方面能力大幅提升,整体性能处于全球大模型前列。得益于模型架构、后训练方案和软硬一体化的协同创新,Qwen3.8在实际推理中能以更快的速度产出智能,可以独立自主编程16天,全程稳定可靠。
目前,Qwen3.8-Max的API服务已首发上线千问AI平台,全球开发者可直接调用,国内每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元,而输入与输出的国际价格仅为Opus5的40%与24%,实现相近智能更高性价比。在构建Coding Agent、搭建多模态应用以及接入企业级智能体流程等场景,开发者都能通过千问AI平台一站式获取模型能力,灵活适配各类主流智能体框架。
千问AI平台也为Token Plan用户带来Qwen3.8-Max 的专属限时优惠:夜间时段使用新模型享5折Credits消耗;8月5日前所有已购买个人版Token Plan的用户本周可获取1次7天额度重置权益。

一、阿里云 Qwen3.8-Max 模型是什么?
Qwen3.8-Max 是通义千问系列中当前能力最强的多模态旗舰大模型,于 2026 年 8 月正式发布。该模型具备 2.4 万亿参数,采用 MoE(Mixture of Experts)架构,在文本生成、深度推理、视觉理解等多方面展现出与全球顶尖模型相媲美的性能。
其核心定位是面向高复杂度、高精度要求的专业任务,可端到端交付生产级成果,适用于法律、金融、UI/UX 设计、芯片设计、量化交易、教育解题、三维创作等数百种高价值场景。
此外,Qwen3.8-Max 支持自主编程,能独立完成跨越数天的真实项目开发,并通过反馈闭环实现自我进化。
二、Qwen3.8-Max 的模型能力
Qwen3.8-Max的能力边界远超传统对话机器人,它被定义为一个能够处理复杂、长周期任务的智能体基座。
在编程与开发领域,Qwen3.8-Max展现了惊人的自主性。它不仅能进行代码补全和生成,更能独立完成长达16天的真实软件工程项目开发。在内部测试中,它成功构建了一个名为“oh-my-cli”的自进化智能体框架,实现了从需求分析、代码生成、测试到日志分析的工程闭环,在FrontendCodeArena榜单中排名第四。
在长文本与多模态处理方面,该模型支持长达100万Token的上下文窗口。这意味着它可以一次性读取并理解整部电视剧集、长达100小时的直播内容或数百页的技术文档,并将其转化为可交互的知识库。其视觉智能能力(VisionArena排名第二)允许用户通过上传UI截图来重建完整的前端网页项目,或将2D平面图转换为3D室内效果图。
此外,在科学研究与复杂逻辑推理上,Qwen3.8-Max也表现优异。它不仅能复现已有的研究实验,还能设计出优于原始论文的新方法,并在WWW2025多模态对话意图识别挑战赛中超越了人类参赛者的表现。
1. 多模态输入与输出
- 输入模态:支持 文本(Text)、图像(Image)、视频(Video),其中视频最长支持 2 小时或 2GB,图像最高支持 1600 万像素。
- 输出模态:仅输出 文本(Text)。
2. 上下文与长度限制
- 最大上下文长度:1,000,000 tokens
- 最大输入长度:991,808 tokens
- 最大输出长度:131,072 tokens
- 最大思维链(CoT)长度:262,144 tokens
3. 高级功能支持情况(以华北2 北京区域为例)
| 功能项 | 支持情况 |
|---|---|
| Function Calling(函数调用) | 支持 |
| 结构化输出(如 JSON Schema) | 支持 |
| 联网搜索(Web Search) | 支持(仅限华北2 北京;其他国际区域如新加坡、东京、法兰克福、弗吉尼亚均不支持) |
| 前缀续写(Prefix Completion) | 支持 |
| 上下文缓存(Context Caching) | 支持 |
| 批量推理(Batch Inference) | 仅华北2 北京支持;其他区域不支持 |
| 模型调优(Fine-tuning) | 全区域均不支持 |
4. 核心能力亮点
- 长程任务系统级规划:可在数千轮交互中重构算法与策略(如商业模拟、芯片设计)。
- 原生视觉生产力:贯穿任务全流程的视觉理解与行动能力,支持教育解题、视频语义解析、3D 创作等。
- 内置工具链(Harness):自动调用联网搜索、代码解释器、网页抓取、以图搜图、文搜图等工具。
三、Qwen3.8-Max 的模型价格(以华北2 北京为例)
对于企业级用户和开发者而言,成本是选择模型的重要考量。Qwen3.8-Max依托其MoE架构,在推理成本上相比同量级的密集模型具有显著优势。
根据官方披露的数据,Qwen3.8-Max的每百万输出Token成本约为6美元。这一价格远低于业内其他同类标杆模型(部分高达50美元/百万Token),极大地降低了高性能AI的使用门槛。
在阿里云百炼平台上,Qwen3.8-Max主要提供两种计费模式:
- 按量计费(标准API):适用于临时测试或低频调用场景,用户根据实际消耗的输入和输出Token数量付费,用多少付多少,灵活便捷。
- Token Plan订阅制:适用于高频协作团队。用户通过购买预付费套餐(如团队版),获得固定的Credits额度。这种方式不仅单价更低,还能享受多模型统一管理的便利。
| 计费项 | 价格 |
|---|---|
| 输入 Token | 12 元 / 百万 tokens |
| 输出 Token | 36 元 / 百万 tokens |
| 缓存命中输入(使用上下文缓存) | 1.5 元 / 百万 tokens |
重要提示:不同地域的价格可能略有差异,建议以百炼控制台实时报价为准。
四、Qwen3.8-Max 的工具调用价格
在智能体(Agent)应用场景中,模型往往需要调用外部工具(如搜索引擎、代码解释器、API接口等)来完成任务。Qwen3.8-Max具备强大的工具调用与长周期自主执行能力。
关于工具调用的具体计费,通常遵循阿里云百炼平台的统一标准。在大多数情况下,模型在思考过程中产生的内部推理Token(包括工具调用的指令生成和结果分析)会纳入总Token消耗量进行计费。
值得注意的是,阿里云经常针对特定功能推出优惠活动。例如,在Token Plan团队版中,针对Qwen3.7-Max等模型曾推出过Credits消耗减半的优惠。虽然Qwen3.8-Max作为最新旗舰,其具体折扣需以百炼控制台实时公告为准,但开启enable_thinking参数以发挥其长周期推理与智能体能力,是其核心使用场景之一。
五、Qwen3.8-Max 的免费额度
阿里云为新用户提供丰富的免费试用资源:
- 百炼平台新用户:开通即赠 超 7000 万 tokens;
- 千问 AI 平台新用户:赠送 1 亿+ tokens 额度;
- Token Plan 个人版:首发体验 Qwen3.8-Max,提供基础额度用量充裕,且夜间调用更省钱。
免费额度可用于包括 Qwen3.8-Max 在内的多种模型,具体可用额度请登录阿里云百炼大模型服务平台查看:https://www.aliyun.com/product/bailian

六、Qwen3.8-Max 的 API 代码示例
虽然知识库未提供完整代码片段,但明确指出:
- Qwen3.8-Max 兼容主流 AI 编程框架的 Responses API;
- 可通过 阿里云百炼 CLI 一行命令调用;
- 在百炼平台中,只需指定
modelId: "qwen3.8-max"即可启用全部能力(包括内置工具)。
典型调用逻辑如下:
1、Completions API
from openai import OpenAI
import os
client = OpenAI(# 如果没有配置环境变量,请用阿里云百炼API Key替换:api_key="sk-xxx" api_key=os.getenv("DASHSCOPE_API_KEY"), base_url="https://llm-fltqd30d7x9rrh4v.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",)
messages = [{"role": "user", "content": "你是谁"}]
completion = client.chat.completions.create(
model="qwen3.8-max", # 您可以按需更换为其它深度思考模型
messages=messages,
extra_body={"enable_thinking": True},
stream=True
)
is_answering = False # 是否进入回复阶段
print("\n" + "=" 20 + "思考过程" + "=" 20)
for chunk in completion:
if not chunk.choices:
continue
delta = chunk.choices[0].delta
if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
if not is_answering:
print(delta.reasoning_content, end="", flush=True)
if hasattr(delta, "content") and delta.content:
if not is_answering:
print("\n" + "=" 20 + "完整回复" + "=" 20)
is_answering = True
print(delta.content, end="", flush=True)
2、Responses API
import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://llm-fltqd30d7x9rrh4v.cn-beijing.maas.aliyuncs.com/api/v2/apps/protocols/compatible-mode/v1",
)
response = client.responses.create(
model="qwen3.8-max",
input="9.9和9.11哪个大?",
extra_body={
"enable_thinking": True # 启用思考模式
}
)# 遍历输出项
for item in response.output:
if item.type == "reasoning":# 打印推理过程摘要 print("【推理过程】") for summary in item.summary: print(summary.text[:500]) # 截取前500字符 print() elif item.type == "message": # 打印最终答案 print("【最终答案】") print(item.content[0].text)
七、Qwen3.8-Max 支持的模型订阅计划有哪些?
目前 Qwen3.8-Max 主要通过以下方式提供服务,采用 按量付费 + 额度抵扣模式:
1、Token Plan(令牌计划)
- 个人版Token Plan:针对独立开发者、学生及AI爱好者。提供灵活的月度订阅档位,价格亲民。用户可以根据每月的预估Token消耗量选择合适的套餐,享受比按量计费更优惠的单价,适合个人项目开发和日常学习使用。
- 团队版Token Plan:专为中小企业及高频协作团队设计。提供更高额度的Credits和更高的并发限制。团队版支持多成员共享额度,并提供企业级的技术支持和数据安全保障。购买团队版后,系统会生成专属的API Key,用户可以在百炼控制台统一管理团队成员的使用情况,非常适合需要稳定、高频调用Qwen3.8-Max的商业应用场景。
- 可使用免费额度或购买 Token 包抵扣调用费用;
- Qwen3.8-Max 明确支持 TokenPlan 抵扣。活动详情可参考:https://www.aliyun.com/benefit/scene/tokenplan

2、夜间错峰0.2折特惠(22:00 - 次日08:00)
这是当前最值得关注的福利。在北京时间每晚22:00至次日08:00期间,Qoder、Meoo以及TokenPlan的客户使用Qwen3.8-Max模型,可享受0.2折的超低折扣(计费系数降至0.01x)。这意味着,原本昂贵的旗舰模型调用成本将降低98%,用户可以用极低的预算完成大规模的数据处理、代码训练或长文本分析任务。活动详情可参考:https://www.aliyun.com/benefit/client/nightplan

3、百炼平台标准计费
- 按实际输入/输出 token 数量计费;
- 支持上下文缓存以降低重复输入成本。
综上,Qwen3.8-Max作为通义千问系列的新一代旗舰大模型,凭借2.4万亿参数规模、百万级超长上下文、16天自主编程能力和全球领先的多模态表现,重新定义了智能体基座的性能标杆。依托阿里云百炼平台极具竞争力的定价体系、新用户超亿级免费额度,以及Token Plan用户专属的夜间5折、额度重置等限时福利,开发者与企业无需承担过高成本,即可快速接入这款顶尖模型,在Coding Agent搭建、多模态应用开发、企业级智能体落地等场景中,以更低门槛释放AI生产力,抢占智能体时代的技术先机。