阿里云Qwen3.8-Max首发上线:API服务与Token Plan同步开放

简介: 阿里云于2026年8月正式推出了其最新一代旗舰基座大模型——Qwen3.8-Max。这款模型不仅在参数规模上实现了新的突破,更在推理效率、多模态处理及长周期任务执行上展现了卓越的性能,标志着通义千问系列模型迈入了一个全新的智能体时代。本文将深入解析Qwen3.8-Max的技术特性、应用场景、价格体系及接入方式,为开发者和企业提供一份详尽的参考指南。

Qwen3.8总参数量2.4万亿,在编程(Coding)和专业协作(Cowork)方面能力大幅提升,整体性能处于全球大模型前列。得益于模型架构、后训练方案和软硬一体化的协同创新,Qwen3.8在实际推理中能以更快的速度产出智能,可以独立自主编程16天,全程稳定可靠。
目前,Qwen3.8-Max的API服务已首发上线千问AI平台,全球开发者可直接调用,国内每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元,而输入与输出的国际价格仅为Opus5的40%与24%,实现相近智能更高性价比。在构建Coding Agent、搭建多模态应用以及接入企业级智能体流程等场景,开发者都能通过千问AI平台一站式获取模型能力,灵活适配各类主流智能体框架。
千问AI平台也为Token Plan用户带来Qwen3.8-Max 的专属限时优惠:夜间时段使用新模型享5折Credits消耗;8月5日前所有已购买个人版Token Plan的用户本周可获取1次7天额度重置权益。

Qwen3.8Max发布.png

一、阿里云 Qwen3.8-Max 模型是什么?

Qwen3.8-Max 是通义千问系列中当前能力最强的多模态旗舰大模型,于 2026 年 8 月正式发布。该模型具备 2.4 万亿参数,采用 MoE(Mixture of Experts)架构,在文本生成、深度推理、视觉理解等多方面展现出与全球顶尖模型相媲美的性能。

其核心定位是面向高复杂度、高精度要求的专业任务,可端到端交付生产级成果,适用于法律、金融、UI/UX 设计、芯片设计、量化交易、教育解题、三维创作等数百种高价值场景。
此外,Qwen3.8-Max 支持自主编程,能独立完成跨越数天的真实项目开发,并通过反馈闭环实现自我进化。

二、Qwen3.8-Max 的模型能力

Qwen3.8-Max的能力边界远超传统对话机器人,它被定义为一个能够处理复杂、长周期任务的智能体基座。

在编程与开发领域,Qwen3.8-Max展现了惊人的自主性。它不仅能进行代码补全和生成,更能独立完成长达16天的真实软件工程项目开发。在内部测试中,它成功构建了一个名为“oh-my-cli”的自进化智能体框架,实现了从需求分析、代码生成、测试到日志分析的工程闭环,在FrontendCodeArena榜单中排名第四。

在长文本与多模态处理方面,该模型支持长达100万Token的上下文窗口。这意味着它可以一次性读取并理解整部电视剧集、长达100小时的直播内容或数百页的技术文档,并将其转化为可交互的知识库。其视觉智能能力(VisionArena排名第二)允许用户通过上传UI截图来重建完整的前端网页项目,或将2D平面图转换为3D室内效果图。

此外,在科学研究与复杂逻辑推理上,Qwen3.8-Max也表现优异。它不仅能复现已有的研究实验,还能设计出优于原始论文的新方法,并在WWW2025多模态对话意图识别挑战赛中超越了人类参赛者的表现。

1. 多模态输入与输出

  • 输入模态:支持 文本(Text)、图像(Image)、视频(Video),其中视频最长支持 2 小时或 2GB,图像最高支持 1600 万像素。
  • 输出模态:仅输出 文本(Text)。

2. 上下文与长度限制

  • 最大上下文长度:1,000,000 tokens
  • 最大输入长度:991,808 tokens
  • 最大输出长度:131,072 tokens
  • 最大思维链(CoT)长度:262,144 tokens

3. 高级功能支持情况(以华北2 北京区域为例)

功能项 支持情况
Function Calling(函数调用) 支持
结构化输出(如 JSON Schema) 支持
联网搜索(Web Search) 支持(仅限华北2 北京;其他国际区域如新加坡、东京、法兰克福、弗吉尼亚均不支持)
前缀续写(Prefix Completion) 支持
上下文缓存(Context Caching) 支持
批量推理(Batch Inference) 仅华北2 北京支持;其他区域不支持
模型调优(Fine-tuning) 全区域均不支持

4. 核心能力亮点

  • 长程任务系统级规划:可在数千轮交互中重构算法与策略(如商业模拟、芯片设计)。
  • 原生视觉生产力:贯穿任务全流程的视觉理解与行动能力,支持教育解题、视频语义解析、3D 创作等。
  • 内置工具链(Harness):自动调用联网搜索、代码解释器、网页抓取、以图搜图、文搜图等工具。

三、Qwen3.8-Max 的模型价格(以华北2 北京为例)

对于企业级用户和开发者而言,成本是选择模型的重要考量。Qwen3.8-Max依托其MoE架构,在推理成本上相比同量级的密集模型具有显著优势。

根据官方披露的数据,Qwen3.8-Max的每百万输出Token成本约为6美元。这一价格远低于业内其他同类标杆模型(部分高达50美元/百万Token),极大地降低了高性能AI的使用门槛。

在阿里云百炼平台上,Qwen3.8-Max主要提供两种计费模式:

  1. 按量计费(标准API):适用于临时测试或低频调用场景,用户根据实际消耗的输入和输出Token数量付费,用多少付多少,灵活便捷。
  2. Token Plan订阅制:适用于高频协作团队。用户通过购买预付费套餐(如团队版),获得固定的Credits额度。这种方式不仅单价更低,还能享受多模型统一管理的便利。
计费项 价格
输入 Token 12 元 / 百万 tokens
输出 Token 36 元 / 百万 tokens
缓存命中输入(使用上下文缓存) 1.5 元 / 百万 tokens

重要提示:不同地域的价格可能略有差异,建议以百炼控制台实时报价为准。

四、Qwen3.8-Max 的工具调用价格

在智能体(Agent)应用场景中,模型往往需要调用外部工具(如搜索引擎、代码解释器、API接口等)来完成任务。Qwen3.8-Max具备强大的工具调用与长周期自主执行能力。

关于工具调用的具体计费,通常遵循阿里云百炼平台的统一标准。在大多数情况下,模型在思考过程中产生的内部推理Token(包括工具调用的指令生成和结果分析)会纳入总Token消耗量进行计费。

值得注意的是,阿里云经常针对特定功能推出优惠活动。例如,在Token Plan团队版中,针对Qwen3.7-Max等模型曾推出过Credits消耗减半的优惠。虽然Qwen3.8-Max作为最新旗舰,其具体折扣需以百炼控制台实时公告为准,但开启enable_thinking参数以发挥其长周期推理与智能体能力,是其核心使用场景之一。

五、Qwen3.8-Max 的免费额度

阿里云为新用户提供丰富的免费试用资源:

  • 百炼平台新用户:开通即赠 超 7000 万 tokens;
  • 千问 AI 平台新用户:赠送 1 亿+ tokens 额度;
  • Token Plan 个人版:首发体验 Qwen3.8-Max,提供基础额度用量充裕,且夜间调用更省钱。

免费额度可用于包括 Qwen3.8-Max 在内的多种模型,具体可用额度请登录阿里云百炼大模型服务平台查看:https://www.aliyun.com/product/bailian

重磅发布Qwen3.8Max.png

六、Qwen3.8-Max 的 API 代码示例

虽然知识库未提供完整代码片段,但明确指出:

  • Qwen3.8-Max 兼容主流 AI 编程框架的 Responses API;
  • 可通过 阿里云百炼 CLI 一行命令调用;
  • 在百炼平台中,只需指定 modelId: "qwen3.8-max" 即可启用全部能力(包括内置工具)。

典型调用逻辑如下:

1、Completions API

from openai import OpenAI
import os
client = OpenAI(

# 如果没有配置环境变量,请用阿里云百炼API Key替换:api_key="sk-xxx"
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://llm-fltqd30d7x9rrh4v.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",

)
messages = [{"role": "user", "content": "你是谁"}]
completion = client.chat.completions.create(
model="qwen3.8-max", # 您可以按需更换为其它深度思考模型
messages=messages,
extra_body={"enable_thinking": True},
stream=True
)
is_answering = False # 是否进入回复阶段
print("\n" + "=" 20 + "思考过程" + "=" 20)
for chunk in completion:
if not chunk.choices:
continue
delta = chunk.choices[0].delta
if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
if not is_answering:
print(delta.reasoning_content, end="", flush=True)
if hasattr(delta, "content") and delta.content:
if not is_answering:
print("\n" + "=" 20 + "完整回复" + "=" 20)
is_answering = True
print(delta.content, end="", flush=True)

2、Responses API

import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://llm-fltqd30d7x9rrh4v.cn-beijing.maas.aliyuncs.com/api/v2/apps/protocols/compatible-mode/v1",
)
response = client.responses.create(
model="qwen3.8-max",
input="9.9和9.11哪个大?",
extra_body={
"enable_thinking": True # 启用思考模式
}
)# 遍历输出项
for item in response.output:
if item.type == "reasoning":

    # 打印推理过程摘要
    print("【推理过程】")
    for summary in item.summary:
        print(summary.text[:500])  # 截取前500字符
    print()
elif item.type == "message":
    # 打印最终答案
    print("【最终答案】")
    print(item.content[0].text)

七、Qwen3.8-Max 支持的模型订阅计划有哪些?

目前 Qwen3.8-Max 主要通过以下方式提供服务,采用 按量付费 + 额度抵扣模式:

1、Token Plan(令牌计划)

  • 个人版Token Plan:针对独立开发者、学生及AI爱好者。提供灵活的月度订阅档位,价格亲民。用户可以根据每月的预估Token消耗量选择合适的套餐,享受比按量计费更优惠的单价,适合个人项目开发和日常学习使用。
  • 团队版Token Plan:专为中小企业及高频协作团队设计。提供更高额度的Credits和更高的并发限制。团队版支持多成员共享额度,并提供企业级的技术支持和数据安全保障。购买团队版后,系统会生成专属的API Key,用户可以在百炼控制台统一管理团队成员的使用情况,非常适合需要稳定、高频调用Qwen3.8-Max的商业应用场景。
  • 可使用免费额度或购买 Token 包抵扣调用费用;
  • Qwen3.8-Max 明确支持 TokenPlan 抵扣。活动详情可参考:https://www.aliyun.com/benefit/scene/tokenplan

Lite版本39.png

2、夜间错峰0.2折特惠(22:00 - 次日08:00)
这是当前最值得关注的福利。在北京时间每晚22:00至次日08:00期间,Qoder、Meoo以及TokenPlan的客户使用Qwen3.8-Max模型,可享受0.2折的超低折扣(计费系数降至0.01x)。这意味着,原本昂贵的旗舰模型调用成本将降低98%,用户可以用极低的预算完成大规模的数据处理、代码训练或长文本分析任务。活动详情可参考:https://www.aliyun.com/benefit/client/nightplan

Qwen3.8Max5折.png

3、百炼平台标准计费

  • 按实际输入/输出 token 数量计费;
  • 支持上下文缓存以降低重复输入成本。

综上,Qwen3.8-Max作为通义千问系列的新一代旗舰大模型,凭借2.4万亿参数规模、百万级超长上下文、16天自主编程能力和全球领先的多模态表现,重新定义了智能体基座的性能标杆。依托阿里云百炼平台极具竞争力的定价体系、新用户超亿级免费额度,以及Token Plan用户专属的夜间5折、额度重置等限时福利,开发者与企业无需承担过高成本,即可快速接入这款顶尖模型,在Coding Agent搭建、多模态应用开发、企业级智能体落地等场景中,以更低门槛释放AI生产力,抢占智能体时代的技术先机。

相关文章
人工智能 缓存 数据挖掘
587 0
|
24天前
|
人工智能 运维 安全
阿里云通义千问大模型全系深度解析:全模态大模型功能、定价、API完整实战教程
随着人工智能产业全面落地,通用大模型已经从单纯对话工具进化为企业数字化、个人提效的核心算力基座。通义千问作为阿里云自研国产通用大模型,迭代形成完整Qwen3全系产品矩阵,覆盖轻量极速、均衡通用、旗舰推理、原生多模态四大梯度,依托百炼平台弹性算力支撑文本处理、全栈代码、图文视频解析、自主智能体等复合任务。本文完整拆解全系模型核心功能、六大性能优势、分层定价规则、多渠道上手教程,附带Python、cURL、运维全套可运行代码,覆盖个人创作者、开发团队、政企单位全部使用场景,全程无复杂前置门槛,兼顾轻量化试用与规模化商用部署需求。
4894 3
|
24天前
|
人工智能 JavaScript 前端开发
阿里云Qwen3.8-Max大模型介绍:模型功能、应用场景、最新活动参考
本文介绍阿里云通义千问最新旗舰Qwen3.8-Max,这款2.4万亿参数的基座模型实现全栈代码工程、多模态闭环执行、256K长上下文等能力突破,支持企业智能办公、全栈应用开发等复杂场景。当前通过阿里云百炼Token Plan可39元/月起订阅,叠加全天1折、夜间低至0.2折的限时福利,大幅降低开发者探索AGI能力的门槛。
缓存 人工智能 5G
206 0
|
22天前
|
缓存 人工智能 Java
刚刚:Qwen3.8-Max发布:概述、功能、定价、速率限制与上下文、内置工具及API 参考指南
Qwen3.8-Max是阿里最新发布的2.4万亿参数MoE大模型,支持图文视频多模态输入,具备编程、法律、金融等数百专业任务能力,原生视觉理解+超长上下文(1M),端到端交付生产级成果。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
2月前
|
人工智能 缓存 自然语言处理
阿里云Token Plan(团队版)详细介绍:支持模型、价格、使用细则及最新活动
阿里云百炼Token Plan团队版是面向企业和开发者的AI大模型订阅服务,以Credits为统一计量单位,支持通义千问、DeepSeek、Kimi、GLM等150+款模型的多模态调用。产品分三档坐席套餐:标准版198元/月(25,000 Credits)、高级版698元/月(100,000 Credits)、尊享版1,398元/月(250,000 Credits),并提供5,000元共享用量包作为弹性补充。当前限时活动包括Qwen3.7-Max调用消耗减半、新模型5-8折优惠、HappyHorse视频生成6折及全模型通用抵扣包最高5.3折等活动。
|
23天前
|
机器学习/深度学习 Web App开发 编解码
2026 年 8 月大模型的三重跃迁
8月1—3日,国产大模型密集突破:通义千问Qwen3.8-Max以2.4T稀疏MoE+1M上下文实现高效推理;MiniMax开源全模态视频模型H3,支持2K/15秒带声视频生成;DeepSeek V4-Flash显著提升Agent能力。三大进展分别指向参数效率、长程自治与多模态生产,标志着大模型正从“辅助工具”迈向“端到端自主交付”。
1719 1
2026 年 8 月大模型的三重跃迁
|
20天前
|
人工智能 缓存 API
阿里云Qwen3.8-Max首发上线:API服务与Token Plan同步开放全解析
阿里云正式发布新一代旗舰基座大模型Qwen3.8-Max,同步上线千问AI平台API服务与百炼Token Plan订阅方案,面向全球开发者全面开放调用。作为通义千问系列首款突破2.4万亿参数的MoE混合专家模型,Qwen3.8-Max在编程能力、复杂逻辑推理、长文档处理与多模态智能体协作等领域实现跨越式升级,可独立自主完成16天连续编程任务,全程稳定可靠。本次上线的API服务提供兼容OpenAI与Anthropic的双协议接口,大幅降低迁移成本;Token Plan则以统一Credits计量,打通多模态能力与主流AI工具,为个人与团队提供高性价比的订阅选择。本文将全面解析Qwen3.8-Max
402 2
|
24天前
|
人工智能 自然语言处理 安全
阿里云千问办公活动:一站式AI生产力平台,限时限量积分加倍
千问办公是阿里巴巴全新推出的一站式 AI 办公平台,不止于对话,更注重交付——用户仅需一句话,即可完成数据分析、PPT 生成、视频剪辑、网页搭建等复杂任务,直接获得可用成果。目前已全面覆盖桌面端、网页端,并深度接入钉钉生态,依托个人云盘、IM、连接器等模块打通数据与设备,让 AI 真正融入工作流,随时随地响应办公需求。