阿里云Qwen3.8-Max大模型首发尝鲜:个人版和企业版超值优惠低至39元/月起

简介: 本文介绍了阿里云Qwen3.8-Max旗舰大模型。该模型拥有2.4万亿参数,采用MoE架构,支持文本、图像、视频多模态输入,在代码工程、专业办公、长程任务规划及多模态视觉理解等方面较上代Qwen3.7-Max显著提升,最大上下文达100万Token。文章详解其核心能力、API调用方式与定价策略(输入12元/百万tokens),并重点介绍Token Plan订阅(39元/月起、首发加量10倍)、NightPlan夜间2折等多项优惠活动,助力用户以低成本享受旗舰级AI生产力。

Qwen3.8-Max 是通义千问系列最新一代旗舰模型,拥有 2.4 万亿参数,采用 MoE 架构,支持文本、图像、视频多模态输入与文本输出。阿里云Qwen3.8-Max 首发尝鲜、上新 deepseek-v4-flash,更多模态和旗舰模型共享额度,个企双版本超值优惠低至39 元/月起,高效开启AI生产力。

Qwen3.8Max发布.png

一、阿里云Qwen3.8-Max大模型介绍

Qwen3.8-Max是通义千问系列最新一代旗舰大模型,作为智能体时代的全能型基座模型,其参数规模高达2.4万亿,并采用先进的混合专家(MoE)架构。该模型不仅支持文本输入,还具备原生多模态能力,可处理图像、视频等复杂输入形式,并输出高质量文本响应。Qwen3.8-Max面向Agent场景深度优化,在长程任务规划、跨模态理解、工具调用及自主执行等方面展现出全球领先的综合能力。

作为阿里云百炼平台的核心模型之一,Qwen3.8-Max已全面集成至Token Plan模型订阅计划,并同步上线于Qoder CN系列产品中。该模型特别适用于全栈开发、数据分析、Office办公自动化、芯片设计、商业模拟、量化交易等高复杂度、长周期的专业任务场景。其设计目标不仅是“帮写代码”,更是实现从辅助到“自主干活”的跃迁,真正成为用户的AI工作搭子。

二、阿里云Qwen3.8-Max大模型相比于Qwen3.7模型有哪些能力提升?

相较于上一代旗舰模型Qwen3.7-Max,Qwen3.8-Max在多个核心维度实现显著跃升:

  1. 代码工程(Coding)能力增强:Qwen3.8-Max可独立完成跨越数天的真实软件项目开发,从需求分析、架构设计、编码实现到测试部署全流程闭环,并能通过用户反馈构建自我升级的评估体系(harness),实现零干预自进化。

  2. 专业办公(Cowork)效率提升:在文档合规审查、合同解析、PPT生成、Excel数据分析等高频办公场景中,Qwen3.8-Max能交付生产级成果,显著优于前代模型。

  3. 通用Agent泛化性强化:在UI/UX设计、3D建模、教育解题、视频理解等高经济价值场景中,模型展现出更强的任务泛化与执行能力。

  4. 长程任务系统级规划能力:支持数千轮交互的超长程任务,在芯片设计、商业沙盘推演、金融量化策略优化等复杂系统中实现深度算法重构与策略迭代。

  5. 多模态视觉生产力升级:原生支持超长文档与长视频(最长2小时/2GB)的深度语义解析,贯穿任务规划、执行与验证全流程。

三、阿里云Qwen3.8-Max模型能力

Qwen3.8-Max具备以下核心能力:

  • 编程与办公自动化:胜任法律、金融、设计等专业领域任务,可自主完成端到端项目交付。
  • 原生视觉理解:支持图像、PDF、长视频等多模态输入,实现从感知到行动的闭环。
  • 长上下文处理:最大上下文长度达1,000,000 Token,最大输出长度131,072 Token,支持超长思维链(262,144 Token)。
  • 工具调用能力:全面支持Function Calling、联网搜索、代码解释器、知识检索、网页抓取、结构化输出、上下文缓存等高级功能。
  • 多协议API兼容:支持OpenAI兼容、Anthropic兼容及DashScope三种API协议,便于现有系统无缝迁移。

四、阿里云Qwen3.8-Max大模型价格

在华北2(北京)地域,Qwen3.8-Max的官方定价如下:

  • 输入价格:12元 / 百万 tokens
  • 输出价格:36元 / 百万 tokens
  • 输入(缓存命中):1.5元 / 百万 tokens

值得注意的是,阿里云推出Token Plan模型订阅计划,个人版套餐起售价低至39元/月,并包含Qwen3.8-Max的使用额度。该计划提供Lite、Standard、Pro三档灵活选择,支持月付、季付、年付,并在夜间时段享受额外折扣。活动详情可参考:https://www.aliyun.com/benefit/scene/tokenplan

Lite版本39.png

此外,新用户还可享受“首发尝鲜,限时加量10倍”优惠,即相同费用下获得10倍token额度,大幅降低使用门槛。

五、阿里云Qwen3.8-Max大模型工具调用价格

Qwen3.8-Max的工具调用(如Function Calling、联网搜索、代码执行等)已包含在基础token计费中,不单独收取额外费用。这意味着用户在调用外部工具或执行代码时,仅按实际输入输出的token数量计费,无需担心隐藏成本。

但需注意:在Qoder Desktop的“专家团模式”中,若子Agent调用了其他非Qwen3.8-Max模型,则该部分调用将按对应模型原价计费,并在Credits明细中单独列出。

六、阿里云Qwen3.8-Max大模型模型限流与上下文

Qwen3.8-Max的上下文规格如下:

参数 数值
最大上下文长度 1,000,000 Token
最大输入长度 991,808 Token(思考模式下为983,616)
最大输出长度 131,072 Token
最大思维链长度 262,144 Token

关于限流策略,阿里云未在公开资料中明确具体RPM(每分钟请求数)或TPM(每分钟token数)限制,但建议高并发用户通过上下文缓存功能复用历史对话,降低重复计算开销并提升吞吐效率。该功能目前仅在华北2(北京)和新加坡地域支持。

七、阿里云Qwen3.8-Max大模型免费额度与最新活动介绍

阿里云当前推出多项普惠活动,助力用户低成本体验Qwen3.8-Max:

1.Token Plan订阅计划:个人版39元/月起,首发尝鲜限时加量10倍,相当于实际单价降至约1.2元/百万输入tokens。

2.Night Plan夜间优惠:每日22:00至次日08:00(北京时间),Qwen3.8-Max使用价格低至2折(即输入2.4元/百万,输出7.2元/百万)。该优惠对Qwen/Meoo/TokenPlan客户专享。活动详情可参考:https://www.aliyun.com/benefit/client/nightplan

Qwen3.8Max5折.png

3.OPC创新助力计划:面向初创企业及个人开发者,提供最高百万元Token补贴。

4.智启AI普惠权益:新用户可享最高1亿+免费tokens,加速AI应用落地。

5.免费试用:140+云产品支持最长12个月免费试用,含大模型ACA认证体验。

重要提醒:此前的Qwen3.8-Max-Preview版本已于2026年8月5日正式下线,所有请求已自动路由至正式版Qwen3.8-Max。用户无需手动切换,但建议检查API调用中的model字段是否已更新为qwen3.8-max

八、阿里云Qwen3.8-Max大模型API代码示例

1. OpenAI

```python
from openai import OpenAI
import os

client = OpenAI(

# 如果没有配置环境变量,请用阿里云百炼API Key替换:api_key="sk-xxx"
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",

)

messages = [{"role": "user", "content": "你是谁"}]
completion = client.chat.completions.create(
model="qwen3.8-max", # 您可以按需更换为其它深度思考模型
messages=messages,
extra_body={"enable_thinking": True},
stream=True
)
is_answering = False # 是否进入回复阶段
print("\n" + "=" 20 + "思考过程" + "=" 20)
for chunk in completion:
if not chunk.choices:
continue
delta = chunk.choices[0].delta
if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
if not is_answering:
print(delta.reasoning_content, end="", flush=True)
if hasattr(delta, "content") and delta.content:
if not is_answering:
print("\n" + "=" 20 + "完整回复" + "=" 20)
is_answering = True
print(delta.content, end="", flush=True)

```Node.js
import OpenAI from "openai";
import process from 'process';

// 初始化 openai 客户端
const openai = new OpenAI({
apiKey: process.env.DASHSCOPE_API_KEY, // 从环境变量读取
baseURL: 'https://dashscope.aliyuncs.com/compatible-mode/v1'
});
let isAnswering = false;
async function main() {
try {
const messages = [{ role: 'user', content: '你是谁' }];
const stream = await openai.chat.completions.create({
model: 'qwen3.8-max',
messages,
stream: true,
enable_thinking: true
});
console.log('\n' + '='.repeat(20) + '思考过程' + '='.repeat(20));
for await (const chunk of stream) {
if (!chunk.choices || chunk.choices.length === 0) continue;
const delta = chunk.choices[0].delta;
if (delta.reasoning_content !== undefined && delta.reasoning_content !== null) {
if (!isAnswering) {
process.stdout.write(delta.reasoning_content);
}
}
if (delta.content !== undefined && delta.content) {
if (!isAnswering) {
console.log('\n' + '='.repeat(20) + '完整回复' + '='.repeat(20));
isAnswering = true;
}
process.stdout.write(delta.content);
}
}
} catch (error) {
console.error('Error:', error);
}
}
main();

```cURL
curl -X POST https://dashscope.aliyuncs.com/compatible-mode/v1/chat/completions \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.8-max",
"messages": [
{
"role": "user",
"content": "你是谁"
}
],
"stream": true,
"enable_thinking": true
}'

2. DashScope

```python
import os
import dashscope
dashscope.base_http_api_url = "https://dashscope.aliyuncs.com/api/v1"

messages = [
{
"role": "user",
"content": [
{"image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241022/emyrja/dog_and_girl.jpeg"},
{"text": "图中描绘的是什么景象?"}]
}]
response = dashscope.MultiModalConversation.call(
api_key=os.getenv('DASHSCOPE_API_KEY'),
model='qwen3.8-max',
messages=messages
)
print(response.output.choices[0].message.content[0]["text"])

```Java
import java.util.Arrays;
import java.util.Collections;
import com.alibaba.dashscope.aigc.multimodalconversation.MultiModalConversation;
import com.alibaba.dashscope.aigc.multimodalconversation.MultiModalConversationParam;
import com.alibaba.dashscope.aigc.multimodalconversation.MultiModalConversationResult;
import com.alibaba.dashscope.common.MultiModalMessage;
import com.alibaba.dashscope.common.Role;
import com.alibaba.dashscope.exception.ApiException;
import com.alibaba.dashscope.exception.NoApiKeyException;
import com.alibaba.dashscope.exception.UploadFileException;
import com.alibaba.dashscope.utils.Constants;

public class Main {

static {Constants.baseHttpApiUrl="https://dashscope.aliyuncs.com/api/v1";}

public static void simpleMultiModalConversationCall()
        throws ApiException, NoApiKeyException, UploadFileException {
    MultiModalConversation conv = new MultiModalConversation();
    MultiModalMessage userMessage = MultiModalMessage.builder().role(Role.USER.getValue())
            .content(Arrays.asList(
                    Collections.singletonMap("image", "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241022/emyrja/dog_and_girl.jpeg"),
                    Collections.singletonMap("text", "图中描绘的是什么景象?"))).build();
    MultiModalConversationParam param = MultiModalConversationParam.builder()
            .apiKey(System.getenv("DASHSCOPE_API_KEY"))
            .model("qwen3.8-max")
            .messages(Arrays.asList(userMessage))
            .build();
    MultiModalConversationResult result = conv.call(param);
    System.out.println(result.getOutput().getChoices().get(0).getMessage().getContent().get(0).get("text"));
}
public static void main(String[] args) {
    try {
        simpleMultiModalConversationCall();
    } catch (ApiException | NoApiKeyException | UploadFileException e) {
        System.out.println(e.getMessage());
    }
    System.exit(0);
}

}

```cURL
curl -X POST https://dashscope.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "qwen3.8-max",
"input":{
"messages":[
{
"role": "user",
"content": [
{"image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241022/emyrja/dog_and_girl.jpeg"},
{"text": "图中描绘的是什么景象?"}
]
}
]
}
}'

注意事项:

  • API Key需在阿里云百炼控制台或DashScope平台获取;
  • 使用OpenAI兼容模式时,部分高级功能(如结构化输出、上下文缓存)可能受限,建议关键业务使用DashScope原生API;
  • 所有调用均计入Token消耗,可通过控制台实时监控用量与费用。

综上所述,阿里云Qwen3.8-Max凭借其顶尖的模型能力、灵活的定价策略与丰富的优惠活动,已成为个人开发者与企业用户构建AI应用的理想选择。无论是日常办公、专业开发还是复杂Agent系统,Qwen3.8-Max均能以超值成本提供旗舰级体验。

相关文章
|
25天前
|
人工智能 测试技术 API
最新版通义千问(Qwen3.8-Max)功能介绍
在大模型技术迭代节奏不断加快的当下,混合专家MoE架构已经成为旗舰级大模型的主流技术路线,通义千问Qwen3.8‑Max作为该系列的旗舰级别模型,依托稀疏混合专家架构完成性能跃迁,兼顾超高推理能力与实际运行效率,面向开发者、企业业务、科研机构、编程团队提供完整的AI能力底座,不仅拥有百万级超长上下文窗口,同时原生支持文本、图像输入,强化长周期自主任务、软件工程开发、专业办公分析、工具调用Agent能力,能够把复杂业务指令直接转化为可交付的结果,区别于传统大模型只做问答输出的模式。很多开发者在接触这款模型时,会好奇它和前代版本的差异,哪些业务场景能够发挥它的最大价值,如何通过API快速完成接入,
600 0
|
23天前
|
人工智能 缓存 安全
通义千问Qwen3.8‑Max深度功能解读:原生多模态、Agent实战与API调用教程
大模型产业已经从简单问答时代迈入复杂任务自主执行的新阶段,行业不再只追求单次对话的流畅度,更加看重模型处理长链路任务、自主规划纠错、工程级代码交付、多模态深度解析以及专业领域复杂推理的综合实力。Qwen3.8‑Max作为千问系列的旗舰基座模型,采用稀疏混合专家MoE架构,总参数量达到2.4万亿,单Token激活参数约95B,兼顾超高能力上限与实际推理效率,把长周期智能体执行、百万级超长上下文、原生多模态理解、工程级自主编码、专业领域深度推理等能力整合在同一基座当中,面向软件研发团队、科研机构、企业业务系统开发者、AI应用服务商提供底层能力支撑。在众多权威第三方评测榜单当中,该模型取得十分亮眼的
666 1
|
19天前
|
人工智能 运维 数据可视化
通义千问Qwen3.8‑Max深度解析:MoE旗舰大模型全能力与API实战教程
大模型技术快速迭代,行业需求已经从简单问答对话,转向可以独立完成复杂工程、长周期任务、多模态综合处理的自主智能体。Qwen3.8‑Max作为通义千问系列定位最高的旗舰版本,采用2.4万亿总参数第三代MoE稀疏混合专家架构,搭配百万级Token超长上下文窗口,实现原生多模态融合,完成从AI辅助工具向自主执行智能体的能力跨越。它不仅在代码工程、专业办公、数理科研推理领域实现大幅度性能跃升,还具备端到端交付生产级业务成果的实力,为个人开发者、企业研发团队、科研机构提供高性能AI生产力底座。本文从底层技术架构、五大核心能力矩阵、真实业务场景、多套可直接运行的API代码示例、接入方式等维度完整展开,帮助
398 2
|
2月前
|
人工智能 运维 API
阿里云百炼Token Plan个人版介绍:Qwen3.8-Max抢先体验指南
2026年7月阿里云百炼平台正式推出**Token Plan个人版包月算力订阅服务**,补齐个人开发者轻量化、高性价比大模型调用的核心需求缺口。在此之前,个人用户使用通义千问旗舰模型大多依赖按量计费模式,批量代码开发、7×24小时智能体挂机、多模态批量创作场景下算力消耗不可控,月度账单波动极大;同时不同模型、不同工具需要单独配置计费凭证,切换繁琐、预算难以规划。全新Token Plan个人版采用包月预付费、Credits统一积分计量模式,一套订阅兼容文本、图像、视频全系千问模型与第三方商用大模型,配套联网搜索、代码解释器等全套增强工具,更开放2.4T参数Qwen3.8-Max-Preview预
792 1
|
1月前
|
人工智能 缓存 API
阿里云Qwen3.8-Max首发上线:API服务与Token Plan同步开放
阿里云于2026年8月正式推出了其最新一代旗舰基座大模型——Qwen3.8-Max。这款模型不仅在参数规模上实现了新的突破,更在推理效率、多模态处理及长周期任务执行上展现了卓越的性能,标志着通义千问系列模型迈入了一个全新的智能体时代。本文将深入解析Qwen3.8-Max的技术特性、应用场景、价格体系及接入方式,为开发者和企业提供一份详尽的参考指南。
|
2月前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
4088 144
|
3天前
|
缓存 自然语言处理 API
阿里云Qwen3.8‑Max、Qwen3.7‑Max、Qwen3.7‑Plus、Qwen3.7‑Flash、Qwen3.8‑Flash功能区别解析,企业项目选型完整指南
随着大模型智能体落地场景持续拓宽,越来越多开发者会面对多款同系列模型选型难题。阿里云百炼平台上架的Qwen3.8‑Max、Qwen3.7‑Max、Qwen3.7‑Plus、Qwen3.7‑Flash、Qwen3.8‑Flash五款模型,覆盖从复杂深度推理、长周期智能体、多模态GUI操控到高吞吐低成本业务场景,不同模型在架构、上下文窗口、模态支持、代码能力、工具调用稳定性、计费成本上存在明显差异。很多开发者在项目前期直接选用高规格旗舰模型,带来不必要的高额推理成本;也有部分场景误用轻量模型,造成复杂任务推理失败、工具调用错乱、长文档解析丢失关键信息等问题。本文将从底层架构、核心能力、适用业务场景
270 1
|
5天前
|
缓存 监控 API
最新版阿里云通义千问 Qwen3.8‑Max 功能介绍、计费规则、选型指南及使用教程与常见问题 FAQ
Qwen3.8‑Max作为千问系列新一代旗舰大模型,采用MoE混合专家架构,总参数规模达到2.4万亿,激活参数约950亿,百万级超大上下文窗口,同时具备原生多模态理解、深度思考推理、强工具调用、长周期智能体闭环执行等多项核心能力。该模型不再局限简单问答对话,能够独立完成复杂软件工程、法律文书分析、金融方案推演、长文档深度解析、截图与视频理解等专业任务,支持端到端输出生产级业务成果,是面向复杂业务、智能体开发、高难度科研分析场景的主力基座模型。
263 1
|
25天前
|
人工智能 缓存 算法
最新版通义千问(Qwen3.8‑Max‑Preview)功能介绍
随着AI智能体从简单问答走向长周期自主任务执行,市场对大模型的综合能力提出更高要求,不仅需要强悍的文本推理,还需要原生多模态理解、百万级超长上下文、稳定的链式工具调用、大型工程项目完整交付能力。Qwen3.8‑Max‑Preview作为通义千问系列新一代旗舰预览基座,总参数规模达到2.4万亿,采用MoE混合专家架构,定位为**代码工程+专业办公**双核旗舰模型,完成从纯文本向原生多模态的跨越,在长链路Agent自治、全栈软件开发、大批量复杂文档分析、多模态专业办公场景实现能力跨越式提升。该预览版本率先开放于百炼平台,支持Token Plan订阅模式调用,适配OpenClaw、Hermes Ag
699 2
|
20天前
|
人工智能 自然语言处理 API
阿里云Token Plan订阅计划详解:AI 模型订阅计划能力、订阅方案与价格、最新活动参考
本文介绍了阿里云百炼推出的Token Plan大模型统一订阅服务,该服务以Credits为统一计量单位,仅在华北2(北京)地域生效,一份订阅即可覆盖150余款主流大模型,支持文本、图像、视频、语音等多模态能力,兼容Cursor、Qoder、Qwen Code等主流AI编程与智能体工具。产品分为个人版与团队版两大体系,个人版三档套餐限时低至39元/月,适配个人开发者从入门到重度使用的全场景需求;团队版主打多席位管理、用量精细化管控与数据不用于训练的合规保障,满足企业级多人协作与生产部署要求。

热门文章

最新文章