Qwen3.8-Max 发布解读:2.4万亿总参数、激活950亿,百万上下文与价格拆解

简介: Qwen3.8-Max 于 2026 年 8 月发布:2.4 万亿总参数 MoE、激活约 950 亿,最大支持 100 万上下文,价格与开源计划一并拆解。

大家好,我晚安code。

最近评论区老有人问:国产开源大模型里,到底哪个值得盯?我的答案是 Qwen3.8-Max——不是因为它刷了多少榜,而是阿里这次把「2.4 万亿总参数 + 百万上下文 + 首次开源 Max 级权重」三张牌一起甩了出来。这篇文章把它的规格、价格、开源进度一次讲清楚。

一、先对齐发布时间:8 月初官方发布

先说事实,别被各路自媒体绕晕:阿里巴巴于 2026 年 8 月 3 日官宣 Qwen3.8-Max,8 月 2 日起已在阿里云百炼等多个区域陆续上线(官方文档注明 8 月 2 日已替代 Preview 版本)。它是通义千问系列迄今参数规模最大、能力最强的旗舰模型。

为什么它值得单独写一篇?因为这是千问史上第一次把 Max 级权重拿出来开源——此前开源的都是 27B 之类的小号,Max 只走 API。这次连家底都亮出来了。

二、规格怎么读:2.4T 总参数,激活只有 950 亿

很多人一看「2.4 万亿参数」就以为要 4TB 显存才能跑,其实不是一回事。Qwen3.8-Max 是稀疏混合专家(MoE,Mixture of Experts)架构:总参数 2.4 万亿不假,但推理时只激活约 950 亿参数。你可以理解为「一个几百人的专家团,每次只按题目叫最对口的几个人上场」。

规格项 Qwen3.8-Max
架构 稀疏 MoE + 混合注意力(标准注意力 + 线性注意力)
总参数 约 2.4 万亿(2.4T)
激活参数 约 950 亿(推理时)
上下文窗口 最大 100 万 token
最大输出 13.1 万 token
输入模态 文本、图像、视频(2 秒~2 小时)
输出模态 目前仅文本

上下文这块国内玩家普遍 128K 起步,Qwen3.8-Max 把窗口直接推到 100 万 token,什么概念?大概能装下一整部中等篇幅的小说、几十份长文档,或者一口气喂进两小时的视频内容再让它总结。对长文档处理、法律金融这类专业场景是实打实的红利。

三、能力亮点:16 天自主编程 + 超长内容理解

规格只是参数,我更关心它干起活来什么样。官方披露的几个点比较有信息量:

  • 长周期自主编程:内部测试里它自主完成了一个长达 16 天的真实软件工程项目,产出的「oh-my-cli」自进化智能体框架已开源。16 天连续推进一个项目,考验的不是单次写码能力,而是任务拆解、状态管理和跨天记忆——这正是智能体时代最缺的能力。
  • 超长内容入口:能吞下超百页文档、整部电视剧、100 小时直播,转成可交互的知识库再问答。结合 100 万上下文窗口看,这条链路是通的。
  • 视觉到世界的转换:官方给了不少应用侧案例,从 UI 截图重建前端、2D 户型图出 3D 效果图,到法律文书审查、金融研究都有覆盖。

四、价格:国内输入 12 元/百万 token,主打便宜大碗

到账环节。Qwen3.8-Max 的国内定价走的是「便宜大碗」路线,输入 12 元/百万 token,跟同体量旗舰比很有竞争力。

计费项 国内价(元/百万 token) 备注
输入 12 华北2 北京等区域
输出 36
缓存命中输入 1.5 命中缓存时
海外参考 约 $2 输入 / $6 输出 阿里云国际站口径

要提醒一句:真实成本看你怎么用。百万上下文的输入如果每次都全量喂,再便宜的单价也会叠起来;好在它支持上下文缓存,命中后输入单价能降到 1.5 元/百万 token,长对话、反复读同一批文档的场景一定要开缓存。

五、开源进度:Max 权重首次开源,许可条款要看清

最大变数是许可协议。 按官方计划,Max 级权重与 Qwen3.8-27B 已在 8 月中旬陆续上架开源平台。要注意两点:

  • 「首次开源 Max 级权重」是实打实的里程碑,说明阿里愿意把最强的家底开放出来让人自部署、微调。
  • 但部分报道指出,Max 权重可能不再沿用此前宽松的 Apache 2.0,而是换成了自定义许可,对商用有额外约定。这块官方细则和最终协议我建议以 Hugging Face / ModelScope 仓库页面的 License 声明为准——动笔时细节仍待官方进一步明确。

对绝大多数开发者,我反而更建议关注同批的 Qwen3.8-27B:稠密小模型、能跑本地,性能又不差,才是大多数人真正用得上的那个。2.4T 的全量权重,你本地大概率是喂不下的。

六、我的点评:别被 2.4T 吓到,也别被 2.4T 忽悠

说点个人判断:Qwen3.8-Max 对能用上 100 万上下文的专业场景是真香,但普通个人开发者没必要盯着 2.4T 这个数字。它真正撬动的,是「国产旗舰也愿意开源、也卷价格」这个信号——这比任何单点参数都重要。

可能有人会问:Qwen3.8-Max 现在能用吗?在哪调?

能。API 已上线阿里云百炼平台(model 参数 qwen3.8-max),国内主要区域可直连,支持 Function Calling、上下文缓存、批量推理;新用户在北京区域有 100 万 token 免费试用额度。开源权重自 8 月中旬起在 Hugging Face / ModelScope 陆续提供。

(以上规格与国内价格为阿里官方 2026 年 8 月口径;开源许可细节以 Hugging Face / ModelScope 仓库页 License 为准,海外价以阿里云国际站为准。)

我是晚安code,持续分享编程干货。觉得有用的话记得点赞收藏和关注~也欢迎在评论区聊聊:Qwen3.8-Max 的 2.4 万亿权重你打算自部署,还是更看好 27B 本地小模型?

目录
相关文章
|
4天前
|
人工智能 自然语言处理 安全
阿里云AI数智鉴密:AI 生成内容如何拿到一张"防篡改的身份证"
隐形水印 + C2PA签名:让AI生成内容“持证上岗”。
1122 0
|
13天前
|
人工智能 自然语言处理 安全
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
本文聚焦阿里云2026年推出的三款自研AI办公产品,清晰拆解千问办公、Qoder Teams、Qoder CN的差异化定位与能力边界:千问办公主打职场全场景提效,支持自然语言指令一键完成PPT生成、数据分析等高频办公任务;Qoder Teams面向程序员团队,深度整合AI代码生成、团队协同与企业知识库能力;Qoder CN则专为金融、政务等强合规场景打造,实现数据不出境与VPC私有化部署。文章同步给出分场景选型指南与最新活动定价,帮助不同类型的企业按需组合产品,实现业务岗、研发岗与强合规场景的AI能力全覆盖。
3733 4
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
|
4天前
|
人工智能 运维 BI
阿里云千问办公QwenWork深度解析:基于Qwen3.8,六大核心能力重构企业全自动化工作流与计费选型指南
传统AI办公工具大多停留在对话问答、文档摘要、简单文案生成层面,只能完成单点碎片化任务,无法自主拆解复杂业务流程,很难串联多工具、多文档、外部业务系统完成端到端完整工作交付。很多企业在落地AI办公的时候,需要组合多款不同工具,来回切换界面,手动复制粘贴中间结果,智能化改造落地门槛居高不下。千问办公QwenWork是整合多款智能体产品能力打造的一体化企业办公智能体平台,底层基座依托Qwen3.8大模型,打通桌面端Agent、云端Agent、企业协同Agent三种运行形态,不再局限简单问答,接收业务目标之后自主拆解任务步骤,调用各类工具,处理文档、表格、浏览器自动化、数据查询,直接输出可交付的办公
1350 0
|
4天前
|
人工智能 安全 前端开发
刚刚 GPT-6 Astra 发布,全球最强,AGI 时代到来!
OpenAI 正式推出 GPT-6 Astra 模型,带大家看看这次 GPT 有哪些提升,跟 Claude Fable 5.1 有什么差距?AI 编程能力如何?AGI 真的来了么?
611 0
|
10天前
|
人工智能 并行计算 数据可视化
秋叶ComfyUI-AKI最新整合包|完整部署教程+核心指令手册
秋叶ComfyUI-AKI一键整合包,国内适配最优、稳定性最强的商用/学习级版本:全封装虚拟环境、预装90%常用节点、内置绘世启动器与成熟工作流,免配置、零依赖、解压即用,完美兼顾新手入门与专业批量生产需求。(239字)
|
14天前
|
人工智能 Linux iOS开发
Ollama使用教程:Ollama官网下载、Ollama本地部署大模型(2026最新)
Ollama 是一款免费开源的本地大模型运行工具,支持在 Windows/macOS/Linux 上离线运行 Qwen、DeepSeek、Llama 等主流开源模型,数据不出本机、隐私安全。提供 OpenAI 兼容 API,命令行一键拉取/运行/管理模型,无需联网,无调用限制,是开发者与 AI 爱好者部署本地 AI 助手的理想选择。(239 字)