重磅!千问最强模型正式发布

简介: 阿里正式发布千问旗舰推理模型Qwen3-Max-Thinking:参数超万亿、预训练数据达36T Tokens,规模与能力均为当前最强。采用全新测试时扩展机制,推理更智能、更经济;原生Agent能力大幅增强,可自主调用工具。开发者与用户均可免费体验。

刚刚,阿里正式发布千问旗舰推理模型Qwen3-Max-Thinking。该模型总参数量超万亿(1T),预训练数据量高达36T Tokens,是目前阿里规模最大、能力最强的千问推理模型。

千问新模型通过总参数、强化学习、推理计算的极致规模扩展,实现了性能的大幅飞跃,在多项关键性能基准测试中刷新全球新纪录。同时,该模型采用全新测试时扩展机制,推理性能提升同时更经济,并大幅增强原生Agent能力,模型对话时可自主调用工具。

目前,开发者可在QwenChat上免费体验Qwen3-Max-Thinking模型,企业可通过阿里云百炼获取新模型API服务,普通用户也可通过千问PC端和网页端试用模型。此外,千问APP也即将接入新模型,所有用户都可免费体验千问最强模型。

体验地址👇

规模最大、能力最强的千问推理模型

Qwen3-Max-Thinking是目前阿里规模最大、能力最强的千问推理模型,其总参数量超万亿(1T),预训练数据量高达36T Tokens。

此前,预览版Qwen3-Max-Thinking斩获数学推理AIME 25和HMMT 25的国内首个双满分,推理性能已让人惊艳;在此基础上,阿里通义团队进行了更大规模的强化学习后训练,全面提升了正式版Qwen3-Max-Thinking性能。

其中,在涵盖事实知识、复杂推理、指令遵循、人类偏好对齐、Agent能力等19个公认的大模型基准测试中,千问旗舰推理模型刷新了数项最佳表现(SOTA)纪录,整体性能可媲美国际顶尖AI大模型。

测试时扩展机制,推理性能提升且更经济

在关键的模型推理能力提升中,千问新模型采用了一种全新的测试时扩展(Test-time Scaling)机制,推理性能提升的同时还更经济。

业界普遍的推理时计算,只会简单增加并行推理路径,重复推导已知结论很常见,冗余推理效率低下;而千问采用的这一机制,可对此前推理的结果进行“经验提取”式的提炼,并据此进行多轮自我迭代,在相同的上下文中实现更高效的推理计算,因此获得更智能的推理结果。

基于这一推理技术创新,千问推理性能和推理效率大为提升,比如在启用工具的“人类最后的测试”HLE中,千问得分58.3,大幅超过GPT-5.2-Thinking的45.5、Gemini 3 Pro的45.8,录得当前所有模型的最高分。

大幅增强原生Agent能力,对话时自主调用工具

面向即将到来的智能体Agent时代,Qwen3-Max-Thinking还大幅增强了自主调用工具的原生Agent能力。

这种自适应的工具调用能力可在QwenChat上完整体验,Qwen3-Max-Thinking模型会自主选用「搜索」、「个性化记忆」和「代码解释器」等三个核心的Agent工具功能,提供专业人士一样水平的回答,更合用户心意、更智能、更流畅;同时,模型幻觉也大为降低,为解决真实复杂任务打下基础。

该能力源自于通义团队专门设计的训练流程。具体而言,在完成初步的工具使用微调后,团队对模型进一步在大量多样化任务上进行了基于规则奖励与模型奖励的联合强化学习训练,使得Qwen3-Max-Thinking拥有更智能结合工具进行思考的能力。

/ END /


来源  |  阿里云公众号


目录
相关文章
|
7月前
|
机器学习/深度学习 人工智能 自然语言处理
以小胜大!千问Qwen3.5重磅发布,每百万Token仅0.8元
阿里巴巴开源全新一代千问Qwen3.5-Plus:全球最强开源大模型,3970亿参数、仅激活170亿,原生多模态,支持图文视频理解与长视频分析;推理吞吐量最高提升19倍,API价格低至0.8元/百万Token。
以小胜大!千问Qwen3.5重磅发布,每百万Token仅0.8元
|
8月前
|
Web App开发 人工智能 JSON
别再手写提示词!需求澄清 + 50多专业提示词框架自动匹配,效率提升10倍!
本项目推出「prompt-optimizer」智能体,专治提示词撰写痛点:表达不清、框架难选、套用费时。支持50+全球顶尖提示词框架,自动匹配、主动澄清歧义、一键生成优化提示词,并兼容多模型。已开源Skill与Chrome插件,开箱即用。(239字)
别再手写提示词!需求澄清 + 50多专业提示词框架自动匹配,效率提升10倍!
|
19天前
|
人工智能 缓存 自然语言处理
千问大模型完全免费使用攻略:从网页版到API一文搞懂
千问大模型提供免费网页版和API额度,本文详解所有免费使用途径,包括网页端对话、API调用额度、学生优惠及开发者资源。
1886 0
|
7月前
|
机器学习/深度学习 人工智能 自然语言处理
以小胜大!千问Qwen3.5重磅发布,每百万Token仅0.8元
阿里巴巴开源全新一代千问Qwen3.5-Plus,全球最强开源大模型:3970亿参数、仅激活170亿,原生多模态,支持图文视频理解与视觉编程;推理吞吐量最高提升19倍,API价格低至0.8元/百万Token。
|
10天前
|
人工智能 小程序 API
阿里云千问大模型完全免费使用攻略:从网页版到 API 一文搞懂实操全教程
千问系列大模型覆盖文本对话、代码编写、长文档解析、图片理解、图像生成等多类能力,普通用户可以直接使用网页端完成日常问答、文案撰写、PPT生成、代码调试;开发者可以借助平台新人免费Token额度,通过API接口把大模型能力集成到自己的程序、本地智能体、小程序、网站当中,不需要前期投入资金,就可以完成原型开发、功能验证、学习测试。
1012 0
|
19天前
|
Web App开发 人工智能 搜索推荐
千问大模型网页版深度体验:你可能不知道的功能与玩法
千问大模型网页版有哪些好用的功能?本文分享使用技巧与隐藏玩法,帮你充分释放千问大模型的潜力,提升办公和学习效率。
165 0
|
11月前
|
自然语言处理 测试技术 API
通义Qwen3-Max:大就是好
通义千问Qwen3-Max正式发布,参数超1T,训练稳定高效,在代码、推理、多语言等任务中表现卓越。预览版已登顶LMArena榜单前三,支持阿里云百炼API调用与Qwen Chat体验,敬请试用。
4782 32
|
1月前
|
人工智能 数据可视化 BI
最新版通义千问Qwen3.7-Max全解析:核心功能、技术架构与实战使用指南
通义千问Qwen3.7-Max是面向智能体时代的新一代旗舰大模型,以万亿参数MoE混合专家架构、256K超长上下文窗口、35小时全自主任务执行能力为核心突破,在编程、办公自动化、长文档分析、复杂推理等场景实现全面领先。它彻底打破传统大模型“被动响应”的局限,进化为能自主拆解需求、调用工具、多轮迭代、完成全流程复杂任务的智能体基座,成为个人与企业构建AI生产力的核心选择。本文将从技术架构、核心功能、使用入口、API调用、场景实战、避坑指南六大维度,全面解析Qwen3.7-Max,帮助用户快速掌握其能力与使用方法,实现从基础对话到复杂工程的高效落地。
400 1
|
1月前
|
文字识别 数据挖掘 API
千问大模型全方位使用指南:网页版、API与智能体一站式教程
千问大模型全方位使用指南,涵盖网页版对话、API调用、智能体搭建等所有使用方式。立即查看,快速上手千问大模型。
1770 0
|
1月前
|
人工智能 自然语言处理 数据可视化
保姆级教程:通义千问最新版全功能详解,零基础上手 + API 调用实操
随着通用人工智能技术持续落地,很多普通用户、办公从业者、学生以及开发者都开始接触大模型工具,但不少新手面对繁杂的模型能力、设置选项、接口调用方式时容易无从下手。通义千问作为通用大模型产品,持续迭代更新,不断补齐长文本处理、多模态解析、自主智能体、工程代码生成、批量文档处理等能力,兼顾网页可视化简易操作与面向开发者的API程序化接入,既适合零基础用户直接在网页端完成办公、学习、内容创作任务,也能满足技术人员搭建AI应用、自动化脚本、知识库系统的开发需求。本文为保姆级完整教程,从基础定位、逐项拆解最新核心功能、分场景实操演示、API代码调用、新手高频避坑要点等维度完整讲解,无论你是完全没有AI使用
783 0