文档备案控制台

开发者社区开发与运维文章正文

通义千问升级旗舰模型Qwen-Max，性能接近GPT-4o

2024-09-19 9799

版权

版权声明：

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： 通义旗舰模型Qwen-Max全方位升级，性能接近GPT-4o

9月19日云栖大会，阿里云CTO周靖人宣布，通义旗舰模型Qwen-Max全方位升级，性能接近GPT-4o。通义官网和通义APP的后台模型均已切换为Qwen-Max，继续免费为所有用户提供服务。用户也可通过阿里云百炼平台调用Qwen-Max的API。

相比上一代模型，Qwen-Max在训练中使用了更多的训练数据、更大的模型规模、更强的人类对齐，最终达到了更高的智能水平。在MMLU-Pro、MATH、GSM8K、MBPP、MultiPL-E、LiveCodeBench等十多个权威基准上，Qwen-Max表现接近GPT-4o，数学能力、代码能力则超越了GPT-4o。数学和代码所代表的推理能力是大模型智能水平的最重要体现。

相比2023年4月的初代通义千问大模型，Qwen-Max的理解能力提升46%、数学能力提升75%、代码能力提升102%、幻觉抵御能力提升35%、指令遵循能力提升105%，模型与人类偏好的对齐水平更是有了质的飞跃，提升了700%以上。

文章标签：

云栖大会

API

关键词：

模型GPT

升级GPT

性能GPT

模型性能GPT

接近GPT

阿里云新鲜事

目录

相关文章

TsingtaoAI

|

7月前

|

人工智能新制造云栖大会

TsingtaoAI亮相云栖大会，AI大模型赋能传统制造业焕新升级

2025年9月24日，杭州云栖小镇，2025云栖大会盛大开幕。作为全球AI技术与产业融合的重要平台，本届大会以“AI驱动产业变革”为主题，集中展示大模型技术在各领域的创新应用。其中，由西湖区商务局牵头组织的“AI大模型应用与产业融合”专场论坛成为大会亮点之一，吸引了来自政府、企业及投资机构的百余名代表参与。在论坛上，TsingtaoAI作为制造业智能化转型的代表企业，分享了在具身智能-制造企业的AI应用实践。

TsingtaoAI

494 1 1

modelscope

|

9月前

|

数据采集机器学习/深度学习编解码

小红书 hi lab开源最强多模态大模型dots.vlm1，性能对标闭源 Gemini 2.5 Pro 和 Seed-VL1.5

小红书 hi lab开源最强多模态大模型dots.vlm1，性能对标闭源 Gemini 2.5 Pro 和 Seed-VL1.5

modelscope

846 0 0

小红书 hi lab开源最强多模态大模型dots.vlm1，性能对标闭源 Gemini 2.5 Pro 和 Seed-VL1.5

喜欢猪猪

|

10月前

|

存储资源调度并行计算

# Qwen3-8B 与 Qwen3-14B 的 TTFT 性能对比与底层原理详解

通义千问Qwen3系列是通义实验室2025年推出的最新大模型，包含多种参数版本，其中Qwen3-8B与Qwen3-14B均支持32K token上下文。Qwen3-8B参数量较小，响应更快，适合低延迟交互；Qwen3-14B参数更多，推理更强，适用于复杂任务。两者在TTFT、架构优化、量化技术及部署方案上各有侧重，满足多样应用场景需求。

喜欢猪猪

5065 10 10

阿里云大数据Al技术

|

10月前

|

机器学习/深度学习人工智能测试技术

【ICML2025】大模型后训练性能4倍提升！阿里云PAI团队研究成果ChunkFlow中选

近日，阿里云 PAI 团队、通义实验室与中国科学院大学前沿交叉科学学院合作在机器学习顶级会议 ICML 2025 上发表论文 Efficient Long Context Fine-tuning with Chunk Flow。ChunkFlow 作为阿里云在变长和超长序列数据集上高效训练解决方案，针对处理变长和超长序列数据的性能问题，提出了以 Chunk 为中心的训练机制，支撑 Qwen 全系列模型的长序列续训练和微调任务，在阿里云内部的大量的业务上带来2倍以上的端到端性能收益，大大降低了训练消耗的 GPU 卡时。

阿里云大数据Al技术

961 1 1

阿里云安全_

|

8月前

|

人工智能安全 Java

通义安全能力重磅升级，AI编码安全性全球领先

喜报～

阿里云安全_

1778 9 9

通义安全能力重磅升级，AI编码安全性全球领先

Lethehong-44459

|

8月前

|

人工智能数据可视化前端开发

AI Ping：精准可靠的大模型服务性能评测平台

AI Ping是清华系团队推出的“大模型服务评测平台”，被誉为“AI界的大众点评”。汇聚230+模型服务，7×24小时监测性能数据，以吞吐量、延迟等硬指标助力开发者科学选型。界面简洁，数据可视化强，支持多模型对比，横向对标国内外主流平台，为AI应用落地提供权威参考。

Lethehong-44459

2016 3 3

bailiantest1

|

9月前

|

人机交互 API 开发工具

基于通义多模态大模型的实时音视频交互

Qwen-Omni是通义千问系列的全新多模态大模型，支持文本、图像、音频和视频的输入，并输出文本和音频。Omni-Realtime服务针对实时交互场景优化，提供低延迟的人机交互体验。

bailiantest1

1598 23 24

汀丶人工智能

|

10月前

|

机器学习/深度学习人工智能编解码

AI-Compass LLM合集-多模态模块：30+前沿大模型技术生态，涵盖GPT-4V、Gemini Vision等国际领先与通义千问VL等国产优秀模型

AI-Compass LLM合集-多模态模块：30+前沿大模型技术生态，涵盖GPT-4V、Gemini Vision等国际领先与通义千问VL等国产优秀模型

汀丶人工智能

996 6 7

AI-Compass LLM合集-多模态模块：30+前沿大模型技术生态，涵盖GPT-4V、Gemini Vision等国际领先与通义千问VL等国产优秀模型

热门文章

最新文章

本地离线部署大模型知识库OLLAMA+Anything（保姆级）

通义千问72B、1.8B、Audio模型开源！魔搭社区最佳实践来啦！

阿里云百炼已上线超强推理开源模型QwQ-32B，尺寸更小，性能比肩DeepSeek满血版

【AI大模型】Transformers大模型库（十）：repetition_penalty惩罚系数

LangSmith：大模型应用开发的得力助手

阿里通义千问的这次升级不仅带来了实实在在的利好，也为我们展示了AI技术的巨大潜力和广阔前景

中科院计算所推出多语言大模型「百聆」，我们已经上手聊起来了

通义灵码添加上下文能力怎么用？一篇看懂

AI Agent多模态融合策略研究与实证应用

LLMs 入门实战系列大全：LLMs应用、领域大模型介绍、大模型常见面经汇总

123_自监督任务变体：Causal LM详解 - GPT-style下一词预测机制与训练优化

34_GPT系列：从1到5的架构升级_深度解析

从CLIP到GPT-4V：多模态RAG背后的技术架构全揭秘

阿里云开发者必备：GPT 从核心原理到企业级部署的全流程指南

阿里云开发者的共性痛点 ——「自建 GPT + 云服务」方案？

Dify x AiOnly平台：手把手教你调用GPT-5从零构建AI工作流！

快速集成GPT-4o：下一代多模态AI实战指南

现代AI工具深度解析：从GPT到多模态的技术革命与实战应用

通过 Cursor CLI 使用 GPT-5 的教程

全网最全的GPT-5测评文章！1.8万字详细实战测评！国内直接使用！

相关课程

更多

阿里云大模型能力培训（永耀）

国家电网大模型ACP培训

大模型 Clouder认证：基于PAI ArtLab的AIGC设计基础

阿里云大模型工程师ACA认证课程

阿里云百炼大模型产品实践

相关电子书

更多

OpenSearch向量检索和大模型方案

通义万相：视觉生成大模型的进化与应用

达摩院通义视觉生成大模型

相关实验场景

更多

使用AI容器镜像部署Qwen大语言模型

在云上部署ChatGLM2-6B大模型（GPU版）

如何快速训练大模型

如何快速体验调用通义大模型

通过GPU云服务器训练GPT-2

下一篇

[网络安全] Dirsearch 工具的安装、使用详细教程