通义千问Qwen3.7-Max:万亿MoE架构,35小时自主执行的旗舰智能体

简介: 在大模型从“被动问答”迈向“主动执行”的智能体时代,通义千问推出的Qwen3.7-Max凭借万亿级MoE混合专家架构、百万Token超长上下文、35小时连续自主执行与顶尖编程推理能力,成为新一代旗舰级通用AI代理。作为通义千问系列中定位“全能智能体基座”的核心产品,它突破传统大模型能力边界,实现从文本理解到复杂任务全流程自主执行的跃迁,在全球权威评测中跻身第一梯队,多项核心能力登顶国产榜首,标志着国产大模型正式迈入“自主实干”的全新阶段。

在大模型从“被动问答”迈向“主动执行”的智能体时代,通义千问推出的Qwen3.7-Max凭借万亿级MoE混合专家架构、百万Token超长上下文、35小时连续自主执行与顶尖编程推理能力,成为新一代旗舰级通用AI代理。作为通义千问系列中定位“全能智能体基座”的核心产品,它突破传统大模型能力边界,实现从文本理解到复杂任务全流程自主执行的跃迁,在全球权威评测中跻身第一梯队,多项核心能力登顶国产榜首,标志着国产大模型正式迈入“自主实干”的全新阶段。

一、核心技术架构:万亿MoE+百万上下文,高效稳定的智能体引擎

Qwen3.7-Max采用万亿级MoE(Mixture of Experts)混合专家架构,总参数规模超1万亿,预训练数据量达36万亿Tokens,涵盖代码库、学术论文、百科知识、多语言对话、行业文档等多元数据,构建起覆盖全领域的知识体系。MoE架构的核心优势在于“按需激活、高效计算”:模型并非每一步都调用全部参数,而是根据任务类型动态激活对应的“专家模块”(如编程专家、推理专家、办公专家),每Token仅激活约220亿参数(仅占总参数的9.4%),在保持超大模型能力的同时,将实时计算成本控制在合理范围,兼顾性能与效率。这种架构设计让Qwen3.7-Max既能处理简单对话,也能支撑超复杂的长周期任务,完美解决“小模型能力不足、大模型成本过高”的行业痛点。详情👉访问阿里云百炼大模型服务平台页面 了解。
image.png
bailian1.png
bailian2.png

在上下文处理能力上,Qwen3.7-Max原生支持100万Token超长上下文窗口,相当于可直接处理约75万字的文本、数万行代码、数十万字行业报告、整本书籍或多小时会议录音,彻底突破传统大模型长文本分段处理带来的信息割裂、逻辑断裂问题。依托优化的混合注意力架构,模型跨章节、跨文件关联检索能力大幅提升,可精准定位长文本中的关键信息,完成法律条文比对、代码工程分析、长篇报告总结等复杂任务。同时,模型支持双模推理模式(思考模式与非思考模式),思考模式下可生成深度思维链,自主拆解任务、验证结果;非思考模式则专注快速响应,灵活适配不同场景需求。

推理效率方面,Qwen3.7-Max通过多项底层优化实现性能飞跃:采用MTP γ=4专用内核,重构计算流程,实现每块同时处理4个查询Token,共享K/V加载以摊销内存访问成本,结合只读缓存指令,达成10.0倍几何平均加速比;通过工作负载自适应拆分调优、寄存器式K/V加载、批量Softmax更新等优化,进一步降低单Token开销,推理速度较上一代旗舰模型提升3倍以上。在AIME数学竞赛测试中,单题解答仅需113秒,比同类模型快近3倍;在Kernel Bench L3测试中,实现2.37倍中位数加速与100%通过率,展现出极致的推理性能。

二、核心功能能力:智能体+编程+办公+推理,全能型AI实干家

  1. 长程自主执行:35小时连续运行,千次工具调用零中断
    长程自主执行是Qwen3.7-Max的核心突破,官方测试可稳定运行35小时、完成1158次工具调用,全自主实现从任务规划到结果验证的全流程闭环,无需人工频繁干预。模型内置全域思考模式,支持1000+次顺序工具调用,可自主调度命令行、代码解释器、浏览器、文件系统、办公软件等工具,完成复杂工作流。例如,在软件开发场景中,模型可自主完成需求分析、代码编写、调试优化、部署配置全流程,生成超10000行代码,交付可直接使用的应用;在办公场景中,可自动完成合同审核、数据汇总、报告生成、邮件发送、日程规划等任务;在浏览器操作场景中,通过插件实现网页感知、自动点击、输入、跳转、数据提取等GUI自动化,无需人工操作即可完成网页数据爬取、表单填写、流程审批等工作。详情👉访问阿里云百炼大模型服务平台页面 了解。
    image.png
    bailian1.png
    bailian2.png

  2. 编程智能体:国内SOTA,全栈开发能力拉满
    编程能力是Qwen3.7-Max的核心优势,在Terminal-Bench 2.0、SWE-Pro、SWE-Multilingual、NL2Repo、SciCode等全球权威编程评测中,多项指标刷新全球最高分,登顶国内SOTA。模型覆盖Python、Java、C++、JavaScript、Go、SQL等主流编程语言,支持前端开发、后端服务、数据库设计、算法实现、自动化脚本编写、测试用例生成等全栈开发需求。其编程智能体能力支持代码解释器实时执行、结果验证与错误修复,可自主排查代码漏洞、优化代码结构、提升运行效率,甚至完成大型项目的代码重构与迭代。

在视觉编程方面,Qwen3.7-Max可将手绘草图、产品原型图、界面截图直接“翻译”为可执行代码,实现“所见即所得”的开发体验。例如,用户上传一张简单的界面草图,模型可在几分钟内生成包含响应式布局、交互事件、样式美化的完整前端代码,无需开发者手动编写基础代码,大幅降低开发门槛与周期。同时,模型支持跨框架泛化,在Claude Code、OpenClaw、Qwen Code等不同框架下均稳定发挥,是各类智能体系统的可靠底座。

  1. 通用智能体:办公+推理+多模态,全场景赋能
    Qwen3.7-Max的通用智能体能力覆盖办公、推理、多模态等全场景,在MCP-Mark、Deep-Planning、SpreadSheetBench等办公与推理基准测试中表现顶尖。在办公场景,模型深度整合Office工作流,可自动生成文档、表格、PPT,完成会议纪要整理、数据报表分析、合同风险排查、财务数据处理等任务,SpreadSheetBench评测得分达84.5,处于全球顶尖水平。在推理场景,模型具备强大的逻辑推理、数学计算、科学分析能力,在GPQA Diamond(92.2分)、Apex(43.5分)等高难度STEM基准测试中位居全球前列,可解决复杂数学题、物理题、化学题,支持生物序列分析、实验数据处理、论文撰写与文献综述。

多模态方面,Qwen3.7-Max原生支持文本、图片、视频、音频、网页等多模态输入,可精准识别图像中的物体、场景、文字、图表、界面元素,理解复杂视觉逻辑,支持OCR文字提取、图表数据解析、设计图解读、屏幕内容识别等功能。与普通多模态模型不同,其视觉能力并非仅用于问答,而是作为智能体的“眼睛”,为后续任务执行提供感知基础。例如,用户上传产品原型图,模型可自动解析布局、元素、交互逻辑;上传软件报错截图,可识别错误信息、分析原因并给出解决方案;上传数据图表,可提取数据、生成分析报告并完成可视化优化,实现从视觉感知到信息处理的无缝衔接。

  1. 极致指令遵循与多语言能力
    Qwen3.7-Max的指令遵循能力在IFBench评测中达81.2分,能精准理解复杂约束条件,严格按照用户要求输出结构化、标准化结果,支持JSON、XML、Markdown等多种格式输出,适配企业级系统集成与自动化流程。多语言方面,模型覆盖119种语言,在WMT24++(85.9分)、MAXIFE(89.3分)等多语言评测中全球领先,可实现跨语言文本生成、翻译与交互,满足全球化应用需求。

三、接入与使用:多路径快速部署,开发者友好

Qwen3.7-Max提供多样化接入方式,普通用户可直接体验,开发者与企业可通过API快速集成,同时支持本地部署与二次开发,适配不同场景需求。

  1. 直接交互体验
    普通用户可通过通义千问官方平台、千问办公等产品直接选择Qwen3.7-Max模型,开启多模态交互。支持文本输入、图片/视频上传、多轮对话,可自由切换思考模式,调整输出参数(如温度、最大Tokens),满足创意生成、严谨分析、任务执行等不同需求。浏览器用户可安装Qwen for Chrome插件,开启网页智能体模式,实现网页内容感知与自动化操作。

  2. API接入开发(Python示例)
    开发者可通过阿里云Model Studio平台调用Qwen3.7-Max API,模型兼容OpenAI协议,支持零摩擦迁移,仅需修改基础地址与API密钥即可快速接入。以下是完整的Python调用示例,涵盖文本对话、代码生成、工具调用与隐式缓存功能:
    ```python
    import os
    from openai import OpenAI

初始化客户端(兼容OpenAI协议,自动启用隐式缓存)

client = OpenAI(
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
api_key=os.getenv("DASHSCOPE_API_KEY") # 从环境变量获取API密钥
)

1. 基础文本对话调用(思考模式)

def text_chat_with_thinking():
messages = [
{"role": "user", "content": "请详细介绍Qwen3.7-Max的核心技术架构与功能优势"}
]
response = client.chat.completions.create(
model="qwen3.7-max",
messages=messages,
temperature=0.7, # 控制输出多样性
max_tokens=8192, # 最大输出长度
stream=True # 流式输出
)

# 流式打印响应结果
for chunk in response:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="")

2. 代码生成与执行调用(开启代码解释器)

def code_generation():
messages = [
{"role": "user", "content": "用Python实现一个分布式任务调度框架,包含任务添加、执行、状态监控与故障恢复功能"}
]
response = client.chat.completions.create(
model="qwen3.7-max",
messages=messages,
tools=[{"type": "code_interpreter"}], # 开启代码解释器
temperature=0.3 # 降低温度,保证代码严谨性
)
print("\n代码生成结果:", response.choices[0].message.content)

3. 智能体工具调用示例(文件系统操作)

def agent_tool_call():
messages = [
{"role": "user", "content": "请分析当前目录下的所有Python文件,找出代码漏洞并生成修复方案,同时生成测试用例"}
]

# 定义可用工具(文件系统、命令行等)
tools = [
    {
        "type": "function",
        "function": {
            "name": "execute_command",
            "description": "执行系统命令",
            "parameters": {
                "type": "object",
                "properties": {
                    "command": {"type": "string", "description": "要执行的命令"}
                },
                "required": ["command"]
            }
        }
    },
    {
        "type": "function",
        "function": {
            "name": "read_file",
            "description": "读取文件内容",
            "parameters": {
                "type": "object",
                "properties": {
                    "file_path": {"type": "string", "description": "文件路径"}
                },
                "required": ["file_path"]
            }
        }
    }
]
response = client.chat.completions.create(
    model="qwen3.7-max",
    messages=messages,
    tools=tools,
    tool_choice="auto"  # 自动选择工具
)
print("\n智能体工具调用响应:", response.choices[0].message.content)

4. 隐式缓存功能演示(重复上下文自动缓存,速度更快、费用更低)

def implicit_cache_demo():

# 第一次调用(无缓存)
messages1 = [{"role": "user", "content": "解释MoE架构的工作原理与优势"}]
response1 = client.chat.completions.create(model="qwen3.7-max", messages=messages1)
print("第一次调用响应:", response1.choices[0].message.content[:100] + "...")

# 第二次调用(相同上下文,自动启用缓存)
messages2 = [{"role": "user", "content": "解释MoE架构的工作原理与优势"}]
response2 = client.chat.completions.create(model="qwen3.7-max", messages=messages2)
print("第二次调用(缓存)响应:", response2.choices[0].message.content[:100] + "...")

执行示例

if name == "main":
print("=== 文本对话(思考模式) ===")
text_chat_with_thinking()
print("\n" + "="*80 + "\n")

print("=== 代码生成与执行 ===")
code_generation()
print("\n" + "="*80 + "\n")

print("=== 智能体工具调用 ===")
agent_tool_call()
print("\n" + "="*80 + "\n")

print("=== 隐式缓存功能演示 ===")
implicit_cache_demo()

```
此外,模型支持批量推理、结构化输出、函数调用、多轮对话等高级功能,可进一步提升调用效率与稳定性,满足企业级高并发场景需求。

四、应用价值与场景:全行业赋能,重塑生产力

Qwen3.7-Max凭借全能的智能体能力、顶尖的编程与推理性能、高效的推理效率,为多个行业带来生产力革新。在软件开发领域,大幅缩短开发周期、降低门槛,助力快速构建复杂应用,从前端原型到后端服务全流程覆盖;在企业办公领域,实现流程自动化、智能化,减少重复性工作,提升团队效率,覆盖文档处理、数据报表、合同管理、会议协作等全场景;在产品设计领域,通过视觉编程实现“草图到代码”的一键转化,加速产品落地;在内容创作领域,快速生成高质量图文、视频脚本、创意内容,支持多语言与多模态输出;在教育、科研、金融、法律、医疗等专业领域,提供精准的专业支持与决策辅助,解决复杂问题。

同时,Qwen3.7-Max通过隐式缓存、MoE架构优化等技术,大幅降低推理成本,兼顾能力与性价比,让更多企业与开发者能够负担得起旗舰级AI能力,加速AI技术的普及与落地。个人用户可在通义千问网页端与APP免费使用核心功能,享受旗舰级AI服务。

五、总结

通义千问Qwen3.7-Max以万亿级MoE混合专家架构、百万Token超长上下文、35小时连续自主执行与顶尖编程推理能力,重新定义了旗舰级通用AI代理的标准。它打破了传统大模型“理解”与“执行”的割裂,实现从文本理解到复杂任务全流程自主执行的跃迁,成为连接AI技术与实际应用的重要桥梁。无论是个人用户、开发者还是企业,Qwen3.7-Max都能提供高效、稳定、全能的AI能力支撑,推动各行业数字化、智能化转型,释放AI的真正生产力价值。

目录
相关文章
|
1月前
|
人工智能 安全 API
最新版通义千问(Qwen3.8-Max)功能介绍
在人工智能大模型技术快速迭代的当下,通义千问推出的Qwen3.8-Max凭借突破性的技术架构与全面升级的能力,成为大模型领域的全新标杆。作为通义千问系列迄今规模最大、能力最强的旗舰模型,Qwen3.8-Max以2.4万亿总参数的体量,结合前沿稀疏混合专家(MoE)架构,在保持高效推理的同时,实现了文本理解、代码生成、多模态交互、长周期任务执行等核心能力的跨越式提升,为个人用户、开发者与企业级应用提供了前所未有的AI能力支撑。
349 1
|
1月前
|
人工智能 缓存 自然语言处理
深度解析 Qwen3.7-Flash:百万上下文 + 多模态感知,轻量 AI 的全能之选
在大模型从“单一文本交互”迈向“多模态融合+智能体执行”的时代,轻量化、高性价比成为AI落地的关键诉求。阿里云推出的Qwen3.7-Flash,作为Qwen3.7系列中的轻量型旗舰,凭借**低延迟、高吞吐、低成本**的核心优势,以及全面升级的多模态理解与智能体执行能力,重新定义了轻量级大模型的性能标准。它不仅保留了百万Token超长上下文的强大记忆能力,更在多模态感知、编码能力、智能体自治与推理效率上实现突破,成为个人开发者、中小企业与高并发场景的理想AI基座,兼顾能力与成本,让AI技术普惠化落地成为现实。
249 0
|
1月前
|
安全 小程序 开发者
最新版阿里云域名优惠口令及优惠口令获取方法
域名作为互联网的基础入口,是个人与企业数字化建设的核心资产,而域名注册、续费的成本控制,始终是站长、开发者与企业主关注的重点。阿里云作为国内领先的域名服务提供商,持续推出域名优惠口令,覆盖.com、.cn、.xin等主流后缀的注册、续费场景,帮助用户大幅降低域名持有成本。本文将全面梳理最新阿里云域名优惠口令、多渠道获取方法、详细使用步骤、核心使用规则,以及常见问题与避坑指南,让你快速掌握阿里云域名优惠口令的全流程操作,实现域名成本最优管控。
479 0
|
6天前
|
缓存 人工智能 API
最新版阿里云通义千问大模型功能介绍:Qwen3.8全系列能力拆解、API实操、计费与选型全指南
大模型产业已经从早期简单问答时代,演进到长文本处理、原生多模态理解、长周期智能体自主执行、工程化代码开发的新阶段。通义千问作为国产主流基座大模型,持续迭代推出Qwen3.8完整产品矩阵,包含Max、Flash等多个版本,覆盖旗舰高性能、高性价比高速推理等不同定位,同时提供百万级上下文窗口、深度思考推理、图文视频多模态输入、函数工具调用、上下文缓存、结构化输出等全套能力,既可以用于网页端直接对话,也可以通过API接口集成到业务系统、Agent开发框架、各类AI开发工具当中,覆盖个人开发者、科研机构、中小企业、大型企业多元业务需求。
319 0
|
1月前
|
机器学习/深度学习 人工智能 自然语言处理
2026测试人必备的"AI驯化"技能树:少了这个能力,简历直接被筛掉
2026年测试工程师正经历能力重构:从“写用例”迈向“驯化AI”。手工测试岗需求降47%,而懂AI Agent、Prompt工程、Skill封装、MCP协议与RAG知识工程的测试人才薪资高30%–50%,成大厂抢手对象。核心转变是——测试对象由确定性系统变为智能体,测试本质从“验功能”升级为“验能力”。
|
1月前
|
人工智能 自然语言处理 API
阿里云百炼CLI:一行命令解锁全栈AI能力,Agent原生一站式调用
在AI智能体(Agent)成为主流应用形态的当下,开发者与企业迫切需要一套轻量化、统一化、可脚本化的工具,让AI Agent能高效调用各类大模型与多模态能力,无需在不同平台、不同接口间反复切换。阿里云百炼CLI(命令行工具)正是为此而生,它将百炼平台的150+多模态模型、10+类AI应用服务、知识库、记忆管理、联网搜索等核心能力,封装为一套简洁、一致的命令行接口,让Agent只需一行命令,即可完成从文本生成、图像创作、视频制作到语音处理、知识检索的全链路AI操作。百炼CLI以“Agent原生”为设计核心,原生兼容主流AI Agent框架,支持跨平台运行,彻底打通AI能力调用的最后一公里,成为开
134 2
|
1月前
|
存储 人工智能 安全
阿里云OSS:对象存储全栈升级,AI原生多模态数据统一底座
在数字化转型与AI应用爆发的时代,企业数据呈现出海量、多模态、高增长的特征,传统存储方案面临成本高昂、扩展性不足、检索效率低、AI适配性差等多重挑战。阿里云对象存储服务(OSS)作为云原生存储的核心产品,历经多轮技术迭代,已从单一的对象存储进化为覆盖非结构化数据、向量数据、结构化数据的AI原生统一存储底座。最新版OSS全面升级,推出Table Bucket、向量Bucket、新版MetaQuery、OSS加速器等核心功能,融合对象存储的低成本、高扩展优势与数据湖、向量检索、结构化管理能力,为企业提供从数据存储、管理、检索到AI应用的全链路解决方案,成为企业构建数据湖、支撑AI训练、实现数据价值
202 2
|
1月前
|
人工智能 自然语言处理 API
阿里云百炼Token Plan:统一Credits计费,全栈AI能力订阅新选择
在AI开发与智能体应用快速普及的当下,开发者与企业面临两大核心痛点:一是多模型调用成本高、计费复杂,不同模型、不同能力需单独付费,成本核算与管控难度大;二是AI工具生态分散,主流编程与智能体工具需分别配置不同平台的API Key,切换繁琐、效率低下。阿里云百炼Token Plan正是为解决这些痛点而生,它以**统一Credits计量**为核心,整合百炼平台全栈AI能力,提供个人版与团队版双版本订阅服务,兼容主流AI编程与智能体工具,实现“一份订阅、全能力调用、成本可控、管理便捷”,成为个人开发者与企业团队使用AI能力的首选订阅方案。
232 1
|
1月前
|
人工智能 编解码 JSON
ComfyUI AI漫剧工业化量产技术方案|基于FLUX+Wan2.2本地二次元短剧全链路落地教程
本方案基于ComfyUI本地部署,整合FLUX+Wan2.2轻量化模型,专治AI漫剧五大痛点:人设变脸、画风混乱、镜头闪烁、水印限制、量产成本高。支持8G显卡,实现风格统一、人设稳定、零水印、全自动批量成片,适配二次元短剧与自媒体创作。(239字)

热门文章

最新文章