最新版通义千问(Qwen3.7-Plus)功能介绍

简介: 作为通义千问3.7系列的中端主力旗舰,Qwen3.7-Plus以35B稠密参数架构为核心,定位“高性价比多模态智能体基座”,彻底打破传统多模态模型“只能看懂、无法做事”的局限。它原生统一文本、图片、截图、短视频、网页五大输入形态,打通GUI可视化界面与CLI命令行双操作环境,实现“看、想、写、做、验”全流程闭环,在全球多模态评测榜单跻身前五、国产榜单登顶,标志国产多模态AI从“内容解析”迈向“自主执行”的关键跨越。相比同系列旗舰Max,它以更轻量化的参数、更低的使用成本,实现了接近旗舰的多模态与智能体能力,成为个人开发者、中小企业与行业数字化场景的首选AI基座。

作为通义千问3.7系列的中端主力旗舰,Qwen3.7-Plus以35B稠密参数架构为核心,定位“高性价比多模态智能体基座”,彻底打破传统多模态模型“只能看懂、无法做事”的局限。它原生统一文本、图片、截图、短视频、网页五大输入形态,打通GUI可视化界面与CLI命令行双操作环境,实现“看、想、写、做、验”全流程闭环,在全球多模态评测榜单跻身前五、国产榜单登顶,标志国产多模态AI从“内容解析”迈向“自主执行”的关键跨越。相比同系列旗舰Max,它以更轻量化的参数、更低的使用成本,实现了接近旗舰的多模态与智能体能力,成为个人开发者、中小企业与行业数字化场景的首选AI基座。

一、核心架构:35B稠密设计,平衡性能与落地效率

Qwen3.7-Plus采用35B稠密参数架构,区别于旗舰Max的万亿级MoE稀疏设计,这种架构让模型在保持强大能力的同时,拥有更稳定的推理性能、更低的算力消耗与更亲民的使用成本,完美适配大规模落地场景。模型预训练数据量高达36万亿Tokens,覆盖119种语言,涵盖文本、图像、视频、代码、专业文档等多元数据,构建了深厚的知识与能力底座。详情👉访问阿里云百炼大模型服务平台页面 了解。
image.png
bailian1.png
bailian2.png

在上下文处理能力上,Qwen3.7-Plus支持100万Tokens超大上下文窗口,最长可输出64万Tokens内容,相当于可一次性完整处理整本书籍、整套项目源码、数百页行业报告或长篇合同,无需拆分分段,大幅提升长文档处理效率。同时,模型内置高效缓存机制,可缓存长上下文请求的公共前缀,减少重复计算,进一步提升响应速度并降低使用成本。

技术层面,Qwen3.7-Plus延续通义千问系列的双推理机制,支持思考模式与快速模式自由切换。思考模式适用于复杂推理、代码开发、高精度文档解析等场景,模拟人类分步思考、逐层推演、自主校验,确保输出精准可靠;快速模式则针对轻量化批量生成、日常问答等场景,精简推理链路,响应速度提升2倍,同等额度调用量可翻2-3倍,让用户在精度与效率间自由取舍。

二、核心能力:四大维度突破,实现多模态全链路执行

(一)多模态统一理解:从图文到视频,全域感知无死角

Qwen3.7-Plus是通义千问系列中唯一同时支持文本、图片、视频三种模态的主力模型,原生实现多模态信息的统一编码与深度理解,无需依赖外部插件。在视觉处理方面,单图支持1600万像素高清输入,一次最多可处理2048张图片,可精准识别图像中的文字、图表、场景、界面、工程图纸等复杂内容,OCR准确率与视觉推理能力位居全球前列。详情👉访问阿里云百炼大模型服务平台页面 了解。
image.png
bailian1.png
bailian2.png

针对视频内容,模型最长支持2小时视频输入,可同时处理64个视频素材,实现关键帧提取、内容理解、人物追踪、事件梳理、字幕生成等全流程处理,可围绕人物、事件、时间、场景构建视频记忆,精准解析长视频中的复杂逻辑与信息关联。此外,模型还支持音频输入,可完成语音转文字、情感分析、内容摘要、语音指令理解等功能,真正实现“能看、能听、能理解”的全模态感知。

(二)GUI+CLI混合操作:从屏幕到命令,自主执行闭环

Qwen3.7-Plus最核心的突破,是成为国内首款实现“看图识屏+自主操控+代码执行”一体化的混合智能体,打通GUI可视化界面与CLI命令行双操作环境,让AI从“被动问答”升级为“主动执行”。它能精准识别桌面端、移动端的各类界面,定位按钮、输入框、菜单等控件,理解界面逻辑与交互规则,自主规划操作步骤并执行多步骤任务,例如自动操作APP完成注册、下单、数据导出等流程。

同时,模型可无缝衔接CLI命令行操作,根据视觉内容或文本指令,自动生成Shell、Python、SQL等命令并执行,实现从界面操作到系统命令的全链路打通。在实测案例中,模型曾稳定运行11小时,自主完成从需求分析、界面设计、代码编写到测试部署的全流程,生成超过1万行代码,独立交付完整的英语学习APP,展现出强大的长程自主执行能力。

(三)全栈视觉编程:从草图到项目,视觉到代码一键转化

视觉编程是Qwen3.7-Plus的差异化核心优势,也是同价位模型中独有的能力。它可直接根据产品草图、界面截图、设计稿等视觉素材,自动生成完整的前端代码(HTML/CSS/JavaScript)、后端逻辑、数据库设计与接口文档,实现从视觉灵感到可执行代码的端到端转化。无论是简单的网页原型、复杂的管理系统界面,还是SVG动画、交互式组件,模型都能精准还原视觉设计,并生成可直接运行的工程代码。

模型内置Code Interpreter工具,可直接执行生成的代码,输出运行结果并进行调试优化,支持复杂算法验证、数据可视化与功能测试。以下是通过DashScope API调用Qwen3.7-Plus视觉编程能力的示例代码:

import os
import dashscope

# 配置API密钥与基础URL
dashscope.api_key = os.getenv("DASHSCOPE_API_KEY")
dashscope.base_http_api_url = "https://dashscope.aliyuncs.com/api/v1"

# 多模态输入:界面截图+文本指令
messages = [
    {
   
        "role": "user",
        "content": [
            {
   "image": "https://example.com/admin-panel-screenshot.png"},  # 后台管理界面截图
            {
   "text": "根据这张后台管理界面截图,生成完整的HTML+CSS+JavaScript代码,实现页面布局与基础交互功能"}
        ]
    }
]

# 调用多模态对话接口,开启代码解释器
response = dashscope.MultiModalConversation.call(
    model="qwen3.7-plus",
    messages=messages,
    extra_body={
   
        "enable_code_interpreter": True,
        "enable_thinking": True  # 开启思考模式,保证代码精准性
    }
)

# 输出生成的代码
print(response.output.choices[0].message.content[0]["text"])

此外,模型支持函数调用功能,可将大模型与外部工具、API接口、数据库无缝连接,实现代码与真实业务系统的联动开发,满足企业级工程化需求。

(四)长程智能体自治:35小时自主运行,千次工具调用

Qwen3.7-Plus具备强大的长程任务自主规划与闭环迭代能力,官方标称可实现35小时自治运行,支持1000+次顺序工具调用,无需人工频繁干预。它能自主拆解复杂任务目标,制定详细执行计划,根据任务需求动态调用代码解释器、联网搜索、文件处理、界面操作等工具,完成子任务后自动验证结果,发现问题并优化方案,形成完整的任务执行闭环。

在复杂推理领域,Qwen3.7-Plus表现同样出色。在AIME数学竞赛测试中,它与旗舰Max答对相同数量的题目,但单题耗时仅113秒,比Max的303秒快近3倍,展现出稠密架构在推理效率上的优势。模型可精准求解复杂数学题、进行逻辑推演、分析科研数据、制定决策方案,思考模式下可展示完整推理步骤,大幅降低幻觉生成率,确保输出结果的可靠性与可追溯性。

三、应用场景:全领域覆盖,赋能各行业数字化升级

(一)软件开发与IT运维

为开发者提供全栈开发支持,从需求文档生成、架构设计、代码编写到测试部署,一站式完成项目交付;可根据界面草图自动生成前端代码,辅助后端逻辑开发、数据库设计与接口文档编写;在IT运维场景,可分析系统日志、定位故障原因、生成运维脚本,实现智能运维自动化,大幅提升开发与运维效率。

(二)企业办公与自动化

助力企业实现办公流程智能化,自动处理合同审阅、财报分析、报表生成、会议纪要整理等工作;可自动操作办公软件完成数据录入、格式转换、内容汇总等重复任务;作为智能办公助手,整合协作工具,实现任务自动分配、进度跟踪与结果汇总,提升企业办公效率与数字化水平。

(三)内容创作与多媒体制作

支持文本、图像、视频的全模态内容创作,自动生成营销文案、短视频脚本、新闻稿件、小说故事;可根据图文素材自动剪辑视频、生成字幕与配音;在设计领域,辅助UI设计、海报制作、插画生成,满足多样化内容生产需求,降低内容创作门槛。

(四)行业数字化与专业服务

在金融领域,提供量化策略编写、风险评估、投资分析、财报解读等服务;在法律领域,辅助合同起草、法律条文检索、案件分析、法律文书生成;在教育领域,可根据教材内容生成教案、习题、课件,辅助个性化教学;在医疗领域,辅助医学文献分析、病例解读、医疗报告生成,提升专业服务效率与准确性。

(五)智能体与自动化系统

作为智能体基座,可部署于各类自动化系统,实现从感知、决策到执行的全流程自主化。例如,在电商场景中,自主完成市场分析、选品、定价、营销、订单处理、复盘优化;在工业场景中,辅助设备监控、故障诊断、生产流程优化;在智能家居场景中,实现多设备联动控制与场景自动化,推动各行业智能化升级。

四、使用方式:多入口接入,快速上手模型能力

Qwen3.7-Plus提供多种接入方式,满足不同用户的使用需求,无论是个人体验还是企业级集成,都能快速上手:

  1. 网页端直接体验:访问通义千问官网,选择Qwen3.7-Plus模型,即可直接进行文本、图像、视频交互,无需开发基础,适合个人用户快速体验模型的多模态与智能体能力。
  2. API接口调用:通过DashScope API接入,支持Python、Node.js等多种SDK,兼容OpenAI协议,方便开发者快速集成到自有应用中。获取API Key后,配置环境变量即可调用,以下是基础文本生成与多模态调用的示例代码:
    ```python

    基础文本生成示例(兼容OpenAI SDK)

    import os
    from openai import OpenAI

client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)

response = client.chat.completions.create(
model="qwen3.7-plus",
messages=[{"role": "user", "content": "分析Qwen3.7-Plus在企业数字化转型中的核心应用价值"}]
)

print(response.choices[0].message.content)

多模态对话示例(DashScope原生SDK)

import dashscope

dashscope.api_key = os.getenv("DASHSCOPE_API_KEY")

messages = [
{
"role": "user",
"content": [
{"image": "https://example.com/product-chart.png"}, # 产品数据图表
{"text": "分析这张图表中的数据趋势,并生成一份数据报告"}
]
}
]

response = dashscope.MultiModalConversation.call(
model="qwen3.7-plus",
messages=messages
)

print(response.output.choices[0].message.content[0]["text"])
```

  1. 企业级智能体平台:配套千问办公平台,将本地电脑操作、云端长任务与企业协作整合,提供可视化任务管理、专家套件、定时任务等功能,适合企业团队部署智能体应用,实现规模化自动化办公。

五、总结:Qwen3.7-Plus,高性价比多模态智能体的最优解

Qwen3.7-Plus以35B稠密参数架构、100万Tokens上下文、全模态统一输入与GUI+CLI混合操作能力,构建了高性价比多模态智能体的全新标杆。它跳出传统多模态模型的局限,实现从“看懂内容”到“自主做事”的跨越,以接近旗舰的能力、更低的成本,为个人开发者、中小企业与各行业提供强大的AI生产力支撑。

无论是软件开发、企业办公、内容创作还是行业数字化,Qwen3.7-Plus都能提供端到端的解决方案,助力用户快速实现智能化升级。随着模型能力的持续迭代与生态的不断完善,Qwen3.7-Plus将成为多模态AI落地的主流选择,推动通用人工智能在各领域的规模化应用,开启智能体时代的全新发展阶段。

目录
相关文章
|
1月前
|
文字识别 自然语言处理 监控
阿里云Qwen3.7 Max与Plus实测全对比:多模态、性能、成本、选型完整解析
2026年阿里云推出Qwen3.7两大主力商用模型Max、Plus,两款产品统一拥有100万Token超长上下文、35小时长时自治执行能力,但底层架构、模态支持、输出上限、推理速度、计费成本存在根本性区分,分别适配纯文本重度推理、多模态综合业务两大赛道。本文基于官方实测数据,从底层架构、模态能力、文本/代码/数学性能、计费成本、落地场景五大维度完整对比,给出清晰选型标准,帮助个人开发者、中小企业、政企团队精准匹配模型。
741 5
|
2月前
|
缓存 人工智能 文字识别
阿里云Qwen 3.7 Plus与Max全解析:资费、消耗、配置与多模态能力深度对比
阿里云Qwen 3.7系列包含Plus与Max两款核心模型,共享100万Tokens超长上下文窗口与35小时自治执行上限,但在模态能力、底层架构、输出上限与资费标准上存在本质差异,分别面向不同量级与类型的AI应用场景。
972 0
|
25天前
|
人工智能 运维 安全
阿里云通义千问大模型全系深度解析:全模态大模型功能、定价、API完整实战教程
随着人工智能产业全面落地,通用大模型已经从单纯对话工具进化为企业数字化、个人提效的核心算力基座。通义千问作为阿里云自研国产通用大模型,迭代形成完整Qwen3全系产品矩阵,覆盖轻量极速、均衡通用、旗舰推理、原生多模态四大梯度,依托百炼平台弹性算力支撑文本处理、全栈代码、图文视频解析、自主智能体等复合任务。本文完整拆解全系模型核心功能、六大性能优势、分层定价规则、多渠道上手教程,附带Python、cURL、运维全套可运行代码,覆盖个人创作者、开发团队、政企单位全部使用场景,全程无复杂前置门槛,兼顾轻量化试用与规模化商用部署需求。
4909 3
|
29天前
|
人工智能 自然语言处理 文字识别
阿里云Qwen3.7 Max与Plus全维度实测对比:多模态能力、架构、资费与选型指南
阿里云百炼平台推出的Qwen3.7系列包含Max、Plus两款商用核心模型,二者共享100万tokens超长上下文窗口、35小时自治执行上限两大核心基础能力,能够一次性承载百万字符文档、完整代码仓库、连续数十小时长流程智能体任务,但在底层架构、模态支持、输出上限、推理速度、计费标准上存在根本性区分,分别面向两类完全不同的AI业务赛道:极致纯文本重度推理场景、多模态图文视频综合业务场景。
380 2
|
22天前
|
人工智能 数据可视化 数据挖掘
Quick BI AIPro 全新发布,让数据成为企业增长引擎!
阿里云Quick BI AIPro正式发布!AI-native架构全新升级,支持自然语言对话分析,5大能力进化:深度分析、业务理解、行动推动、可信追溯、组织协同。首月赠12.5万Credits,0成本快速上手,存量客户无缝升级,新用户上传数据即用。立即免费试用!
201 0
|
21天前
|
人工智能 JSON 自然语言处理
跨层禁止:机器如何拦截非法语义绑定
跨层禁止给颜色挂禁用表,三层防线:入库查绑定、代码查引用、生成实时拦。AI越界用红色即阻断并建议换黄色。A/B验证:同一Prompt,有契约AI从红色变黄色。
跨层禁止:机器如何拦截非法语义绑定
|
22天前
|
人工智能 运维 自然语言处理
最新版通义千问(Qwen3.8-Max)功能介绍
作为通义千问系列迄今规模最大、性能最强的旗舰模型,Qwen3.8-Max凭借2.4万亿总参数的MoE混合专家架构、100万Token上下文窗口与原生多模态能力,实现了从“辅助工具”到“自主智能体”的跨越。它不仅在代码工程、专业办公、复杂推理等核心领域实现跨越式升级,更以端到端交付生产级成果的能力,成为面向智能体时代的通用AI基座,为个人开发者、企业团队与科研机构提供前所未有的AI生产力支撑。
321 1
|
22天前
|
存储 自然语言处理 安全
从模型智能到系统可信:Quick BI AIPro的 AI-native BI架构
阿里云Quick BI AIPro正式发布,首创AI-native BI架构,以7道可信防线保障数据安全与分析准确。支持自然语言交互,首月赠12.5万Credits,0成本开启企业级智能分析。
167 0
|
27天前
|
缓存 自然语言处理 前端开发
最新版通义千问(Qwen3.7-Plus)功能介绍
通义千问Qwen3.7-Plus是Qwen3.7系列中主打高性价比与全场景落地的主力旗舰模型,定位为**多模态交互混合智能体**,以35B稠密参数架构为基础,在保留接近Max级纯文本与编程能力的同时,实现了视觉-语言能力的全面升级,原生打通文本、图片、截图、短视频、网页五大输入形态,支持GUI可视化界面与CLI命令行双环境操作,真正实现“看、想、写、做、验”的全流程任务闭环。它不仅在BabyVision、Vision Arena等多模态评测中登顶国产第一、跻身全球前五,更以11小时连续自治开发App、1000+次工具调用的实战能力,成为多模态智能体落地的首选基座。本文将从核心技术架构、全栈功能
321 2
|
2月前
|
人工智能 缓存 运维
阿里云百炼通义千问Qwen3.7-Plus完整指南:全维度功能特性、落地优势与优惠订阅方案实操手册
AI应用规模化落地进程中,绝大多数企业与开发者面临性能与成本难以平衡的核心难题:轻量化模型推理、图文解析、长文档处理能力不足,无法支撑中等复杂度智能体任务;旗舰级模型长期高频调用成本偏高,中小团队难以持续投入算力预算。依托自研通义千问技术体系打造的Qwen3.7-Plus,是阿里云百炼平台推出的中端全能型多模态大模型,精准填补轻量化模型与旗舰模型之间的市场空白,在保留百万级上下文、原生图文多模态、全链路工具调用、通用代码生成全套核心能力的基础上,大幅下调调用单价,适配个人开发者、小微创业团队、中小企业全层级使用需求。
921 1