最新版通义千问(Qwen3.7-Plus)功能介绍

简介: 作为通义千问3.7系列的中端主力旗舰,Qwen3.7-Plus以35B稠密参数架构为核心,定位“高性价比多模态智能体基座”,彻底打破传统多模态模型“只能看懂、无法做事”的局限。它原生统一文本、图片、截图、短视频、网页五大输入形态,打通GUI可视化界面与CLI命令行双操作环境,实现“看、想、写、做、验”全流程闭环,在全球多模态评测榜单跻身前五、国产榜单登顶,标志国产多模态AI从“内容解析”迈向“自主执行”的关键跨越。相比同系列旗舰Max,它以更轻量化的参数、更低的使用成本,实现了接近旗舰的多模态与智能体能力,成为个人开发者、中小企业与行业数字化场景的首选AI基座。

作为通义千问3.7系列的中端主力旗舰,Qwen3.7-Plus以35B稠密参数架构为核心,定位“高性价比多模态智能体基座”,彻底打破传统多模态模型“只能看懂、无法做事”的局限。它原生统一文本、图片、截图、短视频、网页五大输入形态,打通GUI可视化界面与CLI命令行双操作环境,实现“看、想、写、做、验”全流程闭环,在全球多模态评测榜单跻身前五、国产榜单登顶,标志国产多模态AI从“内容解析”迈向“自主执行”的关键跨越。相比同系列旗舰Max,它以更轻量化的参数、更低的使用成本,实现了接近旗舰的多模态与智能体能力,成为个人开发者、中小企业与行业数字化场景的首选AI基座。

一、核心架构:35B稠密设计,平衡性能与落地效率

Qwen3.7-Plus采用35B稠密参数架构,区别于旗舰Max的万亿级MoE稀疏设计,这种架构让模型在保持强大能力的同时,拥有更稳定的推理性能、更低的算力消耗与更亲民的使用成本,完美适配大规模落地场景。模型预训练数据量高达36万亿Tokens,覆盖119种语言,涵盖文本、图像、视频、代码、专业文档等多元数据,构建了深厚的知识与能力底座。详情👉访问阿里云百炼大模型服务平台页面 了解。
image.png
bailian1.png
bailian2.png

在上下文处理能力上,Qwen3.7-Plus支持100万Tokens超大上下文窗口,最长可输出64万Tokens内容,相当于可一次性完整处理整本书籍、整套项目源码、数百页行业报告或长篇合同,无需拆分分段,大幅提升长文档处理效率。同时,模型内置高效缓存机制,可缓存长上下文请求的公共前缀,减少重复计算,进一步提升响应速度并降低使用成本。

技术层面,Qwen3.7-Plus延续通义千问系列的双推理机制,支持思考模式与快速模式自由切换。思考模式适用于复杂推理、代码开发、高精度文档解析等场景,模拟人类分步思考、逐层推演、自主校验,确保输出精准可靠;快速模式则针对轻量化批量生成、日常问答等场景,精简推理链路,响应速度提升2倍,同等额度调用量可翻2-3倍,让用户在精度与效率间自由取舍。

二、核心能力:四大维度突破,实现多模态全链路执行

(一)多模态统一理解:从图文到视频,全域感知无死角

Qwen3.7-Plus是通义千问系列中唯一同时支持文本、图片、视频三种模态的主力模型,原生实现多模态信息的统一编码与深度理解,无需依赖外部插件。在视觉处理方面,单图支持1600万像素高清输入,一次最多可处理2048张图片,可精准识别图像中的文字、图表、场景、界面、工程图纸等复杂内容,OCR准确率与视觉推理能力位居全球前列。详情👉访问阿里云百炼大模型服务平台页面 了解。
image.png
bailian1.png
bailian2.png

针对视频内容,模型最长支持2小时视频输入,可同时处理64个视频素材,实现关键帧提取、内容理解、人物追踪、事件梳理、字幕生成等全流程处理,可围绕人物、事件、时间、场景构建视频记忆,精准解析长视频中的复杂逻辑与信息关联。此外,模型还支持音频输入,可完成语音转文字、情感分析、内容摘要、语音指令理解等功能,真正实现“能看、能听、能理解”的全模态感知。

(二)GUI+CLI混合操作:从屏幕到命令,自主执行闭环

Qwen3.7-Plus最核心的突破,是成为国内首款实现“看图识屏+自主操控+代码执行”一体化的混合智能体,打通GUI可视化界面与CLI命令行双操作环境,让AI从“被动问答”升级为“主动执行”。它能精准识别桌面端、移动端的各类界面,定位按钮、输入框、菜单等控件,理解界面逻辑与交互规则,自主规划操作步骤并执行多步骤任务,例如自动操作APP完成注册、下单、数据导出等流程。

同时,模型可无缝衔接CLI命令行操作,根据视觉内容或文本指令,自动生成Shell、Python、SQL等命令并执行,实现从界面操作到系统命令的全链路打通。在实测案例中,模型曾稳定运行11小时,自主完成从需求分析、界面设计、代码编写到测试部署的全流程,生成超过1万行代码,独立交付完整的英语学习APP,展现出强大的长程自主执行能力。

(三)全栈视觉编程:从草图到项目,视觉到代码一键转化

视觉编程是Qwen3.7-Plus的差异化核心优势,也是同价位模型中独有的能力。它可直接根据产品草图、界面截图、设计稿等视觉素材,自动生成完整的前端代码(HTML/CSS/JavaScript)、后端逻辑、数据库设计与接口文档,实现从视觉灵感到可执行代码的端到端转化。无论是简单的网页原型、复杂的管理系统界面,还是SVG动画、交互式组件,模型都能精准还原视觉设计,并生成可直接运行的工程代码。

模型内置Code Interpreter工具,可直接执行生成的代码,输出运行结果并进行调试优化,支持复杂算法验证、数据可视化与功能测试。以下是通过DashScope API调用Qwen3.7-Plus视觉编程能力的示例代码:

import os
import dashscope

# 配置API密钥与基础URL
dashscope.api_key = os.getenv("DASHSCOPE_API_KEY")
dashscope.base_http_api_url = "https://dashscope.aliyuncs.com/api/v1"

# 多模态输入:界面截图+文本指令
messages = [
    {
   
        "role": "user",
        "content": [
            {
   "image": "https://example.com/admin-panel-screenshot.png"},  # 后台管理界面截图
            {
   "text": "根据这张后台管理界面截图,生成完整的HTML+CSS+JavaScript代码,实现页面布局与基础交互功能"}
        ]
    }
]

# 调用多模态对话接口,开启代码解释器
response = dashscope.MultiModalConversation.call(
    model="qwen3.7-plus",
    messages=messages,
    extra_body={
   
        "enable_code_interpreter": True,
        "enable_thinking": True  # 开启思考模式,保证代码精准性
    }
)

# 输出生成的代码
print(response.output.choices[0].message.content[0]["text"])

此外,模型支持函数调用功能,可将大模型与外部工具、API接口、数据库无缝连接,实现代码与真实业务系统的联动开发,满足企业级工程化需求。

(四)长程智能体自治:35小时自主运行,千次工具调用

Qwen3.7-Plus具备强大的长程任务自主规划与闭环迭代能力,官方标称可实现35小时自治运行,支持1000+次顺序工具调用,无需人工频繁干预。它能自主拆解复杂任务目标,制定详细执行计划,根据任务需求动态调用代码解释器、联网搜索、文件处理、界面操作等工具,完成子任务后自动验证结果,发现问题并优化方案,形成完整的任务执行闭环。

在复杂推理领域,Qwen3.7-Plus表现同样出色。在AIME数学竞赛测试中,它与旗舰Max答对相同数量的题目,但单题耗时仅113秒,比Max的303秒快近3倍,展现出稠密架构在推理效率上的优势。模型可精准求解复杂数学题、进行逻辑推演、分析科研数据、制定决策方案,思考模式下可展示完整推理步骤,大幅降低幻觉生成率,确保输出结果的可靠性与可追溯性。

三、应用场景:全领域覆盖,赋能各行业数字化升级

(一)软件开发与IT运维

为开发者提供全栈开发支持,从需求文档生成、架构设计、代码编写到测试部署,一站式完成项目交付;可根据界面草图自动生成前端代码,辅助后端逻辑开发、数据库设计与接口文档编写;在IT运维场景,可分析系统日志、定位故障原因、生成运维脚本,实现智能运维自动化,大幅提升开发与运维效率。

(二)企业办公与自动化

助力企业实现办公流程智能化,自动处理合同审阅、财报分析、报表生成、会议纪要整理等工作;可自动操作办公软件完成数据录入、格式转换、内容汇总等重复任务;作为智能办公助手,整合协作工具,实现任务自动分配、进度跟踪与结果汇总,提升企业办公效率与数字化水平。

(三)内容创作与多媒体制作

支持文本、图像、视频的全模态内容创作,自动生成营销文案、短视频脚本、新闻稿件、小说故事;可根据图文素材自动剪辑视频、生成字幕与配音;在设计领域,辅助UI设计、海报制作、插画生成,满足多样化内容生产需求,降低内容创作门槛。

(四)行业数字化与专业服务

在金融领域,提供量化策略编写、风险评估、投资分析、财报解读等服务;在法律领域,辅助合同起草、法律条文检索、案件分析、法律文书生成;在教育领域,可根据教材内容生成教案、习题、课件,辅助个性化教学;在医疗领域,辅助医学文献分析、病例解读、医疗报告生成,提升专业服务效率与准确性。

(五)智能体与自动化系统

作为智能体基座,可部署于各类自动化系统,实现从感知、决策到执行的全流程自主化。例如,在电商场景中,自主完成市场分析、选品、定价、营销、订单处理、复盘优化;在工业场景中,辅助设备监控、故障诊断、生产流程优化;在智能家居场景中,实现多设备联动控制与场景自动化,推动各行业智能化升级。

四、使用方式:多入口接入,快速上手模型能力

Qwen3.7-Plus提供多种接入方式,满足不同用户的使用需求,无论是个人体验还是企业级集成,都能快速上手:

  1. 网页端直接体验:访问通义千问官网,选择Qwen3.7-Plus模型,即可直接进行文本、图像、视频交互,无需开发基础,适合个人用户快速体验模型的多模态与智能体能力。
  2. API接口调用:通过DashScope API接入,支持Python、Node.js等多种SDK,兼容OpenAI协议,方便开发者快速集成到自有应用中。获取API Key后,配置环境变量即可调用,以下是基础文本生成与多模态调用的示例代码:
    ```python

    基础文本生成示例(兼容OpenAI SDK)

    import os
    from openai import OpenAI

client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)

response = client.chat.completions.create(
model="qwen3.7-plus",
messages=[{"role": "user", "content": "分析Qwen3.7-Plus在企业数字化转型中的核心应用价值"}]
)

print(response.choices[0].message.content)

多模态对话示例(DashScope原生SDK)

import dashscope

dashscope.api_key = os.getenv("DASHSCOPE_API_KEY")

messages = [
{
"role": "user",
"content": [
{"image": "https://example.com/product-chart.png"}, # 产品数据图表
{"text": "分析这张图表中的数据趋势,并生成一份数据报告"}
]
}
]

response = dashscope.MultiModalConversation.call(
model="qwen3.7-plus",
messages=messages
)

print(response.output.choices[0].message.content[0]["text"])
```

  1. 企业级智能体平台:配套千问办公平台,将本地电脑操作、云端长任务与企业协作整合,提供可视化任务管理、专家套件、定时任务等功能,适合企业团队部署智能体应用,实现规模化自动化办公。

五、总结:Qwen3.7-Plus,高性价比多模态智能体的最优解

Qwen3.7-Plus以35B稠密参数架构、100万Tokens上下文、全模态统一输入与GUI+CLI混合操作能力,构建了高性价比多模态智能体的全新标杆。它跳出传统多模态模型的局限,实现从“看懂内容”到“自主做事”的跨越,以接近旗舰的能力、更低的成本,为个人开发者、中小企业与各行业提供强大的AI生产力支撑。

无论是软件开发、企业办公、内容创作还是行业数字化,Qwen3.7-Plus都能提供端到端的解决方案,助力用户快速实现智能化升级。随着模型能力的持续迭代与生态的不断完善,Qwen3.7-Plus将成为多模态AI落地的主流选择,推动通用人工智能在各领域的规模化应用,开启智能体时代的全新发展阶段。

目录
相关文章
|
7天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1922 6
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
6天前
|
存储 人工智能 关系型数据库
阿里云AI产品与云产品最新组合套餐:Token Plan、AI coding及云服务器和建站等组合优惠价
阿里云推出全新“算力+模型+应用”一站式云与AI组合套餐活动,覆盖从个人开发者到中大型企业的全场景需求。核心亮点为分三档定价的Token Plan订阅服务,支持Qwen3.8-Max-Preview大模型调用,错峰时段最低可享0.2折优惠。活动同步推出AI Coding、智能体部署、云电脑托管、0代码建站等十余类场景化组合,搭配99元/年的普惠云服务器、88元/年的入门数据库等经典特惠产品,还为企业提供1V1定制化AI转型方案,大幅降低了不同用户群体拥抱AI的技术门槛与采购成本。
655 111
|
15天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2571 13
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
7天前
|
人工智能 弹性计算 数据库
阿里云优惠券种类解析:主要券种区别和适用群体及领取和使用指南
2026年阿里云构建了覆盖全用户的七类优惠券,本文逐一拆解了每类优惠券的核心规则、适用人群与使用技巧:大促限定的阶梯满减券分个人、企业双通道,最高可减800元;学生专属300元无门槛券支持全品类通用;按量付费用户可参与消费达标返券形成循环优惠;新用户有低门槛专享满减券尝鲜;老用户可领取系统自动发放的随机福利券;中大型企业迁云可申请最高100万元的专项补贴;云产品通用券还能在活动价基础上实现折上折。不同身份、不同采购场景的用户均可通过精准匹配对应优惠券,最大化享受优惠力度。
464 110
阿里云优惠券种类解析:主要券种区别和适用群体及领取和使用指南
|
13天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
1662 2
|
15天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
1431 2
|
17天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
1517 55
|
2天前
Qoder 一周年 × Qwen3.8-Max 正式上线,多重好礼限时领
8月3日,Qwen3.8-Max 正式上线Qoder,迎来Qoder一周年。新老用户可领800次免费调用,下单再赠2000次;夜间(22:00–08:00)调用5折;邀请好友双方得积分与调用额度。
262 0