最新版通义千问(Qwen3.7-Plus)功能介绍

简介: 作为通义千问3.7系列的中端主力旗舰,Qwen3.7-Plus以35B稠密参数架构为核心,定位“高性价比多模态智能体基座”,彻底打破传统多模态模型“只能看懂、无法做事”的局限。它原生统一文本、图片、截图、短视频、网页五大输入形态,打通GUI可视化界面与CLI命令行双操作环境,实现“看、想、写、做、验”全流程闭环,在全球多模态评测榜单跻身前五、国产榜单登顶,标志国产多模态AI从“内容解析”迈向“自主执行”的关键跨越。相比同系列旗舰Max,它以更轻量化的参数、更低的使用成本,实现了接近旗舰的多模态与智能体能力,成为个人开发者、中小企业与行业数字化场景的首选AI基座。

作为通义千问3.7系列的中端主力旗舰,Qwen3.7-Plus以35B稠密参数架构为核心,定位“高性价比多模态智能体基座”,彻底打破传统多模态模型“只能看懂、无法做事”的局限。它原生统一文本、图片、截图、短视频、网页五大输入形态,打通GUI可视化界面与CLI命令行双操作环境,实现“看、想、写、做、验”全流程闭环,在全球多模态评测榜单跻身前五、国产榜单登顶,标志国产多模态AI从“内容解析”迈向“自主执行”的关键跨越。相比同系列旗舰Max,它以更轻量化的参数、更低的使用成本,实现了接近旗舰的多模态与智能体能力,成为个人开发者、中小企业与行业数字化场景的首选AI基座。

一、核心架构:35B稠密设计,平衡性能与落地效率

Qwen3.7-Plus采用35B稠密参数架构,区别于旗舰Max的万亿级MoE稀疏设计,这种架构让模型在保持强大能力的同时,拥有更稳定的推理性能、更低的算力消耗与更亲民的使用成本,完美适配大规模落地场景。模型预训练数据量高达36万亿Tokens,覆盖119种语言,涵盖文本、图像、视频、代码、专业文档等多元数据,构建了深厚的知识与能力底座。详情👉访问阿里云百炼大模型服务平台页面 了解。
image.png
bailian1.png
bailian2.png

在上下文处理能力上,Qwen3.7-Plus支持100万Tokens超大上下文窗口,最长可输出64万Tokens内容,相当于可一次性完整处理整本书籍、整套项目源码、数百页行业报告或长篇合同,无需拆分分段,大幅提升长文档处理效率。同时,模型内置高效缓存机制,可缓存长上下文请求的公共前缀,减少重复计算,进一步提升响应速度并降低使用成本。

技术层面,Qwen3.7-Plus延续通义千问系列的双推理机制,支持思考模式与快速模式自由切换。思考模式适用于复杂推理、代码开发、高精度文档解析等场景,模拟人类分步思考、逐层推演、自主校验,确保输出精准可靠;快速模式则针对轻量化批量生成、日常问答等场景,精简推理链路,响应速度提升2倍,同等额度调用量可翻2-3倍,让用户在精度与效率间自由取舍。

二、核心能力:四大维度突破,实现多模态全链路执行

(一)多模态统一理解:从图文到视频,全域感知无死角

Qwen3.7-Plus是通义千问系列中唯一同时支持文本、图片、视频三种模态的主力模型,原生实现多模态信息的统一编码与深度理解,无需依赖外部插件。在视觉处理方面,单图支持1600万像素高清输入,一次最多可处理2048张图片,可精准识别图像中的文字、图表、场景、界面、工程图纸等复杂内容,OCR准确率与视觉推理能力位居全球前列。详情👉访问阿里云百炼大模型服务平台页面 了解。
image.png
bailian1.png
bailian2.png

针对视频内容,模型最长支持2小时视频输入,可同时处理64个视频素材,实现关键帧提取、内容理解、人物追踪、事件梳理、字幕生成等全流程处理,可围绕人物、事件、时间、场景构建视频记忆,精准解析长视频中的复杂逻辑与信息关联。此外,模型还支持音频输入,可完成语音转文字、情感分析、内容摘要、语音指令理解等功能,真正实现“能看、能听、能理解”的全模态感知。

(二)GUI+CLI混合操作:从屏幕到命令,自主执行闭环

Qwen3.7-Plus最核心的突破,是成为国内首款实现“看图识屏+自主操控+代码执行”一体化的混合智能体,打通GUI可视化界面与CLI命令行双操作环境,让AI从“被动问答”升级为“主动执行”。它能精准识别桌面端、移动端的各类界面,定位按钮、输入框、菜单等控件,理解界面逻辑与交互规则,自主规划操作步骤并执行多步骤任务,例如自动操作APP完成注册、下单、数据导出等流程。

同时,模型可无缝衔接CLI命令行操作,根据视觉内容或文本指令,自动生成Shell、Python、SQL等命令并执行,实现从界面操作到系统命令的全链路打通。在实测案例中,模型曾稳定运行11小时,自主完成从需求分析、界面设计、代码编写到测试部署的全流程,生成超过1万行代码,独立交付完整的英语学习APP,展现出强大的长程自主执行能力。

(三)全栈视觉编程:从草图到项目,视觉到代码一键转化

视觉编程是Qwen3.7-Plus的差异化核心优势,也是同价位模型中独有的能力。它可直接根据产品草图、界面截图、设计稿等视觉素材,自动生成完整的前端代码(HTML/CSS/JavaScript)、后端逻辑、数据库设计与接口文档,实现从视觉灵感到可执行代码的端到端转化。无论是简单的网页原型、复杂的管理系统界面,还是SVG动画、交互式组件,模型都能精准还原视觉设计,并生成可直接运行的工程代码。

模型内置Code Interpreter工具,可直接执行生成的代码,输出运行结果并进行调试优化,支持复杂算法验证、数据可视化与功能测试。以下是通过DashScope API调用Qwen3.7-Plus视觉编程能力的示例代码:

import os
import dashscope

# 配置API密钥与基础URL
dashscope.api_key = os.getenv("DASHSCOPE_API_KEY")
dashscope.base_http_api_url = "https://dashscope.aliyuncs.com/api/v1"

# 多模态输入:界面截图+文本指令
messages = [
    {
   
        "role": "user",
        "content": [
            {
   "image": "https://example.com/admin-panel-screenshot.png"},  # 后台管理界面截图
            {
   "text": "根据这张后台管理界面截图,生成完整的HTML+CSS+JavaScript代码,实现页面布局与基础交互功能"}
        ]
    }
]

# 调用多模态对话接口,开启代码解释器
response = dashscope.MultiModalConversation.call(
    model="qwen3.7-plus",
    messages=messages,
    extra_body={
   
        "enable_code_interpreter": True,
        "enable_thinking": True  # 开启思考模式,保证代码精准性
    }
)

# 输出生成的代码
print(response.output.choices[0].message.content[0]["text"])

此外,模型支持函数调用功能,可将大模型与外部工具、API接口、数据库无缝连接,实现代码与真实业务系统的联动开发,满足企业级工程化需求。

(四)长程智能体自治:35小时自主运行,千次工具调用

Qwen3.7-Plus具备强大的长程任务自主规划与闭环迭代能力,官方标称可实现35小时自治运行,支持1000+次顺序工具调用,无需人工频繁干预。它能自主拆解复杂任务目标,制定详细执行计划,根据任务需求动态调用代码解释器、联网搜索、文件处理、界面操作等工具,完成子任务后自动验证结果,发现问题并优化方案,形成完整的任务执行闭环。

在复杂推理领域,Qwen3.7-Plus表现同样出色。在AIME数学竞赛测试中,它与旗舰Max答对相同数量的题目,但单题耗时仅113秒,比Max的303秒快近3倍,展现出稠密架构在推理效率上的优势。模型可精准求解复杂数学题、进行逻辑推演、分析科研数据、制定决策方案,思考模式下可展示完整推理步骤,大幅降低幻觉生成率,确保输出结果的可靠性与可追溯性。

三、应用场景:全领域覆盖,赋能各行业数字化升级

(一)软件开发与IT运维

为开发者提供全栈开发支持,从需求文档生成、架构设计、代码编写到测试部署,一站式完成项目交付;可根据界面草图自动生成前端代码,辅助后端逻辑开发、数据库设计与接口文档编写;在IT运维场景,可分析系统日志、定位故障原因、生成运维脚本,实现智能运维自动化,大幅提升开发与运维效率。

(二)企业办公与自动化

助力企业实现办公流程智能化,自动处理合同审阅、财报分析、报表生成、会议纪要整理等工作;可自动操作办公软件完成数据录入、格式转换、内容汇总等重复任务;作为智能办公助手,整合协作工具,实现任务自动分配、进度跟踪与结果汇总,提升企业办公效率与数字化水平。

(三)内容创作与多媒体制作

支持文本、图像、视频的全模态内容创作,自动生成营销文案、短视频脚本、新闻稿件、小说故事;可根据图文素材自动剪辑视频、生成字幕与配音;在设计领域,辅助UI设计、海报制作、插画生成,满足多样化内容生产需求,降低内容创作门槛。

(四)行业数字化与专业服务

在金融领域,提供量化策略编写、风险评估、投资分析、财报解读等服务;在法律领域,辅助合同起草、法律条文检索、案件分析、法律文书生成;在教育领域,可根据教材内容生成教案、习题、课件,辅助个性化教学;在医疗领域,辅助医学文献分析、病例解读、医疗报告生成,提升专业服务效率与准确性。

(五)智能体与自动化系统

作为智能体基座,可部署于各类自动化系统,实现从感知、决策到执行的全流程自主化。例如,在电商场景中,自主完成市场分析、选品、定价、营销、订单处理、复盘优化;在工业场景中,辅助设备监控、故障诊断、生产流程优化;在智能家居场景中,实现多设备联动控制与场景自动化,推动各行业智能化升级。

四、使用方式:多入口接入,快速上手模型能力

Qwen3.7-Plus提供多种接入方式,满足不同用户的使用需求,无论是个人体验还是企业级集成,都能快速上手:

  1. 网页端直接体验:访问通义千问官网,选择Qwen3.7-Plus模型,即可直接进行文本、图像、视频交互,无需开发基础,适合个人用户快速体验模型的多模态与智能体能力。
  2. API接口调用:通过DashScope API接入,支持Python、Node.js等多种SDK,兼容OpenAI协议,方便开发者快速集成到自有应用中。获取API Key后,配置环境变量即可调用,以下是基础文本生成与多模态调用的示例代码:
    ```python

    基础文本生成示例(兼容OpenAI SDK)

    import os
    from openai import OpenAI

client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)

response = client.chat.completions.create(
model="qwen3.7-plus",
messages=[{"role": "user", "content": "分析Qwen3.7-Plus在企业数字化转型中的核心应用价值"}]
)

print(response.choices[0].message.content)

多模态对话示例(DashScope原生SDK)

import dashscope

dashscope.api_key = os.getenv("DASHSCOPE_API_KEY")

messages = [
{
"role": "user",
"content": [
{"image": "https://example.com/product-chart.png"}, # 产品数据图表
{"text": "分析这张图表中的数据趋势,并生成一份数据报告"}
]
}
]

response = dashscope.MultiModalConversation.call(
model="qwen3.7-plus",
messages=messages
)

print(response.output.choices[0].message.content[0]["text"])
```

  1. 企业级智能体平台:配套千问办公平台,将本地电脑操作、云端长任务与企业协作整合,提供可视化任务管理、专家套件、定时任务等功能,适合企业团队部署智能体应用,实现规模化自动化办公。

五、总结:Qwen3.7-Plus,高性价比多模态智能体的最优解

Qwen3.7-Plus以35B稠密参数架构、100万Tokens上下文、全模态统一输入与GUI+CLI混合操作能力,构建了高性价比多模态智能体的全新标杆。它跳出传统多模态模型的局限,实现从“看懂内容”到“自主做事”的跨越,以接近旗舰的能力、更低的成本,为个人开发者、中小企业与各行业提供强大的AI生产力支撑。

无论是软件开发、企业办公、内容创作还是行业数字化,Qwen3.7-Plus都能提供端到端的解决方案,助力用户快速实现智能化升级。随着模型能力的持续迭代与生态的不断完善,Qwen3.7-Plus将成为多模态AI落地的主流选择,推动通用人工智能在各领域的规模化应用,开启智能体时代的全新发展阶段。

目录
相关文章
|
2月前
|
人工智能 缓存 自然语言处理
阿里云百炼Token Plan三大档位详解:Credits计费规则、Token换算与团队选型指南
阿里云百炼Token Plan是面向团队的AI大模型订阅服务,以Credits作为统一计量积分,覆盖文本生成、图像生成、代码开发等全场景模型调用,兼容主流AI编程与智能体工具,提供团队管理、预算管控、数据安全等企业级能力。该方案采用包月订阅制,提供标准、高级、尊享三档坐席,用户按月付费获取固定Credits额度,所有模型调用、工具使用、上下文缓存均按统一规则折算Credits扣除,告别传统按量付费的账单波动,实现AI使用成本的精准可控。
1493 0
|
20小时前
|
人工智能 开发框架 JSON
从对话到管道:基于百炼 CLI 构建文本理解工作流的四个实践场景
本文介绍百炼CLI(`bl`)如何将高频但低效的文本理解任务(分类、抽取、审读、摘要)工程化:通过规则外置、批量输入、结构化输出,结合Qwen多模型梯度与Qwen-VL多模态能力,零代码构建可复用工作流。四类实战场景覆盖评论打标、合同审读、AI特征评估与视频结构化,兼顾效率、成本与落地性。(239字)
从对话到管道:基于百炼 CLI 构建文本理解工作流的四个实践场景
|
20小时前
|
机器学习/深度学习 缓存 并行计算
单卡4090显存优化实践:模型单卡分片加载、推理链路拆解、延迟与吞吐平衡调优.190
本文详解RTX 4090单卡高效运行大模型的底层方案:通过张量并行(降低单次计算显存峰值)与分层分片(CPU存权重、GPU逐层加载释放),以时间换空间,突破24G显存瓶颈。结合BF16量化、KV缓存优化与异步调度,实现百亿参数模型稳定推理,兼顾延迟、吞吐与成本。
|
20小时前
|
存储 人工智能 运维
阿里云组合购活动最新优惠:精选“云+AI”产品组合,轻量服务器+ TokenPlan 套餐68元起
本文详解阿里云组合购活动,该活动以Token Plan全系列订阅为核心底座,搭配Qoder CN、轻量应用服务器、无影云电脑等工具产品,最低68元起即可配齐从AI算力到部署运行的全链路资源。活动覆盖AI编程、AI Agent部署、Agent托管云电脑、存储+AI联动、"0代码"域名建站及企业AI转型六大场景,提供个人到团队多档位弹性套餐,支持千问、DeepSeek等11款主流模型按需调用。用户通过"选底座→加产品→下单→即用"四步流程一站式上云,避免冗余付费,大幅降低AI落地与业务数字化的综合门槛。
|
7天前
|
人工智能 自然语言处理 前端开发
最新版通义千问(Qwen3.7-Plus)功能介绍
在大模型从单一文本处理迈向多模态智能体的时代,通义千问Qwen3.7-Plus凭借“多模态交互混合智能体”的核心定位,成为平衡性能、成本与实用性的标杆产品。它并非简单的功能叠加,而是将视觉感知、文本推理、代码生成、工具调用与自主执行深度融合,实现“看、想、写、做、验”的端到端任务闭环。作为Qwen3.7系列的均衡主力,它在保留接近旗舰级文本与编程能力的同时,全面升级视觉-语言融合能力,以更亲民的成本覆盖90%以上企业与个人高频场景,是当前最具落地价值的多模态大模型之一。
809 0
|
20小时前
|
人工智能 运维 自然语言处理
最新版通义千问(Qwen3.8-Max)功能介绍
作为通义千问系列迄今规模最大、性能最强的旗舰模型,Qwen3.8-Max凭借2.4万亿总参数的MoE混合专家架构、100万Token上下文窗口与原生多模态能力,实现了从“辅助工具”到“自主智能体”的跨越。它不仅在代码工程、专业办公、复杂推理等核心领域实现跨越式升级,更以端到端交付生产级成果的能力,成为面向智能体时代的通用AI基座,为个人开发者、企业团队与科研机构提供前所未有的AI生产力支撑。
83 0
|
20小时前
|
人工智能 API 网络安全
阿里云计算巢部署OpenClaw全攻略:百炼Coding Plan与Token Plan配置实战指南
OpenClaw作为一款现代化AI智能体框架,凭借GUI+CLI双操作、长程自治与多模态交互能力,成为开发者与企业搭建专属AI助手的优选工具。阿里云计算巢提供OpenClaw一键部署方案,无需手动配置复杂环境,即可快速搭建稳定运行的服务实例;搭配阿里云百炼Coding Plan与Token Plan,可无缝对接通义千问系列大模型,为OpenClaw注入强大的AI核心能力。本文将从部署前准备、计算巢一键部署、百炼双Plan配置、功能验证与避坑指南四大维度,提供完整实战教程,帮助零基础用户快速完成OpenClaw部署与大模型对接,解锁AI智能体全场景能力。
87 0
|
20小时前
|
人工智能 运维 自然语言处理
万小智AI建站2.0全功能深度拆解:零代码全链路建站与CLI批量运维实操指南
数字化时代,品牌官网、线上商城、招商门户、外贸站点已经成为企业获客、品牌曝光、线上交易的核心基础设施。传统定制建站模式长期存在大量难以规避的痛点:定制开发周期动辄数周,前后端开发、视觉设计人力成本高昂,不懂代码则无法自主调整页面;域名、备案、服务器、证书部署流程相互割裂,新手独立上线难度极大;网站后期内容更新、功能升级、数据运维同样需要持续投入技术人力,中小创业者、小微企业往往受限于资金、技术、时间,难以搭建功能完善、合规稳定的商用站点。万小智AI建站2.0依托大语言模型与全栈代码自动生成技术,重构完整建站技术链路,打造**AI需求智能梳理、全栈工程自动生成、对话拖拽双模式编辑、插件化功能拓展
20 0
|
20小时前
|
人工智能 API 网络安全
零门槛搭建Hermes Agent:计算巢一键部署+百炼双Plan配置完整教程
Hermes Agent作为一款开源自进化AI智能体框架,凭借学习闭环、跨会话记忆、多端接入与长程自治能力,成为开发者与企业搭建专属智能助手的优选方案。阿里云计算巢提供Hermes Agent一键部署服务,无需手动配置复杂环境,即可快速搭建稳定运行的服务实例;搭配阿里云百炼Coding Plan与Token Plan,可无缝对接通义千问系列大模型,为Hermes Agent注入强大的AI核心能力。本文将从部署前准备、计算巢一键部署、百炼双Plan配置、功能验证与避坑指南五大维度,提供完整实战教程,帮助零基础用户快速完成Hermes Agent部署与大模型对接,解锁AI智能体全场景能力。
25 0
|
20小时前
|
人工智能 运维 文字识别
阿里云百炼CLI工具全功能深度解析:多模态AI自动化运维实操完整指南
在AI开发流水线、智能体自动化调度、批量素材处理、离线模型调试的场景中,网页可视化控制台存在操作链路冗长、无法批量执行任务、难以嵌入定时脚本与CI/CD流程等固有短板,大量重复点击操作严重消耗开发与运维人员精力。为解决多模态AI任务工具碎片化、智能体框架对接门槛高、批量处理缺少标准化工具链等行业痛点,阿里云百炼平台推出专属轻量化命令行工具百炼CLI,简称`bl`工具。该工具采用插件化开源架构,整合平台全部大模型与配套服务能力,覆盖文本对话、图像编辑、音视频处理、视觉OCR、私有知识库检索、联网实时资讯查询、智能体记忆存储七大核心模块,原生兼容Hermes Agent、OpenClaw、Qode
45 0

热门文章

最新文章