百炼 Qwen3.7-Max 详解:百万上下文、工具调用计费、限流参数、Python 流式调用 Demo

简介: Qwen3.7-Max是阿里云Qwen3.7系列最强纯文本大模型,专为智能体时代设计,擅编程、办公与长周期自主任务。支持Function Calling、缓存等能力,输入上限991K tokens,享免费100万tokens额度及限时5折优惠,可在百炼平台调用。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens

Qwen3.7-Max模型是阿里云Qwen3.7系列中规模最大、综合能力最强的模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。TokCost整理Qwen3.7-Max模型的能力、价格、工具调用费用、免费100万Tokens额度、模型限流与上下文及API代码示例,在阿里云百炼平台调用:https://www.aliyun.com/product/bailian

Qwen3.jpg


模型能力

模型能力 支持
输入模态 文本
输出模态 文本
模型体验
前缀续写
function calling
cache缓存
结构化输出 ×
批量推理
联网搜索
模型调优 ×

模型价格

目前阿里云Qwen3.7-Max模型可以享受限时5折优惠活动,大家根据原价可以计算出实际价格,在阿里云CLUB中心免费领取代金券和折扣券。

模型计费项 模型价格
输入 原价12元/每百万tokens,限时5折
输入(缓存命中) 原价2.4元/每百万tokens,限时5折
输入(Batch File) 6元/每百万tokens
输出 原价36元/每百万tokens,限时5折
输出(Batch File) 18元/每百万tokens
输出(Batch Chat) 原价36元/每百万tokens,限时5折
显式缓存创建 原价15元/每百万tokens,限时5折
显式缓存命中 原价1.2元/每百万tokens,限时5折
输入(Batch Chat) 原价12元/每百万tokens,限时5折

工具调用价格

工具 调用价格
code_interpreterResponses API 限时免费
web_extractorResponses API 限时免费
web_searchResponses API 元/千次调用

免费额度

开通百炼:https://www.aliyun.com/product/bailian 免费领100万Tokens额度。

模型限流与上下文

模型限流与上下文 参数
最大输入长度 991K
最大输出长度 64K
RPM 30000
TPM 5000000
最大输入长度(思考模式下) 983K
最大输出长度(思考模式下) 64K
上下文长度 1M
最大思维链长度 256K

API代码示例

OpenAI兼容:

from openai import OpenAI
import os
client = OpenAI(
    # 如果没有配置环境变量,请用阿里云百炼API Key替换:api_key="sk-xxx"
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    base_url="https://ws-ogyz1pi726j242ib.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)
messages = [{"role": "user", "content": "你是谁"}]
completion = client.chat.completions.create(
    model="qwen3.7-max",  # 您可以按需更换为其它深度思考模型
    messages=messages,
    extra_body={"enable_thinking": True},
    stream=True
)
is_answering = False  # 是否进入回复阶段
print("\n" + "=" * 20 + "思考过程" + "=" * 20)
for chunk in completion:
    if not chunk.choices:
        continue
    delta = chunk.choices[0].delta
    if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
        if not is_answering:
            print(delta.reasoning_content, end="", flush=True)
    if hasattr(delta, "content") and delta.content:
        if not is_answering:
            print("\n" + "=" * 20 + "完整回复" + "=" * 20)
            is_answering = True
        print(delta.content, end="", flush=True)


DashScope:

import os
from dashscope import Generation
import dashscope
dashscope.base_http_api_url = 'https://ws-ogyz1pi726j242ib.cn-beijing.maas.aliyuncs.com/api/v1'

messages = [
    {"role": "system", "content": "You are a helpful assistant."},
    {"role": "user", "content": "你是谁?"},
]
response = Generation.call(
    # 若没有配置环境变量,请用百炼API Key将下行替换为:api_key = "sk-xxx",
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    model="qwen3.7-max",
    messages=messages,
    result_format="message",
    # 开启深度思考
    enable_thinking=True,
)

if response.status_code == 200:
    # 打印思考过程
    print("=" * 20 + "思考过程" + "=" * 20)
    print(response.output.choices[0].message.reasoning_content)
    
    # 打印回复
    print("=" * 20 + "完整回复" + "=" * 20)
    print(response.output.choices[0].message.content)
else:
    print(f"HTTP返回码:{response.status_code}")
    print(f"错误码:{response.code}")
    print(f"错误信息:{response.message}")


相关文章
|
2月前
|
缓存 API
阿里云千问 Qwen3.7-Max 完整手册:模型能力、限时 5 折价格、免费 Tokens、OpenAI 兼容 API 代码
Qwen3.7-Max是阿里云Qwen3.7系列最强旗舰模型,专注智能体时代,擅编程、办公与长周期自主任务。支持文本输入/输出、Function Calling、缓存等能力,上下文达1M(输入991K),享免费100万Tokens及限时5折优惠,百炼平台即开即用。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
3月前
|
缓存 自然语言处理 文字识别
阿里云通义千问Qwen3.7怎么选?Max、Plus、Flash三大版本实测对比
阿里云通义千问Qwen3.7系列包含Max、Plus、Flash三大核心版本,三者定位清晰、能力互补,分别面向极致推理、多模态全能、轻量高效三大场景。三款模型共享100万Tokens超长上下文窗口与35小时自治执行上限,但在模态能力、架构设计、输出上限、推理速度与计费标准上存在本质差异。本文结合实测数据,从核心定位、基础参数、能力表现、成本性价比、场景适配五大维度,全面解析三大版本的区别,为个人与企业提供精准选型参考。
2477 1
|
14天前
|
人工智能 API 内存技术
刚刚 DeepSeek V4.1 Flash 开启内测,1 分钟教你用上!
刚刚 DeepSeek 内测群发布了 DeepSeek V4.1 Flash 中间版本内测的消息,这次的模型采用了新的结构,原生支持多模态、能力更强、速度更快、且成本更低。
1993 15
|
23天前
|
缓存 人工智能 自然语言处理
阿里云qwen3.7-max模型详解:模型能力、价格、上下文限制及使用注意事项参考
本文介绍阿里云通义千问系列面向智能体时代的旗舰模型Qwen3.7-Max,系统梳理其作为综合能力最强的Max模型的核心特性与适用场景。该模型2026年5月推出基础文本版本,同年6月增强版引入原生图像与视频输入多模态能力,专为复杂智能体任务设计,在编程、办公自动化及长周期自主执行等高阶场景表现卓越。模型在全球五大区域同步部署,功能存在差异化(如批量推理仅限北京区域),支持百万级超长上下文与结构化输出等高级功能,同时提供清晰的梯度定价策略。
|
2月前
|
人工智能 自然语言处理 API
阿里云百炼Qwen3.7-Max模型功能、免费Tokens、订阅计费及配置接入指南
Qwen3.7-Max是阿里云百炼推出的旗舰级大模型,具备超强推理、编程、智能体原生支持与多模态理解能力,专为高要求AI场景设计。新用户可免费领取100万Tokens,支持按量计费、资源包订阅及专属部署,接入便捷,合规安全。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
1295 4
|
1月前
|
SQL 自然语言处理 前端开发
别让 Agent 猜数据:企业级 Data Agent 架构设计指南
优先建设语义层、Agentic Harness 架构和分析能力沉淀,把最关键的业务对象、核心指标和高频分析方法系统化,再逐步补齐编排、记忆、权限和审计机制。
|
2月前
|
人工智能 缓存 运维
最新版阿里云 Qwen3.7-Flash 功能介绍
2026年阿里云百炼正式全面迭代**通义千问Qwen3.7全系模型**,在Max旗舰版、Plus全能版之外,重磅优化升级Qwen3.7-Flash高速轻量模型,主打**极速推理、超低算力消耗、高吞吐并发、均衡综合性能**四大核心特性,专门针对高频交互、批量自动化、智能体常驻运行、轻量化工程部署场景深度打磨。不同于主打极致推理精度的旗舰模型,Qwen3.7-Flash以“速度优先、精度均衡、成本可控”为设计核心,补齐了大模型规模化落地中高并发、高频调用、长期挂机的算力短板,成为当下OpenClaw、Hermes Agent等主流AI智能体框架、企业批量办公自动化、开发者高频编码、平台高吞吐交互服
858 0
|
2月前
|
缓存 人工智能 自然语言处理
阿里云Qwen3.7-Max和Qwen3.7-Plus区别与选择参考:模型能力、适用场景、收费价格
阿里云最新发布的 Qwen3.7-Max 与 Qwen3.7-Plus 是通义千问系列中面向智能体时代设计的两款核心大模型,分别定位于旗舰级全能模型与高性价比多模态基座模型。二者在模型能力、适用场景及计费策略上存在显著差异。以下从三个维度进行详细对比,并提供用户选购参考指南。
|
3月前
|
API
阿里云百炼上线Qwen3.7-Max,支持API与Token Plan调用!
Qwen3.7-Max正式上线阿里云百炼平台,支持API调用与Token Plan订阅。输入12元/百万Tokens,输出36元/百万Tokens。