刚刚:Qwen3.8-Max发布:概述、功能、定价、速率限制与上下文、内置工具及API 参考指南

简介: Qwen3.8-Max是阿里最新发布的2.4万亿参数MoE大模型,支持图文视频多模态输入,具备编程、法律、金融等数百专业任务能力,原生视觉理解+超长上下文(1M),端到端交付生产级成果。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens

Qwen3.8-Max是阿里发布的最新基座大模型,2.4万亿参数MoE旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。在阿里云百炼平台抢先体验:https://www.aliyun.com/product/bailian

qwen38max.jpg

输入支持图片、文本和视频,输出为文本。


支持功能:

Qwen3.8-Max支持前缀补全、函数调用、缓存、结构化输出和联网搜索。


定价收费

模型收费价格.jpg

模型计费项

价格 单位
输入 ¥12 /M tokens
输出 ¥36 /M tokens
输入(缓存命中) ¥1.5 /M tokens
显式缓存创建 ¥15 /M tokens
显式缓存命中 ¥1 /M tokens


内置工具收费价格:code_interpreter免费、web_extractor免费、web_search价格4元/K 调用、i2i_search收费48元/K 调用、t2i_search收费24元/K 调用、pdf_parsing价格0.02元每页。


速率限制与上下文

  • 最大输入:991K
  • 最大输出:131K
  • 最大输入(思考模式):983K
  • 最大输出(思考模式):131K
  • 上下文:1M
  • 最大思维链:262K
  • TPM:5M,每分钟 Token 数


内置工具

内置工具.jpg

API 参考


DashScope

Python:

import os
import dashscope
dashscope.base_http_api_url = "https://dashscope.aliyuncs.com/api/v1"

messages = [
    {
        "role": "user",
        "content": [
            {"image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241022/emyrja/dog_and_girl.jpeg"},
            {"text": "图中描绘的是什么景象?"}]
    }]
response = dashscope.MultiModalConversation.call(
    api_key=os.getenv('DASHSCOPE_API_KEY'),
    model='qwen3.8-max',
    messages=messages
)
print(response.output.choices[0].message.content[0]["text"])

Java:

import java.util.Arrays;
import java.util.Collections;
import com.alibaba.dashscope.aigc.multimodalconversation.MultiModalConversation;
import com.alibaba.dashscope.aigc.multimodalconversation.MultiModalConversationParam;
import com.alibaba.dashscope.aigc.multimodalconversation.MultiModalConversationResult;
import com.alibaba.dashscope.common.MultiModalMessage;
import com.alibaba.dashscope.common.Role;
import com.alibaba.dashscope.exception.ApiException;
import com.alibaba.dashscope.exception.NoApiKeyException;
import com.alibaba.dashscope.exception.UploadFileException;
import com.alibaba.dashscope.utils.Constants;

public class Main {
    
    static {Constants.baseHttpApiUrl="https://dashscope.aliyuncs.com/api/v1";}

    public static void simpleMultiModalConversationCall()
            throws ApiException, NoApiKeyException, UploadFileException {
        MultiModalConversation conv = new MultiModalConversation();
        MultiModalMessage userMessage = MultiModalMessage.builder().role(Role.USER.getValue())
                .content(Arrays.asList(
                        Collections.singletonMap("image", "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241022/emyrja/dog_and_girl.jpeg"),
                        Collections.singletonMap("text", "图中描绘的是什么景象?"))).build();
        MultiModalConversationParam param = MultiModalConversationParam.builder()
                .apiKey(System.getenv("DASHSCOPE_API_KEY"))
                .model("qwen3.8-max")
                .messages(Arrays.asList(userMessage))
                .build();
        MultiModalConversationResult result = conv.call(param);
        System.out.println(result.getOutput().getChoices().get(0).getMessage().getContent().get(0).get("text"));
    }
    public static void main(String[] args) {
        try {
            simpleMultiModalConversationCall();
        } catch (ApiException | NoApiKeyException | UploadFileException e) {
            System.out.println(e.getMessage());
        }
        System.exit(0);
    }
}


cURL:

curl -X POST https://dashscope.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
    "model": "qwen3.8-max",
    "input":{
        "messages":[
            {
                "role": "user",
                "content": [
                    {"image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241022/emyrja/dog_and_girl.jpeg"},
                    {"text": "图中描绘的是什么景象?"}
                ]
            }
        ]
    }
}'


更多关于阿里千问Qwen3.8-Max模型的介绍,请移步到阿里云百炼官方AI模型平台:https://www.aliyun.com/product/bailian

相关文章
|
1月前
|
人工智能 缓存 API
阿里云Qwen3.8-Max首发上线:API服务与Token Plan同步开放全解析
阿里云正式发布新一代旗舰基座大模型Qwen3.8-Max,同步上线千问AI平台API服务与百炼Token Plan订阅方案,面向全球开发者全面开放调用。作为通义千问系列首款突破2.4万亿参数的MoE混合专家模型,Qwen3.8-Max在编程能力、复杂逻辑推理、长文档处理与多模态智能体协作等领域实现跨越式升级,可独立自主完成16天连续编程任务,全程稳定可靠。本次上线的API服务提供兼容OpenAI与Anthropic的双协议接口,大幅降低迁移成本;Token Plan则以统一Credits计量,打通多模态能力与主流AI工具,为个人与团队提供高性价比的订阅选择。本文将全面解析Qwen3.8-Max
664 2
|
1月前
|
机器学习/深度学习 Web App开发 编解码
2026 年 8 月大模型的三重跃迁
8月1—3日,国产大模型密集突破:通义千问Qwen3.8-Max以2.4T稀疏MoE+1M上下文实现高效推理;MiniMax开源全模态视频模型H3,支持2K/15秒带声视频生成;DeepSeek V4-Flash显著提升Agent能力。三大进展分别指向参数效率、长程自治与多模态生产,标志着大模型正从“辅助工具”迈向“端到端自主交付”。
2099 1
2026 年 8 月大模型的三重跃迁
|
15天前
|
缓存 自然语言处理 测试技术
国产旗舰大模型详解:Qwen3.8‑Max MoE架构、办公编程能力、API与Qoder‑CLI实操
大模型技术持续迭代,模型不再局限简单问答、片段代码生成,向着全栈工程开发、原生多模态理解、超长文档解析、长周期自主闭环任务演进。Qwen3.8‑Max作为新一代旗舰基座模型,基于第三代稀疏混合专家MoE架构打造,总参数规模达到2.4万亿,推理阶段仅激活950亿有效参数,兼顾超大模型知识容量与推理效率。该模型支持最高100万Token超长上下文窗口,具备原生多模态理解、全栈自主编程、数百类专业办公任务处理、数千轮长周期自主执行能力,同时兼容OpenAI标准接口协议,提供Qoder‑CLI命令行工具,适配个人开发者、企业业务系统、科研项目、智能体Agent开发等多元场景。本文从底层技术架构、核心能
438 0
|
28天前
|
人工智能 缓存 数据挖掘
阿里云Qwen3.8-Max大模型首发尝鲜:个人版和企业版超值优惠低至39元/月起
本文介绍了阿里云Qwen3.8-Max旗舰大模型。该模型拥有2.4万亿参数,采用MoE架构,支持文本、图像、视频多模态输入,在代码工程、专业办公、长程任务规划及多模态视觉理解等方面较上代Qwen3.7-Max显著提升,最大上下文达100万Token。文章详解其核心能力、API调用方式与定价策略(输入12元/百万tokens),并重点介绍Token Plan订阅(39元/月起、首发加量10倍)、NightPlan夜间2折等多项优惠活动,助力用户以低成本享受旗舰级AI生产力。
阿里云Qwen3.8-Max大模型首发尝鲜:个人版和企业版超值优惠低至39元/月起
|
5月前
|
数据采集 人工智能 API
2026 淘宝 API 接口实用指南:从资质申请到实战避坑
2026年淘宝API接入指南:详解账号资质(个人/企业/服务商权限差异)、凭证获取(新增场景核验)、高频接口实战(商品/订单/支付回调代码)、签名避坑、合规要点及工具推荐,助开发者高效安全对接。
2686 0
|
1月前
|
人工智能 缓存 API
阿里云Qwen3.8-Max首发上线:API服务与Token Plan同步开放
阿里云于2026年8月正式推出了其最新一代旗舰基座大模型——Qwen3.8-Max。这款模型不仅在参数规模上实现了新的突破,更在推理效率、多模态处理及长周期任务执行上展现了卓越的性能,标志着通义千问系列模型迈入了一个全新的智能体时代。本文将深入解析Qwen3.8-Max的技术特性、应用场景、价格体系及接入方式,为开发者和企业提供一份详尽的参考指南。
|
9天前
|
缓存 自然语言处理 API
阿里云Qwen3.8‑Max、Qwen3.7‑Max、Qwen3.7‑Plus、Qwen3.7‑Flash、Qwen3.8‑Flash功能区别解析,企业项目选型完整指南
随着大模型智能体落地场景持续拓宽,越来越多开发者会面对多款同系列模型选型难题。阿里云百炼平台上架的Qwen3.8‑Max、Qwen3.7‑Max、Qwen3.7‑Plus、Qwen3.7‑Flash、Qwen3.8‑Flash五款模型,覆盖从复杂深度推理、长周期智能体、多模态GUI操控到高吞吐低成本业务场景,不同模型在架构、上下文窗口、模态支持、代码能力、工具调用稳定性、计费成本上存在明显差异。很多开发者在项目前期直接选用高规格旗舰模型,带来不必要的高额推理成本;也有部分场景误用轻量模型,造成复杂任务推理失败、工具调用错乱、长文档解析丢失关键信息等问题。本文将从底层架构、核心能力、适用业务场景
387 1
|
1月前
|
机器学习/深度学习 人工智能 API
Qwen3.8-Max 开源了:该不该从 Claude 切过去?
阿里正式发布2.4万亿参数旗舰Qwen3.8-Max,支持100万上下文与原生多模态,激活95B参数,推理成本仅6美元/百万token。下周将开源Max系列权重——史上首次,兼具强编码、长程智能体与办公自动化能力,但标准编程基准仍略逊Fable 5。(239字)
|
1月前
|
人工智能 自然语言处理 API
阿里云百炼Token Plan:AI 模型订阅计划,Qwen3.8-Max 首发尝鲜、上新deepseek-v4-flash,个人版39元起
阿里云推出的百炼Token Plan全新升级活动,是面向全类型AI生产力用户的重磅订阅服务升级,核心权益包含Qwen3.8-Max-Preview首发尝鲜限时加量10倍福利,覆盖文本、视觉、视频等全模态旗舰模型,支持个人版与企业版多档位灵活选择,早鸟优惠低至39元/月,每晚22点到次日8点夜间调用还可享qwen3.7系列低至2折起的超大折扣,同时开放多款组合购套餐将算力、工具、部署环境一站式配齐,帮助用户高效开启全链路AI生产力。
|
2月前
|
人工智能 自然语言处理 数据挖掘
通义千问 Token Plan 重磅上新!2.4T 参数 Qwen3.8-Max 抢先体验,夜间调用 0.2 折
千问AI推出Token Plan订阅计划,以统一Credits体系覆盖文本、图像、视频全模态,首发2.4万亿参数Qwen3.8-Max与HappyHorse1.1视频引擎;支持日间1折、夜间0.2折潮汐算力,含Harness全套工具;个人/企业双版本,大幅降低多模型调用成本与使用门槛。

热门文章

最新文章