Qwen3.8‑Omni‑Flash 重磅发布,阿里云原生全模态模型,具备长音视频理解、音视频生产与编辑、视频问答等 Agentic 能力,免费体验:阿里云百炼AI模型平台体验Qwen3.8‑Omni‑Flash模型,百炼提供免费100万Tokens,如下图:
Qwen3.8‑Omni‑Flash
Qwen 新一代原生全模态模型,支持 1M 长序列,可直接输入文本、图像、音频与视频,基于 Qwen3.8-Flash-Next 架构。模型面向真实生产力场景中的 Agent 能力:在具备编程、文本知识工作、GUI 操作等 Agentic 能力的同时,在以音视频为核心的Agentic应用例如视频剪辑、音乐视频创作、影视制作与解说、音视频到图文摘要、音视频对话等需要综合处理文本、图像、音频和视频的工作流上取得了显著的效果。支持 2 通道与 4 通道空间音频解析,兼容 DashScope 与 OpenAI 协议,建议安装配套的 Qwen-MM-Plugins,便于 Agent 框架接入原生多模态能力。
支持免费100万Tokens额度
领取免费Tokens额度:阿里云百炼AI大模型平台 在百炼平台可以免费体验100万Tokens额度,可以开通免费额度用完即停,开通后你的免费Tokens额度用完之后,就自动停掉了,否则可能会产生费用。
免费额度用完即停:仅消耗平台赠送的免费额度,免费额度用尽后平台将自动停止服务(返回403错误:AllocationQuota.FreeTierOnly.),避免产生免费额度以外的费用。若您希望在免费额度用尽后仍继续使用模型服务,并根据实际产生的 用量付费,请您保持本功能是关闭状态。
模型能力
模型收费价格:
Qwen3.8‑Omni‑Flash模型输入价格0.8元/每百万Tokens,输入2.7元/每百万Tokens,输入(缓存命中)价格0.1元/每百万Tokens,如下图:
模型限流与上下文
工具调用价格
Web Search:Responses API收费4元/千次调用
API代码示例
兼容OpenAI的curl、Python、nodejs如下:
curl:
# 适用于 Bash / Zsh;请先配置目标地域的 DASHSCOPE_API_KEY 环境变量。 # Qwen3.8-Omni-Flash 仅支持文本输出,不设置 audio 参数。 # -N 关闭缓冲,终端将显示 SSE 流式响应(含文本增量和 usage)。 curl -N -X POST "https://ws-ogyz1pi726j242ib.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions" \ -H "Authorization: Bearer $DASHSCOPE_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "qwen3.8-omni-flash", "messages": [{"role": "user", "content": "你是谁?"}], "modalities": ["text"], "stream": true, "stream_options": {"include_usage": true} }'
Python:
# 安装依赖:pip install -U openai # 请先配置目标地域的 DASHSCOPE_API_KEY 环境变量。 import os from openai import OpenAI client = OpenAI( api_key=os.environ["DASHSCOPE_API_KEY"], base_url="https://ws-ogyz1pi726j242ib.cn-beijing.maas.aliyuncs.com/compatible-mode/v1", ) completion = client.chat.completions.create( model="qwen3.8-omni-flash", messages=[{"role": "user", "content": "你是谁?"}], # Qwen3.8-Omni-Flash 仅支持文本输出,不设置 audio 参数。 modalities=["text"], stream=True, stream_options={"include_usage": True}, ) for chunk in completion: if chunk.choices: content = chunk.choices[0].delta.content if content: print(content, end="", flush=True) elif chunk.usage: print() print("Usage:", chunk.usage) print()
nodejs:
// 安装依赖:npm install openai // 保存为 demo.mjs,运行:node demo.mjs // 请先配置目标地域的 DASHSCOPE_API_KEY 环境变量。 import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.DASHSCOPE_API_KEY, baseURL: "https://ws-ogyz1pi726j242ib.cn-beijing.maas.aliyuncs.com/compatible-mode/v1", }); const completion = await client.chat.completions.create({ model: "qwen3.8-omni-flash", messages: [{ role: "user", content: "你是谁?" }], // Qwen3.8-Omni-Flash 仅支持文本输出,不设置 audio 参数。 modalities: ["text"], stream: true, stream_options: { include_usage: true }, }); for await (const chunk of completion) { if (chunk.choices?.length) { const content = chunk.choices[0].delta.content; if (content) process.stdout.write(content); } else if (chunk.usage) { console.log(); console.log("Usage:", chunk.usage); } } console.log();
更多关于Qwen3.8-Omni-Flash模型的介绍,请参考官方文档:https://bailian.console.aliyun.com/cn-beijing/model/market/detail/qwen3.8-omni-flash