Qwen3.8-Flash 是通义千问最新推出的多模态大模型,模型调用 ID 为 qwen3.8-flash,原生支持百万级上下文窗口(1,000,000 tokens),输入模态支持文本、图像和视频,输出模态为文本。在阿里云百炼AI大模型平台:https://www.aliyun.com/product/bailian 测试使用,可以免费领取100万Tokens,如下图:

核心能力:
- 支持 Function Calling、结构化输出、联网搜索、前缀续写和上下文缓存;不支持批量推理和模型调优。
- 兼容 OpenAI 与 Anthropic 接口协议,可接入 Claude Code、Codex 等开发者工具。
- 在编程辅助、智能体协作、图文理解、长视频分析等场景中表现突出。
上下文限制:
- 最大输入长度:991,808 tokens(思考模式下 983,616)
- 最大输出长度:131,072 tokens
- 最大思维链长度:262,144 tokens
部署地域与能力差异:
- 华北2(北京)、新加坡:支持联网搜索
- 德国(法兰克福)、日本(东京)、美国(弗吉尼亚):不支持联网搜索
- 所有地域均支持 Function Calling、结构化输出、上下文缓存和前缀续写
计费信息(华北2-北京):
- 输入:0.8 元/百万 tokens
- 输出:2.7 元/百万 tokens
- 输入(缓存命中):0.1 元/百万 tokens
价格可能调整,实际关于Qwen3.8-Flash模型精准报价,请在阿里云百炼平台查询:https://www.aliyun.com/product/bailian