阿里千问Qwen3.8-Flash多模态MoE模型:百万级上下文窗口、免费领100万Tokens

简介: 通义千问最新多模态大模型Qwen3.8-Flash(ID:qwen3.8-flash),原生支持百万级上下文(100万tokens)、文本/图像/视频输入,输出为文本。具备Function Calling、结构化输出、联网搜索(限北京/新加坡)等能力,兼容OpenAI/Anthropic协议,已在阿里云百炼平台开放免费试用(赠100万Tokens)。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens

Qwen3.8-Flash 是通义千问最新推出的多模态大模型,模型调用 ID 为 qwen3.8-flash,原生支持百万级上下文窗口(1,000,000 tokens),输入模态支持文本、图像和视频,输出模态为文本。在阿里云百炼AI大模型平台:https://www.aliyun.com/product/bailian 测试使用,可以免费领取100万Tokens,如下图:

阿里云百炼Qwen3.8-Flash

核心能力:

  • 支持 Function Calling、结构化输出、联网搜索、前缀续写和上下文缓存;不支持批量推理和模型调优。
  • 兼容 OpenAI 与 Anthropic 接口协议,可接入 Claude Code、Codex 等开发者工具。
  • 在编程辅助、智能体协作、图文理解、长视频分析等场景中表现突出。

上下文限制:

  • 最大输入长度:991,808 tokens(思考模式下 983,616)
  • 最大输出长度:131,072 tokens
  • 最大思维链长度:262,144 tokens

部署地域与能力差异:

  • 华北2(北京)、新加坡:支持联网搜索
  • 德国(法兰克福)、日本(东京)、美国(弗吉尼亚):不支持联网搜索
  • 所有地域均支持 Function Calling、结构化输出、上下文缓存和前缀续写

计费信息(华北2-北京):

  • 输入:0.8 元/百万 tokens
  • 输出:2.7 元/百万 tokens
  • 输入(缓存命中):0.1 元/百万 tokens

价格可能调整,实际关于Qwen3.8-Flash模型精准报价,请在阿里云百炼平台查询:https://www.aliyun.com/product/bailian

目录
相关文章
人工智能 缓存 前端开发
12430 70
人工智能 自然语言处理 安全
1316 0
Web App开发 人工智能 API
1536 2
人工智能 JavaScript 开发工具
4906 0
人工智能 Java BI
1630 1
人工智能 JavaScript 测试技术
2569 2
开发工具 Swift git
2000 6
人工智能 JavaScript 测试技术
1238 4