阿里云AI Stack全量适配Qwen3模型,企业级部署效率全面升级

简介: 2025年4月29日的凌晨5点,阿里全新一代模型通义千问Qwen3正式发布并全部开源8款「混合推理模型」,包含:6款Dense模型:0.6B、1.7B、4B、8B、14B、32B。2款MoE模型:Qwen3-30B-A3B和旗舰版Qwen3-235B-A22B。阿里云AI Stack已适配全量Qwen3模型,可快速部署实现Qwen3模型的开箱即用!

师出同门,AI Stack原生适配Qwen3

阿里云AI Stack是面向企业级的轻量、极致性价比企业级AI软硬一体解决方案,此前已完成Qwen2.5等主流开源大模型的适配。AI Stack目前已与“师出同门”的Qwen3实现高效深度适配,通过AI Stack快速部署Qwen3,实现新一代大模型的“开箱即用”。

image.png

AI Stack单机提供16卡,1.5+TB超大显存,700GB/s卡间互联,满足业务的多样化需求:

  • 16卡可运行无损精度旗舰版Qwen3-235B-A22B,提供更快响应、更高并发、更长上下文支持,满足业务的快速响应需求。
  • 灵活满足业务多样性需求,单机16卡中的8卡可实现无损精度旗舰版Qwen3-235B-A22B的极速运行,剩余8卡可适配其他不同尺寸、不同模态模型,为更大尺寸模型部署留足算力空间。


即日起,最新版本AI stack将包含Qwen3全尺寸模型,并支持最新APG SDK。客户可通过新安装或现有版本升级的方式,获取最新Qwen3模型服务能力,将AI能力与业务场景融合,加速企业的数智化升级!

相关文章
|
5月前
|
人工智能 文字识别 监控
|
5月前
|
云安全 人工智能 安全
Dify平台集成阿里云AI安全护栏,构建AI Runtime安全防线
阿里云 AI 安全护栏加入Dify平台,打造可信赖的 AI
3362 166
|
5月前
|
人工智能 vr&ar UED
获奖公布|第十九届"挑战杯"竞赛2025年度中国青年科技创新"揭榜挂帅"擂台赛阿里云“AI技术助力乡村振兴”专题赛拟授奖名单公示
获奖公布|第十九届"挑战杯"竞赛2025年度中国青年科技创新"揭榜挂帅"擂台赛阿里云“AI技术助力乡村振兴”专题赛拟授奖名单公示
|
5月前
|
机器学习/深度学习 人工智能 Serverless
吉利汽车携手阿里云函数计算,打造新一代 AI 座舱推理引擎
当前吉利汽车研究院人工智能团队承担了吉利汽车座舱 AI 智能化的方案建设,在和阿里云的合作中,基于星睿智算中心 2.0 的 23.5EFLOPS 强大算力,构建 AI 混合云架构,面向百万级用户的实时推理计算引入阿里云函数计算的 Serverless GPU 算力集群,共同为智能座舱的交互和娱乐功能提供大模型推理业务服务,涵盖的场景如针对模糊指令的复杂意图解析、文生图、情感 TTS 等。
|
5月前
|
人工智能 搜索推荐 程序员
当AI学会“跨界思考”:多模态模型如何重塑人工智能
当AI学会“跨界思考”:多模态模型如何重塑人工智能
714 120
|
5月前
|
缓存 物联网 PyTorch
使用TensorRT LLM构建和运行Qwen模型
本文档介绍如何在单GPU和单节点多GPU上使用TensorRT LLM构建和运行Qwen模型,涵盖模型转换、引擎构建、量化推理及LoRA微调等操作,并提供详细的代码示例与支持矩阵。
1470 2
|
5月前
|
机器学习/深度学习 人工智能 算法
阿里云视频云以 360° 实时回放技术支撑 NBA 2025 中国赛 —— AI 开启“智能观赛”新体验
NBA中国与阿里云达成合作,首发360°实时回放技术,融合AI视觉引擎,实现多视角、低延时、沉浸式观赛新体验,重新定义体育赛事观看方式。
976 0
阿里云视频云以 360° 实时回放技术支撑 NBA 2025 中国赛 —— AI 开启“智能观赛”新体验
|
5月前
|
存储 人工智能 OLAP
AI Agent越用越笨?阿里云AnalyticDB「AI上下文工程」一招破解!
AI上下文工程是优化大模型交互的系统化框架,通过管理指令、记忆、知识库等上下文要素,解决信息缺失、长度溢出与上下文失效等问题。依托AnalyticDB等技术,实现上下文的采集、存储、组装与调度,提升AI Agent的准确性与协同效率,助力企业构建高效、稳定的智能应用。

热门文章

最新文章