模型简介
MiniMax-M3 是由 MiniMax(稀宇科技)研发并开源的新一代大语言模型,是国内首个同时具备「前沿 Coding 能力、1M 超长上下文、原生多模态」三项核心能力的大模型。它采用自研的全新稀疏注意力架构 MSA(MiniMax Sparse Attention),总参数 428B、每次推理仅激活约 22B,在长上下文与智能体场景下兼顾性能与推理成本。
MiniMax-M3 大模型具有以下核心特点:
- 1M 超长上下文:基于自研 MSA 架构,最高支持 1M token 上下文窗口,并保障至少 512K token 稳定可用,可一次性处理整本长篇文档、完整代码仓库或长程任务上下文
- 前沿 Coding 能力:在编程与智能体等专业任务上达到前沿水平,胜任跨文件、多步骤的复杂工程开发与调试
- 原生多模态:原生支持图片与视频输入,并具备操作电脑桌面的能力,可覆盖更丰富的 Agent 交互场景
- 强大的 Agent 能力:面向长程智能体任务优化,具备稳定的任务拆解、工具调用与持续推进能力
- 高效稀疏注意力架构:MSA 架构在超长序列下显著提升计算效率,是支撑「长上下文 + 多模态 + Coding」三能力合一的核心
- 结构化输出与函数调用:原生支持 JSON 输出、Function Calling 等特性,方便与各类业务系统、Agent 框架对接
部署步骤
- 在计算巢模型市场中找到MiniMax-M3模型,点击“开始部署”,或通过链接直达该模型:https://computenest.console.aliyun.com/ai-lab/model/cn-hangzhou/MiniMax-M3

- 平台支持SGLang、vLLM部署框架,部署参数大多提供有默认配置,无需修改即可一键部署。
注意:选择ACS集群部署时,在使用GU8TF/GU8TEF/P16EN等显存较大的GPU卡型时,需要提交工单申请对应的GPU卡型白名单后才可进行部署,工单产品分类选择"容器计算服务ACS"。



- 部署成功后,即可按概览页上的Api调用示例进行调用。

更多模型支持
计算巢模型市场持续提供开源社区热门模型的快速部署,模型覆盖Qwen、DeepSeek、Kimi、GLM等开源优秀模型,同时联合ACS团队提供了PD分离的高性能推理方案,欢迎大家使用。
部署过程遇到问题,可以加入官方钉钉群咨询:
