计算巢支持一键部署GLM-5.2

简介: GLM-5.2是智谱推出的旗舰级MoE大模型(744B总参,激活仅40B),支持真正无损1M上下文与128K输出,长程任务能力开源SOTA,编程与工程规范遵循能力卓越,原生支持结构化输出与工具调用,已在计算巢模型市场开放FP8版一键部署。

模型简介

GLM-5.2 是由智谱(ZhipuAI)研发的新一代旗舰基座大语言模型,面向「长程任务(Long-Horizon Tasks)」时代打造。它采用 MoE 稀疏混合专家架构,总参数达 744B、每次推理仅激活约 40B,在保有大模型知识容量的同时兼顾推理成本;配合真正可用的 1M 无损上下文,可一次性承载项目级工程上下文,让耗时数小时乃至数十小时的复杂工程任务稳定跑到底。

GLM-5.2 大模型具有以下核心特点:

  • Solid 1M 超长上下文:标配 1M token 上下文窗口且为「无损」可用,实测可一次性放入整个工程仓库;长程任务后半程的上下文漂移、目标遗忘明显减少,最大输出可达 128K token
  • 顶级长程任务能力:在 FrontierSWE、SWE-Marathon、PostTrainBench 等长程任务基准上整体表现介于 Claude Opus 4.7 与 4.8 之间,是当前排名最高的开源模型
  • 开源 SOTA 的 Coding 能力:在主流编程基准上保持开源 SOTA,与 Claude Opus 4.8 处于可比区间;在百万用户盲测的前端评估系统 Code Arena 上取得全球可用模型第一
  • 稳定的工程规范遵循:在长上下文、多轮执行中更能守住代码风格、架构边界、依赖约束、构建与测试流程等研发硬约束,降低越界修改与擅自提交风险
  • 思考模式切换:支持思考/非思考模式自由切换,并可调节 reasoning_effort,兼顾深度推理与快速响应
  • 结构化输出与工具调用:原生支持 JSON 结构化输出、Function Calling 与 MCP,方便与各类业务系统、Agent 框架对接

部署步骤

  1. 在计算巢模型市场中找到GLM-5.2-FP8模型,点击“开始部署”,或通过链接直达该模型:https://computenest.console.aliyun.com/ai-lab/model/cn-hangzhou/GLM-5.2-FP8

image.png

  1. 平台支持SGLang、vLLM部署框架,部署参数大多提供有默认配置,无需修改即可一键部署。

注意:选择ACS集群部署时,在使用GU8TF/GU8TEF/P16EN等显存较大的GPU卡型时,需要提交工单申请对应的GPU卡型白名单后才可进行部署,工单产品分类选择"容器计算服务ACS"。

image.png
image.png
image.png

  1. 部署成功后,即可按概览页上的Api调用示例进行调用。

image.png

更多模型支持

计算巢模型市场持续提供开源社区热门模型的快速部署,模型覆盖Qwen、DeepSeek、Kimi、GLM等开源优秀模型,同时联合ACS团队提供了PD分离的高性能推理方案,欢迎大家使用。

部署过程遇到问题,可以加入官方钉钉群咨询:

相关文章
|
1月前
|
SQL 存储 关系型数据库
【SQLite】SQLite3下载、安装、数据库操作保姆级教程(2026最新,超详细)
SQLite 是全球最流行的嵌入式关系数据库引擎,无需安装服务、零配置、单文件(.db)存储,直接以 C 库形式嵌入应用。广泛用于移动App、桌面软件、IoT设备及开发测试,支持标准SQL与ACID事务,跨平台、轻量高效。(239字)
|
1月前
|
存储 Kubernetes 调度
|
1月前
|
缓存 人工智能 自然语言处理
成本直降50%!GPT-5.6 Terra与GPT-5.5跑分、延迟、稳定性深度实测
随着大模型技术持续迭代更新,高效能、低成本成为企业开发、个人项目落地的核心诉求。OpenAI推出的GPT-5.6系列模型,针对性优化了前代模型的成本高、资源消耗大、推理延迟波动等痛点,其中**GPT-5.6 Terra**作为中端均衡主力模型,主打平替GPT-5.5、成本减半的核心优势,一经推出便成为各类AI应用、智能问答、代码开发、文本处理场景的首选模型。
229 1
|
1月前
|
网络安全 开发者
Xiuno BBS 审计之问题12:HTTPS 请求关闭 SSL 证书校验,存在中间人攻击风险
Xiuno BBS 4.0.4 的 `https_post()` 函数禁用SSL证书校验(`CURLOPT_SSL_VERIFYPEER=0`),仅验证主机名,导致HTTPS通信易遭中间人攻击,插件下载、远程图片抓取等场景可被劫持并执行RCE。XIUNOX已修复,供4.0.4维护者参考。(239字)
248 0
|
4月前
|
JSON API 芯片
计算巢模型市场支持一键部署Deepseek V4模型
DeepSeek-V4是DeepSeek开源的新一代大模型,开创百万token超长上下文普惠时代。含Pro(1.6T参数)与Flash(284B参数)双版本,支持思考/非思考模式切换、结构化输出及国产昇腾芯片适配,推理性能达世界顶级水平。(239字)
|
11月前
|
人工智能 算法 小程序
再见 Cursor,Qoder 真香!这波要改写 AI 编程格局
真心建议大家去使用一下这段时间最新推出的一款 AI 编程工具:Qoder 。真的是太好用了,一点也不比 Cursor 差。
1862 10
|
6月前
|
机器学习/深度学习 API
Qwen3.5 开源家族扩容!
通义千问Qwen3.5系列重磅开源:含397B、122B、35B、27B四款模型,覆盖高性能与高性价比场景;新增Qwen3.5-Flash API,支持百万token上下文及原生工具链,已在阿里云百炼上线。
5554 4
|
云安全 人工智能 安全
大模型+安全,阿里云发布AI云盾系列产品!
阿里云正式发布AI云盾(Cloud Shield for AI)系列安全产品,包括AI安全护栏、升级云安全中心、WAAP和云防火墙。该系列提供模型输入输出安全、AI-BOM、AI-SPM等能力,构建三层模型安全防御体系,涵盖AI基础设施、大模型及应用安全。其中,AI安全护栏保障生成式AI合规性,实时检测威胁并维护模型健康,支持多模态内容交叉检测的All In One API调用模式。此外,AI-BOM与AI-SPM助力客户持续监控AI资产及安全状态。
1661 3
大模型+安全,阿里云发布AI云盾系列产品!
|
10月前
|
存储 人工智能 安全
《Confidential MaaS 技术指南》发布,从 0 到 1 构建可验证 AI 推理环境
Confidential MaaS 将从前沿探索逐步成为 AI 服务的安全标准配置。