官方博客-第20页-阿里云开发者社区

新念

2025-02-14

1390

DeepSeek-V3 高效训练关键技术分析

本文从模型架构、并行策略、通信优化和显存优化四个方面展开，深入分析了DeepSeek-V3高效训练的关键技术，探讨其如何以仅5%的算力实现对标GPT-4o的性能。

新念

1,390

望雲十雨言澈

2025-04-10

520

AI Infra之模型显存管理分析

本文围绕某线上客户部署DeepSeek-R1满血版模型时进行多次压测后，发现显存占用一直上升，从未下降的现象，记录了排查过程。

望雲十雨言澈等

520

阿里云云原生

2025-08-07

327

Function AI 助力用户自主开发 MCP 服务，一键上云高效部署

在 AI 与云原生融合的趋势下，开发者面临模型协同与云端扩展的挑战。MCP（模型上下文协议）提供统一的交互规范，简化模型集成与服务开发。Function AI 支持 MCP 代码一键上云，提供绑定代码仓库、OSS 上传、本地交付物部署及镜像部署等多种构建方式，助力开发者高效部署智能服务，实现快速迭代与云端协同。

阿里云云原生

327

王明橙鲤黄俊

2024-05-15

64101

通义千问开源模型在PAI灵骏的最佳实践

本文将展示如何基于阿里云PAI灵骏智算服务，在通义千问开源模型之上进行高效分布式继续预训练、指令微调、模型离线推理验证以及在线服务部署。

王明橙鲤黄俊等

64,101

ModelScope

2024-05-15

1166

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

1,166

ModelScope

2024-05-15

1213

今天，来自 Qwen1.5 开源家族的新成员，代码专家模型 CodeQwen1.5开源！CodeQwen1.5 基于 Qwen 语言模型初始化，拥有 7B 参数的模型，其拥有 GQA 架构，经过了 ~3T tokens 代码相关的数据进行预训练，共计支持 92 种编程语言、且最长支持 64K 的上下文输入。效果方面，CodeQwen1.5 展现出了优秀的代码生成、长序列建模、代码修改、SQL 能力等,该模型可以大大提高开发人员的工作效率，并在不同的技术环境中简化软件开发工作流程。

ModelScope

1,213

资源编排ROS

2024-06-24

398

基于 ROS 的 Terraform 托管服务轻松部署文本转语音系统 ChatTTS

基于 IaC 的理念，通过定义一个模板，使用 ROS 提供的 Terraform 托管服务进行自动化部署，可以非常高效快捷地部署任意云资源和应用（比如 ChatTTS 服务）。相比于手动部署或者通过 API、SDK 的部署方式，有着高效、稳定等诸多优势，也是服务上云的最佳实践。

资源编排ROS

398

阿里云云原生

2024-08-12

459

5 大场景上手通义灵码企业知识库 RAG

大家好，我是通义灵码，你的智能编程助手！今天就跟大家分享下企业知识库能帮开发者做些什么。

阿里云云原生

459

阿里云云原生

2024-09-23

1082

重磅！阿里云可观测产品家族全新升级，AI +数据双驱动，打造全栈可观测体系

近日，阿里云可观测产品家族正式发布云监控 2.0，隶属产品日志服务 SLS、云监控 CMS、应用实时监控服务 ARMS 迎来重磅升级。

阿里云云原生

1,082

官方博客-第20页-阿里云开发者社区

类目筛选

内容类型

DeepSeek-V3 高效训练关键技术分析

AI Infra之模型显存管理分析

Function AI 助力用户自主开发 MCP 服务，一键上云高效部署

通义千问开源模型在PAI灵骏的最佳实践

元象大模型开源30款量化版本加速低成本部署丨附教程

快来与 CodeQwen1.5 结对编程

基于 ROS 的 Terraform 托管服务轻松部署文本转语音系统 ChatTTS

5 大场景上手通义灵码企业知识库 RAG

重磅！阿里云可观测产品家族全新升级，AI +数据双驱动，打造全栈可观测体系

官方博客-第20页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

DeepSeek-V3 高效训练关键技术分析

AI Infra之模型显存管理分析

Function AI 助力用户自主开发 MCP 服务，一键上云高效部署

通义千问开源模型在PAI灵骏的最佳实践

元象大模型开源30款量化版本 加速低成本部署丨附教程

快来与 CodeQwen1.5 结对编程

基于 ROS 的 Terraform 托管服务轻松部署文本转语音系统 ChatTTS

5 大场景上手通义灵码企业知识库 RAG

重磅！阿里云可观测产品家族全新升级，AI +数据双驱动，打造全栈可观测体系

元象大模型开源30款量化版本加速低成本部署丨附教程