官方博客-第13页-阿里云开发者社区

新念

2025-02-14

1410

DeepSeek-V3 高效训练关键技术分析

本文从模型架构、并行策略、通信优化和显存优化四个方面展开，深入分析了DeepSeek-V3高效训练的关键技术，探讨其如何以仅5%的算力实现对标GPT-4o的性能。

新念

1,410

阿里云云原生

2025-04-22

1321

本文介绍如何使用Serverless Devs CLI工具从零开发并一键部署MCP Server到阿里云函数计算（FC）。首先通过初始化MCP Server项目，完成本地代码编写，利用Node.js实现一个简单的Hello World工具。接着对代码进行打包，并通过Serverless Devs工具将项目部署至云端。部署完成后，提供三种客户端接入方式：官方Client、其他本地Client及在FC上部署的Client。最后可通过内置大模型的inspector测试部署效果。Serverless Devs简化了开发流程，提升了MCP Server的构建效率。

阿里云云原生

1,321

灵杰开发者

2025-08-08

593

Flink 2.1 SQL：解锁实时数据与AI集成，实现可扩展流处理

简介：本文整理自阿里云高级技术专家李麟在Flink Forward Asia 2025新加坡站的分享，介绍了Flink 2.1 SQL在实时数据处理与AI融合方面的关键进展，包括AI函数集成、Join优化及未来发展方向，助力构建高效实时AI管道。

灵杰开发者

593

阿里云PolarDB

2023-08-22

3655

深度优化 | PolarDB-X 基于向量化SIMD指令的探索

本文将介绍PolarDB-X对于向量化SIMD指令的探索和实践，包括基本用法及实现原理，以及在具体算子实现中的思考和沉淀。

阿里云PolarDB

3,655

阿里云云原生

2024-05-15

2457

为大模型工程提效，基于阿里云 ACK 的云原生 AI 工程化实践

本文主要介绍了解析云原生 AI 所遇到的技术挑战和应对方案，随后介绍云原生 AI 领域的关键技术与架构细节，最后分享我们在 ACK 的相关经验及工程实践。

阿里云云原生

2,457

子白

2024-05-15

102428

大语言模型推理提速，TensorRT-LLM 高性能推理实践

大型语言模型（Large language models,LLM）是基于大量数据进行预训练的超大型深度学习模型，本文主要讲述TensorRT-LLM利用量化、In-Flight Batching、Attention、Graph Rewriting提升 LLM 模型推理效率。

子白

102,428

李德

2024-12-06

1323

【阅读十分钟，百分百成功】——通过大模型实现对客服回答的质量评估

本文章基于业务实践，总结有关客服质检场景的解决方案和处理经验，为相似场景提供可行的借鉴方法。

李德

1,323

橙唯

2025-02-21

896

基于LLM打造沉浸式3D世界

阿里云数据可视化产品DataV团队一直在三维交互领域进行前沿探索，为了解决LLMs与3D结合的问题，近期在虚幻引擎内结合通义千问大模型家族打造了一套基于LLM的实时可交互3D世界方案，通过自然语言来与引擎内的3D世界进行交互。

橙唯

896

望宸

2025-02-28

1058

大模型推理主战场：通信协议的标配

DeepSeek加速了模型平权，大模型推理需求激增，性能提升主战场从训练转向推理。SSE（Server-Sent Events）和WebSocket成为大模型应用的标配网络通信协议。SSE适合服务器单向推送实时数据，如一问一答场景；WebSocket支持双向实时通信，适用于在线游戏、多人协作等高实时性场景。两者相比传统HTTPS协议，能更好地支持流式输出、长时任务处理和多轮交互，满足大模型应用的需求。随着用户体量扩大，网关层面临软件变更、带宽成本及恶意攻击等挑战，需通过无损上下线、客户端重连机制、压缩算法及安全防护措施应对。

望宸

1,058

官方博客-第13页-阿里云开发者社区

类目筛选

内容类型

DeepSeek-V3 高效训练关键技术分析

从零开始开发 MCP Server

Flink 2.1 SQL：解锁实时数据与AI集成，实现可扩展流处理

深度优化 | PolarDB-X 基于向量化SIMD指令的探索

为大模型工程提效，基于阿里云 ACK 的云原生 AI 工程化实践

大语言模型推理提速，TensorRT-LLM 高性能推理实践

【阅读十分钟，百分百成功】——通过大模型实现对客服回答的质量评估

基于LLM打造沉浸式3D世界

大模型推理主战场：通信协议的标配

官方博客-第13页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

DeepSeek-V3 高效训练关键技术分析

从零开始开发 MCP Server

Flink 2.1 SQL：解锁实时数据与AI集成，实现可扩展流处理

深度优化 | PolarDB-X 基于向量化SIMD指令的探索

为大模型工程提效，基于阿里云 ACK 的云原生 AI 工程化实践

大语言模型推理提速，TensorRT-LLM 高性能推理实践

【阅读十分钟，百分百成功】——通过大模型实现对客服回答的质量评估

基于LLM打造沉浸式3D世界

大模型推理主战场：通信协议的标配