官方博客-第14页-阿里云开发者社区

赫曦

2024-05-15

93192

阿里云云原生弹性方案，用弹性解决集群资源利用率难题

本文主要介绍了通过弹性，实现成本优化，解决集群资源利用率难题。

赫曦

93,192

ModelScope

2024-05-15

1155

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

1,155

古琦

2024-07-04

109501

全链路追踪 & 性能监控，GO 应用可观测全面升级

当前，大多数面向 Golang 应用的监控能力主要是通过 SDK 方式接入，需要开放人员手动进行埋点，会存在一定问题。对此，可观测 Go Agent 应运而生。本文介绍的阿里云可观测 Go Agent 方案，能通过无侵入的方式实现应用监控能力。

古琦

109,501

龙蜥社区OpenAnolis

2024-11-06

2921

AI 场景下确保模型数据安全，Confidential AI 技术最佳实践解读

机密计算软硬结合技术保障数据安全。

龙蜥社区OpenAnolis

2,921

丕天

2025-03-21

1131

AI 推理场景的痛点和解决方案

一个典型的推理场景面临的问题可以概括为限流、负载均衡、异步化、数据管理、索引增强 5 个场景。通过云数据库 Tair 丰富的数据结构可以支撑这些场景，解决相关问题，本文我们会针对每个场景逐一说明。

丕天

1,131

ModelScope

2025-06-16

544

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

生成式模型在文本生成图片等领域的快速发展，为社区带来了日新月异的诸多文生图模型。

ModelScope

544

刘佳旭

2023-09-26

138996

云原生场景下高可用架构的最佳实践

刘佳旭

138,996

子白

2024-05-15

102450

大语言模型推理提速，TensorRT-LLM 高性能推理实践

大型语言模型（Large language models,LLM）是基于大量数据进行预训练的超大型深度学习模型，本文主要讲述TensorRT-LLM利用量化、In-Flight Batching、Attention、Graph Rewriting提升 LLM 模型推理效率。

子白

102,450

肖雪珣朱健

2024-07-29

8434

如何在Dataphin中构建Flink+Paimon流式湖仓方案

当前大数据处理工业界非常重要的一个大趋势是一体化，尤其是湖仓一体架构。与过去分散的数据仓库和数据湖不同，湖仓一体架构通过将数据存储和处理融为一体，不仅提升了数据访问速度和处理效率，还简化了数据管理流程，降低了资源成本。企业可以更轻松地实现数据治理和分析，从而快速决策。paimon是国内开源的，也是最年轻的成员。本文主要演示如何在 Dataphin 产品中构建 Flink+Paimon 的流式湖仓方案。

肖雪珣朱健

8,434

官方博客-第14页-阿里云开发者社区

类目筛选

内容类型

阿里云云原生弹性方案，用弹性解决集群资源利用率难题

vLLM部署Yuan2.0：高吞吐、更便捷

全链路追踪 & 性能监控，GO 应用可观测全面升级

AI 场景下确保模型数据安全，Confidential AI 技术最佳实践解读

AI 推理场景的痛点和解决方案

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

云原生场景下高可用架构的最佳实践

大语言模型推理提速，TensorRT-LLM 高性能推理实践

如何在Dataphin中构建Flink+Paimon流式湖仓方案

官方博客-第14页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

阿里云云原生弹性方案，用弹性解决集群资源利用率难题

vLLM部署Yuan2.0：高吞吐、更便捷

全链路追踪 & 性能监控，GO 应用可观测全面升级

AI 场景下确保模型数据安全，Confidential AI 技术最佳实践解读

AI 推理场景的痛点和解决方案

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

云原生场景下高可用架构的最佳实践

大语言模型推理提速，TensorRT-LLM 高性能推理实践

如何在Dataphin中构建Flink+Paimon流式湖仓方案