ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

356

言澈

2024-05-15

253

全景剖析阿里云容器网络数据链路（二）—— Terway ENI

本文是[全景剖析容器网络数据链路]第二部分，主要介绍Kubernetes Terway ENI模式下，数据面链路的转转发链路。

言澈

253

言澈

2024-05-15

421

全景剖析阿里云容器网络数据链路（三）—— Terway ENIIP

本文是[全景剖析容器网络数据链路]第三部分，主要介绍Kubernetes Terway ENIIP模式下，数据面链路的转转发链路。

言澈

421

继儒

2023-03-21

2233

Hologres技术揭秘，JSON半结构化数据的极致分析性能

本文将会揭秘Hologres JSONB半结构化数据的技术原理，实现JSON半结构数据的极致分析性能。

继儒

2,233

刘佳旭

2023-09-26

138044

云原生场景下高可用架构的最佳实践

刘佳旭

138,044

斜阳

2024-05-15

132434

谈谈 RocketMQ 5.0 分级存储背后一些有挑战的技术优化

斜阳

132,434

弦望

2024-05-15

188

开源Flink迁移至实时计算Flink全托管版最佳实践

Flink全托管产品（Flink Serverless）是一款基于Apache Flink构建的全托管产品，为您提供全托管一站式的实时计算服务，具有免运费、高增值、低成本等特性。本方案介绍如何将自建开源Flink集群的流式任务（包含Datastream、Table/SQL、PyFlink任务）迁移至阿里云实时计算全托管版。

弦望

188

阿里云云原生

2023-07-27

43384

一文详解Spring Bean循环依赖

本文主要梳理了Spring解决bean循环依赖的思路。

阿里云云原生

43,384

吴昆

2024-05-15

145460

弹性调度助力企业灵活应对业务变化，高效管理云上资源

本文主要介绍了弹性调企业灵活应对企业业务变化，并高效管理云上资源。

吴昆

145,460

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

全景剖析阿里云容器网络数据链路（二）—— Terway ENI

全景剖析阿里云容器网络数据链路（三）—— Terway ENIIP

Hologres技术揭秘，JSON半结构化数据的极致分析性能

云原生场景下高可用架构的最佳实践

谈谈 RocketMQ 5.0 分级存储背后一些有挑战的技术优化

开源Flink迁移至实时计算Flink全托管版最佳实践

一文详解Spring Bean循环依赖

弹性调度助力企业灵活应对业务变化，高效管理云上资源