ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

362

刘佳旭

2023-09-26

138050

云原生场景下高可用架构的最佳实践

刘佳旭

138,050

吴昆

2024-05-15

145467

弹性调度助力企业灵活应对业务变化，高效管理云上资源

本文主要介绍了弹性调企业灵活应对企业业务变化，并高效管理云上资源。

吴昆

145,467

阿里云云原生

2024-05-22

60070

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

超算快速弹性伸缩场景下，如何构建一套准确、快速、可靠的监控体系成为关键点。阿里云在超算场景的主机监控落地实践，解决超算场景面临的挑战，交付一套可靠和全面的主机监控体系。

阿里云云原生

60,070

豁朗

2022-05-16

1796

【最佳实践】K8s挂载PVC日志采集“轻量级”玩法

本文提供一种相对Sidecar部署更轻量级的采集方式，只需要部署少量的Logtail容器，即可采集不同业务容器的日志。

豁朗

1,796

豁朗

2024-05-15

125409

弱结构化日志 Flink SQL 怎么写？SLS SPL 来帮忙

豁朗

125,409

阿里云云原生

2024-05-15

66743

无需重新学习，使用 Kibana 查询/可视化 SLS 数据

本文演示了使用 Kibana 连接 SLS ES 兼容接口进行查询和分析的方法。

阿里云云原生

66,743

木烟

2024-06-24

45718

多环境镜像晋级/复用最佳实践

本文介绍了在应用研发场景中，如何通过阿里云服务实现镜像构建部署的高效和安全。主要关注两个实践方法来确保“所发即所测”。

木烟

45,718

阿里云存储

2024-06-26

25616

AutoMQ：基于 Regional ESSD 构建十倍降本的云原生 Kafka

本文介绍了AutoMQ基于Regional ESSD构建的十倍降本云原生，降低成本并提供无限容量，通过将存储层分离，使用ESSD作为WAL，OSS作为主存储，实现了成本降低和性能优化。此外，它利用弹性伸缩和抢占式实例，减少了70%的计算成本，并通过秒级分区迁移实现了高效弹性。而且，AutoMQ与Apache Kafka相比，能实现10倍成本优化和百倍弹性效率提升，且完全兼容Kafka API。

阿里云存储

25,616

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

云原生场景下高可用架构的最佳实践

弹性调度助力企业灵活应对业务变化，高效管理云上资源

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

【最佳实践】K8s挂载PVC日志采集“轻量级”玩法

弱结构化日志 Flink SQL 怎么写？SLS SPL 来帮忙

无需重新学习，使用 Kibana 查询/可视化 SLS 数据

多环境镜像晋级/复用最佳实践

AutoMQ：基于 Regional ESSD 构建十倍降本的云原生 Kafka