ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

361

阿里云云原生

2024-05-22

60070

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

超算快速弹性伸缩场景下，如何构建一套准确、快速、可靠的监控体系成为关键点。阿里云在超算场景的主机监控落地实践，解决超算场景面临的挑战，交付一套可靠和全面的主机监控体系。

阿里云云原生

60,070

豁朗

2022-05-16

1796

【最佳实践】K8s挂载PVC日志采集“轻量级”玩法

本文提供一种相对Sidecar部署更轻量级的采集方式，只需要部署少量的Logtail容器，即可采集不同业务容器的日志。

豁朗

1,796

阿里云云原生

2024-05-15

66743

无需重新学习，使用 Kibana 查询/可视化 SLS 数据

本文演示了使用 Kibana 连接 SLS ES 兼容接口进行查询和分析的方法。

阿里云云原生

66,743

阿里云云原生

2023-07-27

43393

一文详解Spring Bean循环依赖

本文主要梳理了Spring解决bean循环依赖的思路。

阿里云云原生

43,393

豁朗

2024-05-15

125408

弱结构化日志 Flink SQL 怎么写？SLS SPL 来帮忙

豁朗

125,408

阿里云大数据Al技术

2024-05-15

144804

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

本教程将带领大家免费领取阿里云PAI-EAS的免费试用资源，并且带领大家在 ComfyUI 环境下使用 SVD的模型，根据任何图片生成一个小短视频。

阿里云大数据Al技术

144,804

刘军

2024-06-18

16544

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

本文展示了 Dubbo3 triple 协议是如何简化从协议规范与实现上简化开发测试、入口流量接入成本的，同时提供高性能通信、面向接口的易用性编码。

刘军

16,544

恶来

2023-05-15

6986

消息队列之 MetaQ 和 Kafka 区别和优势详解

本篇文章介绍MetaQ和Kafka这两个消息队列的区别和优势。

恶来

6,986

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

【最佳实践】K8s挂载PVC日志采集“轻量级”玩法

无需重新学习，使用 Kibana 查询/可视化 SLS 数据

一文详解Spring Bean循环依赖

弱结构化日志 Flink SQL 怎么写？SLS SPL 来帮忙

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

消息队列之 MetaQ 和 Kafka 区别和优势详解