ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

359

泮圣伟

2024-05-15

216

基于Ingress-APISIX网关实现全链路灰度

本文介绍了通过将 APISIX 提供的灵活的路由能力以及 MSE 提供的全链路灰度能力结合，可以在不需要修改任何业务代码的情况下，轻松实现全链路灰度能力。

泮圣伟

216

元泊

2024-05-15

211

SLS：使用 OTel 官方 SDK 采集 Android、iOS Trace 数据实践

本文介绍了使用 OTel 官方 SDK 采集 Android、iOS Trace 数据实践。

元泊

211

继儒

2023-03-21

2236

Hologres技术揭秘，JSON半结构化数据的极致分析性能

本文将会揭秘Hologres JSONB半结构化数据的技术原理，实现JSON半结构数据的极致分析性能。

继儒

2,236

凡玺

2024-05-15

121538

Ganos实时热力聚合查询能力解析与最佳实践

本文主要介绍Ganos实时热力聚合查询并动态输出热力瓦片能力，依托阿里云PolarDB PostgreSQL产品、ADB PostgreSQL和RDS PostgreSQL 三款数据库建设输出。

凡玺

121,538

阿里云云原生

2024-05-15

66740

无需重新学习，使用 Kibana 查询/可视化 SLS 数据

本文演示了使用 Kibana 连接 SLS ES 兼容接口进行查询和分析的方法。

阿里云云原生

66,740

朱坪刘松伟赵世振

2024-07-01

21830

阿里云 SAE 助力修正商城 3 周内提升系统承载能力 20 倍，轻松应对春晚流量

在 2024 年春节前夕，修正电商事业部面临了前所未有的技术挑战，修正将参与春晚的全民健康好礼派发的活动，且在央视及各大平台进行广告投放，预计流量激增至 16 亿，系统需要承载保底 5 万 QPS，目标 10 万 QPS。修正技术团队迫切需要升级 APP 架构以应对即将到来的超高并发场景。这一挑战不仅是对技术的考验，更是对修正品牌实力的一次展示。为了应对这次巨大的技术挑战，修正技术团队选择与阿里云云原生团队合作，进行 APP 架构的升级。

朱坪刘松伟赵世振等

21,830

斜阳

2024-05-15

132437

谈谈 RocketMQ 5.0 分级存储背后一些有挑战的技术优化

斜阳

132,437

隆基

2024-05-15

108401

深度剖析 RocketMQ 5.0，消息进阶：如何支撑复杂业务消息场景？

本文主要学习 RocketMQ 的一致性特性，一致性对于交易、金融都是刚需。从大规模复杂业务出发，学习 RocketMQ 的 SQL 订阅、定时消息等特性。再从高可用的角度来看，这里更多的是大型公司对于高阶可用性的要求，如同城容灾、异地多活等。

隆基

108,401

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

基于Ingress-APISIX网关实现全链路灰度

SLS：使用 OTel 官方 SDK 采集 Android、iOS Trace 数据实践

Hologres技术揭秘，JSON半结构化数据的极致分析性能

Ganos实时热力聚合查询能力解析与最佳实践

无需重新学习，使用 Kibana 查询/可视化 SLS 数据

阿里云 SAE 助力修正商城 3 周内提升系统承载能力 20 倍，轻松应对春晚流量

谈谈 RocketMQ 5.0 分级存储背后一些有挑战的技术优化

深度剖析 RocketMQ 5.0，消息进阶：如何支撑复杂业务消息场景？