ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

355

遥方

2024-05-15

159

ACK场景下应用程序安全访问云资源最佳实践

在实际的容器安全实践中，怎么样避免应用程序永久访问密钥。本文会介绍基于云原生的产品能力来实现无AK方案。

遥方

159

阿里云PolarDB

2023-08-22

2825

深度优化 | PolarDB-X 基于向量化SIMD指令的探索

本文将介绍PolarDB-X对于向量化SIMD指令的探索和实践，包括基本用法及实现原理，以及在具体算子实现中的思考和沉淀。

阿里云PolarDB

2,825

德歌

2023-09-14

24904

沉浸式学习PostgreSQL|PolarDB 16: 植入通义千问大模型+文本向量化模型, 让数据库具备AI能力

本文将带领大家来体验一下如何将“千问大模型+文本向量化模型”植入到PG|PolarDB中, 让数据库具备AI能力.

德歌

24,904

阿里云大数据Al技术

2024-05-15

144798

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

本教程将带领大家免费领取阿里云PAI-EAS的免费试用资源，并且带领大家在 ComfyUI 环境下使用 SVD的模型，根据任何图片生成一个小短视频。

阿里云大数据Al技术

144,798

泮圣伟

2024-05-15

212

基于Ingress-APISIX网关实现全链路灰度

本文介绍了通过将 APISIX 提供的灵活的路由能力以及 MSE 提供的全链路灰度能力结合，可以在不需要修改任何业务代码的情况下，轻松实现全链路灰度能力。

泮圣伟

212

阿里云云原生

2024-05-22

60059

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

超算快速弹性伸缩场景下，如何构建一套准确、快速、可靠的监控体系成为关键点。阿里云在超算场景的主机监控落地实践，解决超算场景面临的挑战，交付一套可靠和全面的主机监控体系。

阿里云云原生

60,059

朱坪刘松伟赵世振

2024-07-01

21825

阿里云 SAE 助力修正商城 3 周内提升系统承载能力 20 倍，轻松应对春晚流量

在 2024 年春节前夕，修正电商事业部面临了前所未有的技术挑战，修正将参与春晚的全民健康好礼派发的活动，且在央视及各大平台进行广告投放，预计流量激增至 16 亿，系统需要承载保底 5 万 QPS，目标 10 万 QPS。修正技术团队迫切需要升级 APP 架构以应对即将到来的超高并发场景。这一挑战不仅是对技术的考验，更是对修正品牌实力的一次展示。为了应对这次巨大的技术挑战，修正技术团队选择与阿里云云原生团队合作，进行 APP 架构的升级。

朱坪刘松伟赵世振等

21,825

隆基

2024-05-15

108395

深度剖析 RocketMQ 5.0，消息进阶：如何支撑复杂业务消息场景？

本文主要学习 RocketMQ 的一致性特性，一致性对于交易、金融都是刚需。从大规模复杂业务出发，学习 RocketMQ 的 SQL 订阅、定时消息等特性。再从高可用的角度来看，这里更多的是大型公司对于高阶可用性的要求，如同城容灾、异地多活等。

隆基

108,395

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

ACK场景下应用程序安全访问云资源最佳实践

深度优化 | PolarDB-X 基于向量化SIMD指令的探索

沉浸式学习PostgreSQL|PolarDB 16: 植入通义千问大模型+文本向量化模型, 让数据库具备AI能力

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

基于Ingress-APISIX网关实现全链路灰度

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

阿里云 SAE 助力修正商城 3 周内提升系统承载能力 20 倍，轻松应对春晚流量

深度剖析 RocketMQ 5.0，消息进阶：如何支撑复杂业务消息场景？