ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

362

豁朗

2022-05-16

1797

【最佳实践】K8s挂载PVC日志采集“轻量级”玩法

本文提供一种相对Sidecar部署更轻量级的采集方式，只需要部署少量的Logtail容器，即可采集不同业务容器的日志。

豁朗

1,797

阿里云AnalyticDB

2023-05-29

5374

AnalyticDB(ADB)+LLM，构建AIGC时代下企业专属Chatbot

如何基于向量数据库+LLM（大语言模型），打造更懂你的企业专属Chatbot。

阿里云AnalyticDB

5,374

昕羽

2024-05-15

65148

阿里云 EMR 基于 Paimon 和 Hudi 构建 Streaming Lakehouse

Apache Paimon 和 Apache Hudi 作为数据湖存储格式，有着高吞吐的写入和低延迟的查询性能，是构建数据湖的常用组件。本文在阿里云EMR上，针对数据实时入湖场景，对 Paimon 和 Hudi 的性能进行比对，并分别以 Paimon 和 Hudi 作为统一存储搭建准实时数仓。

昕羽

65,148

桦雄

2024-05-15

61430

走进RDS之MySQL内存分配与管理（中）

MySQL内存分配与管理总体上分为上中下三篇介绍，本篇为中篇，主要介绍 InnoDB 的内存构成和使用，代码版本主要基于8.0.25。

桦雄

61,430

阿里云云原生

2024-05-24

47281

“黏土风格”轻松拿捏，基于函数计算部署 ComfyUI实现AI生图

使用阿里云函数计算FC，快速部署AI绘画工具ComfyUI，体验高质量图像生成。新用户可享180元试用额度，包括GPU、vCPU、内存和调用次数。开通FC和文件存储NAS，通过应用中心选择ComfyUI模板创建应用。

阿里云云原生

47,281

朱坪刘松伟赵世振

2024-07-01

21837

阿里云 SAE 助力修正商城 3 周内提升系统承载能力 20 倍，轻松应对春晚流量

在 2024 年春节前夕，修正电商事业部面临了前所未有的技术挑战，修正将参与春晚的全民健康好礼派发的活动，且在央视及各大平台进行广告投放，预计流量激增至 16 亿，系统需要承载保底 5 万 QPS，目标 10 万 QPS。修正技术团队迫切需要升级 APP 架构以应对即将到来的超高并发场景。这一挑战不仅是对技术的考验，更是对修正品牌实力的一次展示。为了应对这次巨大的技术挑战，修正技术团队选择与阿里云云原生团队合作，进行 APP 架构的升级。

朱坪刘松伟赵世振等

21,837

豁朗

2024-05-15

125409

弱结构化日志 Flink SQL 怎么写？SLS SPL 来帮忙

豁朗

125,409

作霖

2024-05-15

187

ADB PG最佳实践之高效复制数据到RDS PG

ADB PG是一个经典MPP数据库，长项在于查询分析处理，面对客户联机分析和联机交易（HTAP）场景就显得力不从心，我们在某银行核心系统DB2 for LUW迁移到ADB PG时就遇到类似问题，因此我们提出ADB PG+RDS PG混搭技术架构，来解决客户此类HTAP需求。该混搭架构的精髓在于扬长避短，充分发挥分析型数据库和交易型数据库的长处和特性，分析型数据库专注于数据加工跑批场景，然后批量加工的结果数据卸载到RDS PG，通过RDS PG对外提供高并发对客交易服务。

作霖

187

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

【最佳实践】K8s挂载PVC日志采集“轻量级”玩法

AnalyticDB(ADB)+LLM，构建AIGC时代下企业专属Chatbot

阿里云 EMR 基于 Paimon 和 Hudi 构建 Streaming Lakehouse

走进RDS之MySQL内存分配与管理（中）

“黏土风格”轻松拿捏，基于函数计算部署 ComfyUI实现AI生图

阿里云 SAE 助力修正商城 3 周内提升系统承载能力 20 倍，轻松应对春晚流量

弱结构化日志 Flink SQL 怎么写？SLS SPL 来帮忙

ADB PG最佳实践之高效复制数据到RDS PG