ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

357

朱坪刘松伟赵世振

2024-07-01

21828

阿里云 SAE 助力修正商城 3 周内提升系统承载能力 20 倍，轻松应对春晚流量

在 2024 年春节前夕，修正电商事业部面临了前所未有的技术挑战，修正将参与春晚的全民健康好礼派发的活动，且在央视及各大平台进行广告投放，预计流量激增至 16 亿，系统需要承载保底 5 万 QPS，目标 10 万 QPS。修正技术团队迫切需要升级 APP 架构以应对即将到来的超高并发场景。这一挑战不仅是对技术的考验，更是对修正品牌实力的一次展示。为了应对这次巨大的技术挑战，修正技术团队选择与阿里云云原生团队合作，进行 APP 架构的升级。

朱坪刘松伟赵世振等

21,828

斜阳

2024-05-15

132436

谈谈 RocketMQ 5.0 分级存储背后一些有挑战的技术优化

斜阳

132,436

阿里云存储

2024-05-15

94852

AIGC训练场景下的存储特征研究

在今天这样以AIGC为代表的AI时代下，了解训练场景对于存储的具体诉求同样是至关重要的。本文将尝试解读WEKA的一个相关报告，来看看AIGC对于存储有哪些具体的性能要求。

阿里云存储

94,852

ModelScope

2024-05-15

103434

手把手教你捏一个自己的Agent

Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用，用于方便地创建针对各种现实应用量身定制智能体，目前已经在生产级别落地。

ModelScope

103,434

元泊

2024-05-15

207

SLS：使用 OTel 官方 SDK 采集 Android、iOS Trace 数据实践

本文介绍了使用 OTel 官方 SDK 采集 Android、iOS Trace 数据实践。

元泊

207

弦望

2024-05-15

188

开源Flink迁移至实时计算Flink全托管版最佳实践

Flink全托管产品（Flink Serverless）是一款基于Apache Flink构建的全托管产品，为您提供全托管一站式的实时计算服务，具有免运费、高增值、低成本等特性。本方案介绍如何将自建开源Flink集群的流式任务（包含Datastream、Table/SQL、PyFlink任务）迁移至阿里云实时计算全托管版。

弦望

188

豁朗

2021-08-13

1709

用SLS配置日志关键字告警的N种方法

本文主要介绍一种免运维，高性能，支持灵活配置的方案，使用SLS接入日志和告警。

豁朗

1,709

阿里云云原生

2023-07-27

43384

一文详解Spring Bean循环依赖

本文主要梳理了Spring解决bean循环依赖的思路。

阿里云云原生

43,384

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

阿里云 SAE 助力修正商城 3 周内提升系统承载能力 20 倍，轻松应对春晚流量

谈谈 RocketMQ 5.0 分级存储背后一些有挑战的技术优化

AIGC训练场景下的存储特征研究

手把手教你捏一个自己的Agent

SLS：使用 OTel 官方 SDK 采集 Android、iOS Trace 数据实践

开源Flink迁移至实时计算Flink全托管版最佳实践

用SLS配置日志关键字告警的N种方法

一文详解Spring Bean循环依赖