ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

354

云服务器ECS

2023-10-17

687

使用ECS部署并使用Docker

本文介绍如何在云服务ECS实例上，部署并使用Docker。

云服务器ECS

687

喻奎

2023-06-25

9995

MaxCompute湖仓一体近实时增量处理技术架构揭秘

本文将介绍阿里云云原生大数据计算服务MaxCompute湖仓一体近实时增量处理技术架构的核心设计和应用场景。

喻奎

9,995

ModelScope

2024-05-15

103430

手把手教你捏一个自己的Agent

Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用，用于方便地创建针对各种现实应用量身定制智能体，目前已经在生产级别落地。

ModelScope

103,430

太业

2024-05-15

301

【最佳实践】使用CloudLens排查iLogtail重启问题

本文主要介绍如何使用CloudLens for SLS定位和解决iLogtail日常使用中的常见问题之一：iLogtail异常重启问题。

太业

301

豁朗

2021-08-13

1708

用SLS配置日志关键字告警的N种方法

本文主要介绍一种免运维，高性能，支持灵活配置的方案，使用SLS接入日志和告警。

豁朗

1,708

弃余

2023-08-11

797

Linux 内存管理新特性：Memory folios 解读

本文主要讲解folio ，极其在应用中的直接价值。

弃余

797

阿里云存储

2024-05-15

94847

AIGC训练场景下的存储特征研究

在今天这样以AIGC为代表的AI时代下，了解训练场景对于存储的具体诉求同样是至关重要的。本文将尝试解读WEKA的一个相关报告，来看看AIGC对于存储有哪些具体的性能要求。

阿里云存储

94,847

探索云世界

2024-06-25

81134

部署高可用WordPress网站

高可用服务是另外一个高频使用的场景，编写模板的流程和《部署单点WordPress网站》一样，但涉及的资源更多一些。本文以《部署高可用WordPress网站》为例，介绍高可用部署类的模板如何编写。

探索云世界

81,134

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

使用ECS部署并使用Docker

MaxCompute湖仓一体近实时增量处理技术架构揭秘

手把手教你捏一个自己的Agent

【最佳实践】使用CloudLens排查iLogtail重启问题

用SLS配置日志关键字告警的N种方法

Linux 内存管理新特性：Memory folios 解读

AIGC训练场景下的存储特征研究

部署高可用WordPress网站