ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

362

阿里云云原生

2024-05-15

98

实践总结｜前端架构设计的一点考究（下）

作者将【DDD、六边形、洋葱、清洁、CQRS】进行深入学习并梳理总结的一个前端架构设计，并且经历一定应用实践的考验。

阿里云云原生

98

阿里云云原生

2024-05-16

56179

容器内存可观测性新视角：WorkingSet 与 PageCache 监控

本文介绍了 Kubernetes 中的容器工作内存（WorkingSet）概念，它用于表示容器内存的实时使用量，尤其是活跃内存。

阿里云云原生

56,179

周宇睿

2023-09-08

470

MaxCompute半结构化数据思考与创新

本文将介绍MaxCompute在半结构化数据方面的一些思考与创新，围绕半结构化数据简析、传统方案优劣对比、MaxCompute半结构化数据解决方案、收益分析。

周宇睿

470

林以琳

2024-05-15

746

基于PAI-DSW快速启动Stable Diffusion WebUI

基于PAI-DSW快速启动Stable Diffusion WebUI，创作你的专属冬日主题AI画作！

林以琳

746

ModelScope

2024-05-15

388

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

本期文章，我们会介绍一下AgentScope的一个设计哲学（Agent-oriented programming）

ModelScope

388

荆磊

2024-05-15

55645

更优性能与性价比，从自建 ELK 迁移到 SLS 开始

本文介绍了 SLS 基本能力，并和开源自建 ELK 做了对比，可以看到 SLS 相比开源 ELK 有较大优势。

荆磊

55,645

资源编排ROS

2024-07-11

55

使用资源编排 ROS 轻松部署高可用架构网站——以 WordPress 为例

WordPress 是流行的开源 CMS，阿里云的资源编排服务 (ROS) 提供 IaC 功能，简化云上资源自动化部署，如创建 VPC、ECS、SLB、RDS 和弹性伸缩等。通过 ROS 模板（JSON/YAML），用户能快速部署高可用的 WordPress 环境，包括负载均衡、多可用区的 ECS 服务器集群、高可用 RDS 数据库等。模板定义了资源、参数和输出，用户在 ROS 控制台配置参数后一键部署。ROS 提升了部署效率，便于跨地域复制相同架构。

资源编排ROS

55

尹航

2024-07-15

19249

将Dubbo应用部署到服务网格中

本文主要就Dubbo应用如何接入服务网格、获得各项云原生能力进行了探讨，并提出了最佳实践以及过渡两种实践场景。我们首先推荐您使用Dubbo社区提供的最佳实践场景来接入服务网格，在必要时可以通过过渡方案来向最佳实践方案逐步实现过渡。

尹航

19,249

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

实践总结｜前端架构设计的一点考究（下）

容器内存可观测性新视角：WorkingSet 与 PageCache 监控

MaxCompute半结构化数据思考与创新

基于PAI-DSW快速启动Stable Diffusion WebUI

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

更优性能与性价比，从自建 ELK 迁移到 SLS 开始

使用资源编排 ROS 轻松部署高可用架构网站——以 WordPress 为例

将Dubbo应用部署到服务网格中