ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

362

泮圣伟

2024-05-15

128

我们在数据库上做全链路灰度的方式

本文介绍了MSE提供的数据库层面的灰度能力。

泮圣伟

128

恶来

2023-05-15

6987

消息队列之 MetaQ 和 Kafka 区别和优势详解

本篇文章介绍MetaQ和Kafka这两个消息队列的区别和优势。

恶来

6,987

非有

2024-05-15

911

一文详解 Java 限流接口实现

本文介绍的实现方式属于应用级限制，应用级限流方式只是单应用内的请求限流，不能进行全局限流。要保证系统的抗压能力，限流是一个必不可少的环节，虽然可能会造成某些用户的请求被丢弃，但相比于突发流量造成的系统宕机来说，这些损失一般都在可以接受的范围之内。

非有

911

阿里云大数据Al技术

2024-05-15

144804

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

本教程将带领大家免费领取阿里云PAI-EAS的免费试用资源，并且带领大家在 ComfyUI 环境下使用 SVD的模型，根据任何图片生成一个小短视频。

阿里云大数据Al技术

144,804

无哲

2024-05-15

46944

SLS 查询新范式：使用 SPL 对日志进行交互式探索

像 Unix 命令一样支持多级管道级联，像加工预览一样实时处理查询结果，更便捷的交互，更丰富的算子，更灵活的探索半结构化日志，快来试试使用 SPL 语言查询日志数据吧~

无哲

46,944

源點

2024-05-15

238

如何“多快好省”地使用阿里云产品实现数据下载加速

阿里云CDN下载加速解决方案旨在通过全球调度中心智能化地将客户端的下载请求精准调度到分布于全球的最优CDN边缘节点，同时依托海量带宽储备及强大的CDN控制逻辑让企业省心省力地为用户带来极速下载体验，助力企业获得更大的市场回报。

源點

238

资源编排ROS

2019-12-24

1887

资源编排ROS之自定制资源（多云部署Terraform篇）

资源编排服务（Resource Orchestration Service，简称ROS）是阿里云提供的一项简化云计算资源管理的服务。您可以遵循ROS定义的模板规范编写资源栈模板，在模板中定义所需的云计算资源（例如ECS实例、RDS数据库实例）、资源间的依赖关系等。

资源编排ROS

1,887

周宇睿

2023-09-08

470

MaxCompute半结构化数据思考与创新

本文将介绍MaxCompute在半结构化数据方面的一些思考与创新，围绕半结构化数据简析、传统方案优劣对比、MaxCompute半结构化数据解决方案、收益分析。

周宇睿

470

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

我们在数据库上做全链路灰度的方式

消息队列之 MetaQ 和 Kafka 区别和优势详解

一文详解 Java 限流接口实现

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

SLS 查询新范式：使用 SPL 对日志进行交互式探索

如何“多快好省”地使用阿里云产品实现数据下载加速

资源编排ROS之自定制资源（多云部署Terraform篇）

MaxCompute半结构化数据思考与创新