ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

362

非有

2024-05-15

911

一文详解 Java 限流接口实现

本文介绍的实现方式属于应用级限制，应用级限流方式只是单应用内的请求限流，不能进行全局限流。要保证系统的抗压能力，限流是一个必不可少的环节，虽然可能会造成某些用户的请求被丢弃，但相比于突发流量造成的系统宕机来说，这些损失一般都在可以接受的范围之内。

非有

911

骆天

2024-05-15

844

高并发架构设计三大利器：缓存、限流和降级

软件系统有三个追求：高性能、高并发、高可用，俗称三高。本篇讨论高并发，从高并发是什么到高并发应对的策略、缓存、限流、降级等。

骆天

844

探索云世界

2024-05-15

175526

阿里云 Serverless 异步任务处理系统在数据分析领域的应用

本文主要介绍异步任务处理系统中的数据分析，函数计算异步任务最佳实践-Kafka ETL，函数计算异步任务最佳实践-音视频处理等。

探索云世界

175,526

阿里云大数据Al技术

2024-05-15

144804

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

本教程将带领大家免费领取阿里云PAI-EAS的免费试用资源，并且带领大家在 ComfyUI 环境下使用 SVD的模型，根据任何图片生成一个小短视频。

阿里云大数据Al技术

144,804

周宇睿

2023-09-08

470

MaxCompute半结构化数据思考与创新

本文将介绍MaxCompute在半结构化数据方面的一些思考与创新，围绕半结构化数据简析、传统方案优劣对比、MaxCompute半结构化数据解决方案、收益分析。

周宇睿

470

阿里云云原生

2024-05-15

113607

函数计算部署AI艺术字应用，生成新春文字头像

基于 Stable Diffusion Serverless API 解决方案搭建 AI 文字生成应用，支持并发出图。

阿里云云原生

113,607

欧叔

2024-05-15

135587

基于客户真实使用场景的云剪辑Timeline问题解答与代码实操

本文为阿里云智能媒体服务IMS「云端智能剪辑」实践指南第6期，从客户真实实践场景出发，分享一些Timeline小技巧（AI_TTS、主轨道、素材对齐），助力客户降低开发时间与成本。

欧叔

135,587

阿里云云原生

2024-05-15

97

实践总结｜前端架构设计的一点考究（下）

作者将【DDD、六边形、洋葱、清洁、CQRS】进行深入学习并梳理总结的一个前端架构设计，并且经历一定应用实践的考验。

阿里云云原生

97

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

一文详解 Java 限流接口实现

高并发架构设计三大利器：缓存、限流和降级

阿里云 Serverless 异步任务处理系统在数据分析领域的应用

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

MaxCompute半结构化数据思考与创新

函数计算部署AI艺术字应用，生成新春文字头像

基于客户真实使用场景的云剪辑Timeline问题解答与代码实操

实践总结｜前端架构设计的一点考究（下）