ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

363

阿里云云原生

2024-05-15

99

实践总结｜前端架构设计的一点考究（下）

作者将【DDD、六边形、洋葱、清洁、CQRS】进行深入学习并梳理总结的一个前端架构设计，并且经历一定应用实践的考验。

阿里云云原生

99

霖玉

2023-06-15

13294

大数据SQL数据倾斜与数据膨胀的优化与经验总结

目前市面上大数据查询分析引擎层出不穷，但在业务使用过程中，大多含有性能瓶颈的SQL，主要集中在数据倾斜与数据膨胀问题中。本文结合业界对大数据SQL的使用与优化，尝试给出相对系统性的解决方案。

霖玉

13,294

ModelScope

2024-05-15

389

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

本期文章，我们会介绍一下AgentScope的一个设计哲学（Agent-oriented programming）

ModelScope

389

子丑

2024-06-13

64947

基于 Nginx Ingress + 云效 AppStack 实现灰度发布

本文将演示结合云效 AppStack，来看下如何在阿里云 ACK 集群上进行应用的 Ingress 灰度发布。

子丑

64,947

周宇睿

2023-09-08

470

MaxCompute半结构化数据思考与创新

本文将介绍MaxCompute在半结构化数据方面的一些思考与创新，围绕半结构化数据简析、传统方案优劣对比、MaxCompute半结构化数据解决方案、收益分析。

周宇睿

470

林以琳

2024-05-15

746

基于PAI-DSW快速启动Stable Diffusion WebUI

基于PAI-DSW快速启动Stable Diffusion WebUI，创作你的专属冬日主题AI画作！

林以琳

746

欧叔

2024-05-15

135587

基于客户真实使用场景的云剪辑Timeline问题解答与代码实操

本文为阿里云智能媒体服务IMS「云端智能剪辑」实践指南第6期，从客户真实实践场景出发，分享一些Timeline小技巧（AI_TTS、主轨道、素材对齐），助力客户降低开发时间与成本。

欧叔

135,587

ModelScope

2024-05-15

393

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

393

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

实践总结｜前端架构设计的一点考究（下）

大数据SQL数据倾斜与数据膨胀的优化与经验总结

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

基于 Nginx Ingress + 云效 AppStack 实现灰度发布

MaxCompute半结构化数据思考与创新

基于PAI-DSW快速启动Stable Diffusion WebUI

基于客户真实使用场景的云剪辑Timeline问题解答与代码实操

元象大模型开源30款量化版本加速低成本部署丨附教程

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

实践总结｜前端架构设计的一点考究（下）

大数据SQL数据倾斜与数据膨胀的优化与经验总结

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

基于 Nginx Ingress + 云效 AppStack 实现灰度发布

MaxCompute半结构化数据思考与创新

基于PAI-DSW快速启动Stable Diffusion WebUI

基于客户真实使用场景的云剪辑Timeline问题解答与代码实操

元象大模型开源30款量化版本 加速低成本部署丨附教程

元象大模型开源30款量化版本加速低成本部署丨附教程