ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

362

阿里云云原生

2024-05-15

98

实践总结｜前端架构设计的一点考究（下）

作者将【DDD、六边形、洋葱、清洁、CQRS】进行深入学习并梳理总结的一个前端架构设计，并且经历一定应用实践的考验。

阿里云云原生

98

离澈

2024-05-15

88

万字长文：一文详解单元测试干了什么

好的单元测试不仅可以验证代码结构设计的是否合理，而且可以提前发现代码中的漏洞，将线上风险扼杀在摇篮中。本文从常用的单元测试框架出发，对Mockito框架深入浅出的讲解，希望能帮到每一位同学。

离澈

88

周宇睿

2023-09-08

470

MaxCompute半结构化数据思考与创新

本文将介绍MaxCompute在半结构化数据方面的一些思考与创新，围绕半结构化数据简析、传统方案优劣对比、MaxCompute半结构化数据解决方案、收益分析。

周宇睿

470

林以琳

2024-05-15

746

基于PAI-DSW快速启动Stable Diffusion WebUI

基于PAI-DSW快速启动Stable Diffusion WebUI，创作你的专属冬日主题AI画作！

林以琳

746

岱泽

2024-05-15

75504

总结｜性能优化思路及常用工具及手段

性能优化是降低成本的手段之一，每年大促前业务平台都会组织核心链路上的应用做性能优化，一方面提升系统性能，另外一方面对腐化的代码进行清理。本文结合业务平台性能优化的经验，探讨一下性能优化的思路及常用工具及手段。

岱泽

75,504

ModelScope

2024-05-15

393

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

393

ModelScope

2024-05-15

388

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

本期文章，我们会介绍一下AgentScope的一个设计哲学（Agent-oriented programming）

ModelScope

388

资源编排ROS

2024-07-09

171

使用资源编排 ROS 轻松部署单点网站——以 WordPress 为例

WordPress 是流行的开源CMS，阿里云的ROS（Resource Orchestration Service）提供模板化部署服务，简化云上环境如VPC、ECS、MySQL的创建。用户可通过ROS控制台选择模板一键部署WordPress，配置包括实例区、类型、系统盘及密码等参数。ROS模板定义了资源、参数和输出，自动处理依赖关系，实现云资源和应用的自动化部署。通过ROS，用户可以高效管理和更新整个资源栈，实现快速、可靠的云服务部署。

资源编排ROS

171

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

实践总结｜前端架构设计的一点考究（下）

万字长文：一文详解单元测试干了什么

MaxCompute半结构化数据思考与创新

基于PAI-DSW快速启动Stable Diffusion WebUI

总结｜性能优化思路及常用工具及手段

元象大模型开源30款量化版本加速低成本部署丨附教程

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

使用资源编排 ROS 轻松部署单点网站——以 WordPress 为例

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

实践总结｜前端架构设计的一点考究（下）

万字长文：一文详解单元测试干了什么

MaxCompute半结构化数据思考与创新

基于PAI-DSW快速启动Stable Diffusion WebUI

总结｜性能优化思路及常用工具及手段

元象大模型开源30款量化版本 加速低成本部署丨附教程

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

使用资源编排 ROS 轻松部署单点网站——以 WordPress 为例

元象大模型开源30款量化版本加速低成本部署丨附教程