ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

362

周宇睿

2023-09-08

470

MaxCompute半结构化数据思考与创新

本文将介绍MaxCompute在半结构化数据方面的一些思考与创新，围绕半结构化数据简析、传统方案优劣对比、MaxCompute半结构化数据解决方案、收益分析。

周宇睿

470

张佐玮

2023-12-01

893

Koordinator 助力云原生应用性能提升，小红书混部技术实践

本文基于 2023 云栖大会上关于 Koordinator 分享的实录，介绍小红书通过规模化落地混部技术来大幅提升集群资源效能，降低业务资源成本。

张佐玮

893

林以琳

2024-05-15

746

基于PAI-DSW快速启动Stable Diffusion WebUI

基于PAI-DSW快速启动Stable Diffusion WebUI，创作你的专属冬日主题AI画作！

林以琳

746

阿里云云原生

2024-05-15

113607

函数计算部署AI艺术字应用，生成新春文字头像

基于 Stable Diffusion Serverless API 解决方案搭建 AI 文字生成应用，支持并发出图。

阿里云云原生

113,607

ModelScope

2024-05-15

388

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

本期文章，我们会介绍一下AgentScope的一个设计哲学（Agent-oriented programming）

ModelScope

388

龙蜥社区OpenAnolis

2024-07-05

89

重新定义 AI 部署效率与性能，ZOLOZ 借助 AC2 实现低成本高性能的提优的方式｜ AI 案例推荐

ZOLOZ，视觉 AI 推理的算力和成本问题求解。

龙蜥社区OpenAnolis

89

ModelScope

2024-05-15

392

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

392

史泽寰

2023-09-19

814

全网最细，深度解析 Istio Ambient Mesh 流量路径

本文旨在对 Istio Ambient Mesh 的流量路径进行详细解读，力求尽可能清晰地呈现细节，以帮助读者完全理解 Istio Ambient Mesh 中最为关键的部分。

史泽寰

814

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

MaxCompute半结构化数据思考与创新

Koordinator 助力云原生应用性能提升，小红书混部技术实践

基于PAI-DSW快速启动Stable Diffusion WebUI

函数计算部署AI艺术字应用，生成新春文字头像

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

重新定义 AI 部署效率与性能，ZOLOZ 借助 AC2 实现低成本高性能的提优的方式｜ AI 案例推荐

元象大模型开源30款量化版本加速低成本部署丨附教程

全网最细，深度解析 Istio Ambient Mesh 流量路径

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

MaxCompute半结构化数据思考与创新

Koordinator 助力云原生应用性能提升，小红书混部技术实践

基于PAI-DSW快速启动Stable Diffusion WebUI

函数计算部署AI艺术字应用，生成新春文字头像

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

重新定义 AI 部署效率与性能，ZOLOZ 借助 AC2 实现低成本高性能的提优的方式｜ AI 案例推荐

元象大模型开源30款量化版本 加速低成本部署丨附教程

全网最细，深度解析 Istio Ambient Mesh 流量路径

元象大模型开源30款量化版本加速低成本部署丨附教程