ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

407

阿里云云原生

2024-08-16

513

用 Higress AI 网关降低 AI 调用成本 - 阿里云天池云原生编程挑战赛参赛攻略

《Higress AI 网关挑战赛》正在火热进行中，Higress 社区邀请了目前位于排行榜 top5 的选手杨贝宁同学分享他的心得。本文是他整理的参赛攻略。

阿里云云原生

513

阿里云实时数仓Hologres

2023-07-17

20676

基于Hologres向量计算与大模型免费定制专属聊天机器人

本文为您介绍如何基于Hologres向量计算能力，结合大模型的阅读理解和信息整合能力，对该垂直行业的问题提供更贴切的回答，即费、快速定制专属聊天机器人。

阿里云实时数仓Hologres

20,676

阿里云中间件

2023-08-25

368

充换电企业开迈斯低成本提升线上应用稳定性的最佳实践

阿里云中间件

368

阿里云MaxCompute

2023-09-27

1187

深入MaxCompute，人力家借助Information Schema合理治理费用

本文将为大家带来MaxCompute与人力家客户案例深度解读。

阿里云MaxCompute

1,187

尹航

2023-10-09

29855

基于阿里云服务网格流量泳道的全链路流量管理（一）严格模式流量泳道

灰度发布是一种常见的对新版本应用服务的发布手段，其特点在于能够将流量在服务的稳定版本和灰度版本之间时刻切换，以帮助我们用更加可靠的方式实现服务的升级。

尹航

29,855

勿烦

2023-12-01

607

MaxCompute 重装上阵，Global Zorder

MaxCompute支持Global Zorder，使得整个表或者分区的数据在全局上能按照指定字段进行ZORDER排序，以便数据能有更好的聚集性。

勿烦

607

林以琳

2024-05-15

772

基于PAI-DSW快速启动Stable Diffusion WebUI

基于PAI-DSW快速启动Stable Diffusion WebUI，创作你的专属冬日主题AI画作！

林以琳

772

古琦

2024-05-15

109754

应用监控 eBPF 版：实现 Golang 微服务的无侵入应用监控

古琦

109,754

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

用 Higress AI 网关降低 AI 调用成本 - 阿里云天池云原生编程挑战赛参赛攻略

基于Hologres向量计算与大模型免费定制专属聊天机器人

充换电企业开迈斯低成本提升线上应用稳定性的最佳实践

深入MaxCompute，人力家借助Information Schema合理治理费用

基于阿里云服务网格流量泳道的全链路流量管理（一）严格模式流量泳道

MaxCompute 重装上阵，Global Zorder

基于PAI-DSW快速启动Stable Diffusion WebUI

应用监控 eBPF 版：实现 Golang 微服务的无侵入应用监控