官方博客-第29页-阿里云开发者社区

ModelScope

2024-05-15

1125

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

1,125

探索云世界

2024-05-15

407

Serverless与Websocket的聊天工具

本文以阿里云函数计算为例，通过API网关触发器实现一个基于Websocket的聊天工具。

探索云世界

407

阿里云实时数仓Hologres

2024-06-27

2933

实时数仓Hologres OLAP场景核心能力介绍

Hologres提供统一、实时、弹性、易用的一站式实时数仓引擎，解决复杂OLAP难题。

阿里云实时数仓Hologres

2,933

阿里云百炼

2024-07-09

1462

阿里云百炼应用实践系列-基于LlamaIndex的文档问答助手

本文以阿里云百炼官方文档问答助手为例，介绍如何基于阿里云百炼平台打造基于LlamaIndex的RAG文档问答产品。我们基于阿里云百炼平台的底座能力，以官方帮助文档为指定知识库，搭建了问答服务，支持钉钉、Web访问。介绍了相关技术方案和主要代码，供开发者参考。

阿里云百炼

1,462

阿里云云原生

2024-08-06

8547

【AI 冰封挑战】搭档函数计算，“冰”封你的夏日记忆

夏日炎炎，别让高温打败你的创意，立即体验 ComfyUI 自制冰冻滤镜！无需繁琐的后期技巧，三步开启一段清凉无比的视觉探险。参与实验并上传作品即可获得运动无线蓝牙耳机，限量 800 个，先到先得！

阿里云云原生

8,547

木将

2024-09-11

427

二级缓存架构极致提升系统性能

本文详细阐述了如何通过二级缓存架构设计提升高并发下的系统性能。

木将

427

付宇轩

2024-09-14

734

阿里云函数计算 x NVIDIA 加速企业 AI 应用落地

阿里云函数计算与 NVIDIA TensorRT/TensorRT-LLM 展开合作，通过结合阿里云的无缝计算体验和 NVIDIA 的高性能推理库，开发者能够以更低的成本、更高的效率完成复杂的 AI 任务，加速技术落地和应用创新。

付宇轩

734

信徒

2024-12-05

799

我的程序突然罢工了｜深入探究HSF调用异常，从死锁到活锁的全面分析与解决

本文详细记录了作者在处理HSF调用异常问题的过程中，从初步怀疑死锁到最终发现并解决活锁问题的全过程。

信徒

799

阿里云弹性计算

2025-01-06

171752

对话｜企业如何构建更完善的容器供应链安全防护体系

阿里云与企业共筑容器供应链安全

阿里云弹性计算

171,752

官方博客-第29页-阿里云开发者社区

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

Serverless与Websocket的聊天工具

实时数仓Hologres OLAP场景核心能力介绍

阿里云百炼应用实践系列-基于LlamaIndex的文档问答助手

【AI 冰封挑战】搭档函数计算，“冰”封你的夏日记忆

二级缓存架构极致提升系统性能

阿里云函数计算 x NVIDIA 加速企业 AI 应用落地

我的程序突然罢工了｜深入探究HSF调用异常，从死锁到活锁的全面分析与解决

对话｜企业如何构建更完善的容器供应链安全防护体系

官方博客-第29页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

Serverless与Websocket的聊天工具

实时数仓Hologres OLAP场景核心能力介绍

阿里云百炼应用实践系列-基于LlamaIndex的文档问答助手

【AI 冰封挑战】搭档函数计算，“冰”封你的夏日记忆

二级缓存架构极致提升系统性能

阿里云函数计算 x NVIDIA 加速企业 AI 应用落地

我的程序突然罢工了｜深入探究HSF调用异常，从死锁到活锁的全面分析与解决

对话｜企业如何构建更完善的容器供应链安全防护体系