官方博客-第19页-阿里云开发者社区

亦达

2025-02-20

709

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

vLLM 是一种便捷的大型语言模型（LLM）推理服务，旨在简化个人和企业用户对复杂模型的使用。通过 vLLM，用户可以轻松发起推理请求，享受高效、稳定的 LLM 服务。针对大规模部署 vLLM 的挑战，如大模型参数量、高效推理能力和上下文理解等，阿里云函数计算（FC）提供了 GPU 预留实例闲置计费功能，优化了性能、成本和稳定性之间的平衡。此外，FC 支持简便的部署流程和多种应用集成方式，帮助企业快速上线并管理 vLLM 服务。总结来说，vLLM 结合 FC 的解决方案为企业提供了强大的技术支持和灵活的部署选项，满足不同业务需求。

亦达

709

阿里云云原生

2025-02-25

1116

解锁 DeepSeek 安全接入、稳定运行新路径

聚焦于企业部署 DeepSeek 的应用需求，本文介绍了模型权重下载及多种部署方案，还阐述了大模型应用落地的常见需求，帮助用户逐步提升模型应用效果。

阿里云云原生

1,116

行疾

2024-05-15

3224

阿里云容器服务 ACK AI 助手正式上线

期待已久！阿里云容器服务 ACK AI 助手正式上线

行疾

3,224

ModelScope

2024-05-15

1846

Multi-Agent实践第7期：智能体的高效协作

教程第7期

ModelScope

1,846

景祁

2024-05-15

164496

设计与构建 FinOps 流程、团队、体系与目标

企业 FinOps 实施不是一蹴而就的项目，如果您正在推进企业云原生 FinOps 落地，除了选择合适的技术手段，企业内部的流程和体系建设也尤为重要。

景祁

164,496

瑞丹

2024-07-31

2834

【产品升级】Dataphin V4.2重大升级：上线敏捷版，打通数据资产管理和消费，开启数据价值放大新篇章

Dataphin 是阿里巴巴旗下的一个智能数据建设与治理平台，旨在帮助企业构建高效、可靠、安全的数据资产。在V4.2版本中，Dataphin敏捷版上线助力企业打造轻量版数据中台，打通数据资产管理和消费，陪伴企业迈入数据高价值应用新阶段。

瑞丹

2,834

阿里云云原生

2024-10-18

975

海量大模型如何一键部署上云，函数计算 x ModelScope 社区给出答案

得益于阿里云函数计算的产品能力，魔搭 SwingDeploy 后的模型推理 API 服务默认具备极致弹性伸缩（缩零能力）、GPU 虚拟化（最小 1GB 显存粒度）、异步调用能力、按用付费、闲置计费等能力，这些能力帮助算法工程师大大加快了魔搭开源模型投入生产的生命周期。

阿里云云原生

975

阿里云云原生

2024-11-01

972

Serverless GPU：助力 AI 推理加速

近年来，AI 技术发展迅猛，企业纷纷寻求将 AI 能力转化为商业价值，然而，在部署 AI 模型推理服务时，却遭遇成本高昂、弹性不足及运维复杂等挑战。本文将探讨云原生 Serverless GPU 如何从根本上解决这些问题，以实现 AI 技术的高效落地。

阿里云云原生

972

阿里云云原生

2024-11-26

624

Apache Dubbo 正式发布 HTTP/3 版本 RPC 协议，弱网效率提升 6 倍

在 Apache Dubbo 3.3.0 版本之后，官方推出了全新升级的 Triple X 协议，全面支持 HTTP/1、HTTP/2 和 HTTP/3 协议。本文将围绕 Triple 协议对 HTTP/3 的支持进行详细阐述，包括其设计目标、实际应用案例、性能测试结果以及源码架构分析等内容。

阿里云云原生

624

官方博客-第19页-阿里云开发者社区

类目筛选

内容类型

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

解锁 DeepSeek 安全接入、稳定运行新路径

阿里云容器服务 ACK AI 助手正式上线

Multi-Agent实践第7期：智能体的高效协作

设计与构建 FinOps 流程、团队、体系与目标

【产品升级】Dataphin V4.2重大升级：上线敏捷版，打通数据资产管理和消费，开启数据价值放大新篇章

海量大模型如何一键部署上云，函数计算 x ModelScope 社区给出答案

Serverless GPU：助力 AI 推理加速

Apache Dubbo 正式发布 HTTP/3 版本 RPC 协议，弱网效率提升 6 倍

官方博客-第19页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

解锁 DeepSeek 安全接入、稳定运行新路径

阿里云容器服务 ACK AI 助手正式上线

Multi-Agent实践第7期：智能体的高效协作

设计与构建 FinOps 流程、团队、体系与目标

【产品升级】Dataphin V4.2重大升级：上线敏捷版，打通数据资产管理和消费，开启数据价值放大新篇章

海量大模型如何一键部署上云，函数计算 x ModelScope 社区给出答案

Serverless GPU：助力 AI 推理加速

Apache Dubbo 正式发布 HTTP/3 版本 RPC 协议，弱网效率提升 6 倍