官方博客-第24页-阿里云开发者社区

亦达

2025-02-20

709

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

vLLM 是一种便捷的大型语言模型（LLM）推理服务，旨在简化个人和企业用户对复杂模型的使用。通过 vLLM，用户可以轻松发起推理请求，享受高效、稳定的 LLM 服务。针对大规模部署 vLLM 的挑战，如大模型参数量、高效推理能力和上下文理解等，阿里云函数计算（FC）提供了 GPU 预留实例闲置计费功能，优化了性能、成本和稳定性之间的平衡。此外，FC 支持简便的部署流程和多种应用集成方式，帮助企业快速上线并管理 vLLM 服务。总结来说，vLLM 结合 FC 的解决方案为企业提供了强大的技术支持和灵活的部署选项，满足不同业务需求。

亦达

709

阿里云云原生

2025-02-25

1116

解锁 DeepSeek 安全接入、稳定运行新路径

聚焦于企业部署 DeepSeek 的应用需求，本文介绍了模型权重下载及多种部署方案，还阐述了大模型应用落地的常见需求，帮助用户逐步提升模型应用效果。

阿里云云原生

1,116

言澈

2025-02-28

1173

进行GPU算力管理

本篇主要简单介绍了在AI时代由‘大参数、大数据、大算力’需求下，对GPU算力管理和分配带来的挑战。以及面对这些挑战，GPU算力需要从单卡算力管理、单机多卡算力管理、多机多卡算力管理等多个方面发展出来的业界通用的技术。

言澈

1,173

行疾

2024-05-15

3224

阿里云容器服务 ACK AI 助手正式上线

期待已久！阿里云容器服务 ACK AI 助手正式上线

行疾

3,224

探索云世界

2024-05-15

2891

阿里云大降价后，再谈“降本增效”

2024年2月29日，阿里云宣布史上最大力度降价，引发行业对用云成本的热议。

探索云世界

2,891

ModelScope

2024-05-15

1846

Multi-Agent实践第7期：智能体的高效协作

教程第7期

ModelScope

1,846

阿里云云原生

2024-05-15

55708

Higress 全新 Wasm 运行时，性能大幅提升

本文介绍 Higress 将 Wasm 插件的运行时从 V8 切换到 WebAssembly Micro Runtime (WAMR) 的最新进展。

阿里云云原生

55,708

阿里云云原生

2024-05-15

44106

得物 ZooKeeper SLA 也可以 99.99%丨最佳实践

在本文中，作者探讨了ZooKeeper（ZK）的一个内存占用问题，特别是当有大量的Watcher和ZNode时，导致的内存消耗。

阿里云云原生

44,106

探索云世界

2024-05-15

423

基于Docker搭建halo博客

实例安装Ubuntu20.04系统，通过MobaXterm远程连接ECS，同时通过安装宝塔面板和部署LNMP环境，基于Docker搭建了halo博客应用。

探索云世界

423

官方博客-第24页-阿里云开发者社区

类目筛选

内容类型

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

解锁 DeepSeek 安全接入、稳定运行新路径

进行GPU算力管理

阿里云容器服务 ACK AI 助手正式上线

阿里云大降价后，再谈“降本增效”

Multi-Agent实践第7期：智能体的高效协作

Higress 全新 Wasm 运行时，性能大幅提升

得物 ZooKeeper SLA 也可以 99.99%丨最佳实践

基于Docker搭建halo博客

官方博客-第24页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

解锁 DeepSeek 安全接入、稳定运行新路径

进行GPU算力管理

阿里云容器服务 ACK AI 助手正式上线

阿里云大降价后，再谈“降本增效”

Multi-Agent实践第7期：智能体的高效协作

Higress 全新 Wasm 运行时，性能大幅提升

得物 ZooKeeper SLA 也可以 99.99%丨最佳实践

基于Docker搭建halo博客