官方博客-第22页-阿里云开发者社区

亦达

2025-02-20

746

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

vLLM 是一种便捷的大型语言模型（LLM）推理服务，旨在简化个人和企业用户对复杂模型的使用。通过 vLLM，用户可以轻松发起推理请求，享受高效、稳定的 LLM 服务。针对大规模部署 vLLM 的挑战，如大模型参数量、高效推理能力和上下文理解等，阿里云函数计算（FC）提供了 GPU 预留实例闲置计费功能，优化了性能、成本和稳定性之间的平衡。此外，FC 支持简便的部署流程和多种应用集成方式，帮助企业快速上线并管理 vLLM 服务。总结来说，vLLM 结合 FC 的解决方案为企业提供了强大的技术支持和灵活的部署选项，满足不同业务需求。

亦达

746

阿里云云原生

2025-04-17

1277

通义灵码 Rules 库合集来了，覆盖Java、TypeScript、Python、Go、JavaScript 等

通义灵码新上的外挂 Project Rules 获得了开发者的一致好评：最小成本适配我的开发风格、相当把团队经验沉淀下来，是个很好功能……

阿里云云原生

1,277

阿里云云原生

2025-05-12

1041

如何在通义灵码里使用 MCP 能力

通义灵码支持MCP工具使用，通过模型自主规划实现工具调用，深度集成魔搭MCP广场，涵盖2400+热门服务。提供STDIO和SSE两种通信模式，适用于不同场景需求。用户可通过智能体模式调用MCP工具，完成如网页内容抓取、天气查询等任务。文档详细介绍了服务配置、使用流程及常见问题解决方法，助力开发者高效拓展AI编码能力。

阿里云云原生

1,041

阿里云云原生

2025-05-23

582

MCP Server 实践之旅第 3 站：MCP 协议亲和性的技术解析

本文将以 MCP Server 在函数计算平台的深度集成为研究载体，解构基于 SSE 长连接通信模型，剖析会话亲和、优雅升级等关键技术，揭示 Serverless 架构在 MCP 场景中的亲和性创新实践。

阿里云云原生

582

隆基

2024-05-15

88963

RocketMQ 流存储解析：面向流场景的关键特性与典型案例

隆基

88,963

ModelScope

2024-05-15

1155

LISA微调技术解析：比LoRA更低的显存更快的速度

LISA是Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning的简写，由UIUC联合LMFlow团队于近期提出的一项LLM微调技术，可实现把全参训练的显存使用降低到之前的三分之一左右，而使用的技术方法却是非常简单。

ModelScope

1,155

仲阳

2024-06-13

14503

阿里云运维第一步（监控）：开箱即用的监控

监控运维是一个体系化的工作，完善这个体系非一日之功。但是我们的业务不可一日无监控“裸奔”，在阿里云怎么样快速低成本的建立第一道资源监控的护城河？开箱即用的云监控，将会是你进入阿里云的第一个可靠的小伙伴。

仲阳

14,503

阿里云云原生

2024-09-02

698

西游再现，一键部署 Flux 文生图大模型生成西游人物

从花果山的灵石出世，到取经路上的九九八十一难，再到大闹天宫的惊心动魄……这些耳熟能详的西游场景，如今都能通过 Flux 模型，以超乎想象的细节和真实感呈现在你眼前。本次实验在函数计算中内置的 flux.1-dev-fp8 大模型，搭配 Lora 模型，无需复杂的配置，一键部署，你就能成为这场视觉盛宴的创造者。

阿里云云原生

698

牧思

2024-12-02

557

一行代码都不改，Golang 应用链路指标日志全知道

本文将通过阿里云开源的 Golang Agent，帮助用户实现“一行代码都不改”就能获取到应用产生的各种观测数据，同时提升运维团队和研发团队的幸福感。

牧思

557

官方博客-第22页-阿里云开发者社区

类目筛选

内容类型

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

通义灵码 Rules 库合集来了，覆盖Java、TypeScript、Python、Go、JavaScript 等

如何在通义灵码里使用 MCP 能力

MCP Server 实践之旅第 3 站：MCP 协议亲和性的技术解析

RocketMQ 流存储解析：面向流场景的关键特性与典型案例

LISA微调技术解析：比LoRA更低的显存更快的速度

阿里云运维第一步（监控）：开箱即用的监控

西游再现，一键部署 Flux 文生图大模型生成西游人物

一行代码都不改，Golang 应用链路指标日志全知道

官方博客-第22页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

通义灵码 Rules 库合集来了，覆盖Java、TypeScript、Python、Go、JavaScript 等

如何在通义灵码里使用 MCP 能力

MCP Server 实践之旅第 3 站：MCP 协议亲和性的技术解析

RocketMQ 流存储解析：面向流场景的关键特性与典型案例

LISA微调技术解析：比LoRA更低的显存更快的速度

阿里云运维第一步（监控）：开箱即用的监控

西游再现，一键部署 Flux 文生图大模型生成西游人物

一行代码都不改，Golang 应用链路指标日志全知道