官方博客-第21页-阿里云开发者社区

探索云世界

2025-01-02

413

云端问道11期实践教学-创建专属AI助手

本次分享意在帮助用户更加全面、深入地了解百炼的核心产品能力，并通过实际操作学会如何快速将大模型与自己的系统及应用相结合。主要包括以下三个方面： 1. 阿里云百炼产品定位和能力简介 2. 知识检索 RAG 智能体应用能力和优势 3. 最佳落地案例实践分享

探索云世界

413

亦达

2025-02-20

746

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

vLLM 是一种便捷的大型语言模型（LLM）推理服务，旨在简化个人和企业用户对复杂模型的使用。通过 vLLM，用户可以轻松发起推理请求，享受高效、稳定的 LLM 服务。针对大规模部署 vLLM 的挑战，如大模型参数量、高效推理能力和上下文理解等，阿里云函数计算（FC）提供了 GPU 预留实例闲置计费功能，优化了性能、成本和稳定性之间的平衡。此外，FC 支持简便的部署流程和多种应用集成方式，帮助企业快速上线并管理 vLLM 服务。总结来说，vLLM 结合 FC 的解决方案为企业提供了强大的技术支持和灵活的部署选项，满足不同业务需求。

亦达

746

阿里云云原生

2025-04-17

1277

通义灵码 Rules 库合集来了，覆盖Java、TypeScript、Python、Go、JavaScript 等

通义灵码新上的外挂 Project Rules 获得了开发者的一致好评：最小成本适配我的开发风格、相当把团队经验沉淀下来，是个很好功能……

阿里云云原生

1,277

阿里云云原生

2025-05-23

582

MCP Server 实践之旅第 3 站：MCP 协议亲和性的技术解析

本文将以 MCP Server 在函数计算平台的深度集成为研究载体，解构基于 SSE 长连接通信模型，剖析会话亲和、优雅升级等关键技术，揭示 Serverless 架构在 MCP 场景中的亲和性创新实践。

阿里云云原生

582

隆基

2024-05-15

88963

RocketMQ 流存储解析：面向流场景的关键特性与典型案例

隆基

88,963

ModelScope

2024-05-15

1155

LISA微调技术解析：比LoRA更低的显存更快的速度

LISA是Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning的简写，由UIUC联合LMFlow团队于近期提出的一项LLM微调技术，可实现把全参训练的显存使用降低到之前的三分之一左右，而使用的技术方法却是非常简单。

ModelScope

1,155

仲阳

2024-06-13

14503

阿里云运维第一步（监控）：开箱即用的监控

监控运维是一个体系化的工作，完善这个体系非一日之功。但是我们的业务不可一日无监控“裸奔”，在阿里云怎么样快速低成本的建立第一道资源监控的护城河？开箱即用的云监控，将会是你进入阿里云的第一个可靠的小伙伴。

仲阳

14,503

坤硕

2024-07-29

20131

LLM 应用可观测性：从 Trace 视角展开的探索与实践之旅

基于大语言模型的应用在性能、成本、效果等方面存在一系列实际痛点，本文通过分析 LLM 应用模式以及关注点差异来阐明可观测技术挑战，近期阿里云可观测推出了面向 LLM 应用的可观测解决方案以及最佳实践，一起来了解下吧。

坤硕

20,131

阿里云云原生

2024-09-02

698

西游再现，一键部署 Flux 文生图大模型生成西游人物

从花果山的灵石出世，到取经路上的九九八十一难，再到大闹天宫的惊心动魄……这些耳熟能详的西游场景，如今都能通过 Flux 模型，以超乎想象的细节和真实感呈现在你眼前。本次实验在函数计算中内置的 flux.1-dev-fp8 大模型，搭配 Lora 模型，无需复杂的配置，一键部署，你就能成为这场视觉盛宴的创造者。

阿里云云原生

698

官方博客-第21页-阿里云开发者社区

类目筛选

内容类型

云端问道11期实践教学-创建专属AI助手

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

通义灵码 Rules 库合集来了，覆盖Java、TypeScript、Python、Go、JavaScript 等

MCP Server 实践之旅第 3 站：MCP 协议亲和性的技术解析

RocketMQ 流存储解析：面向流场景的关键特性与典型案例

LISA微调技术解析：比LoRA更低的显存更快的速度

阿里云运维第一步（监控）：开箱即用的监控

LLM 应用可观测性：从 Trace 视角展开的探索与实践之旅

西游再现，一键部署 Flux 文生图大模型生成西游人物

官方博客-第21页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

云端问道11期实践教学-创建专属AI助手

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

通义灵码 Rules 库合集来了，覆盖Java、TypeScript、Python、Go、JavaScript 等

MCP Server 实践之旅第 3 站：MCP 协议亲和性的技术解析

RocketMQ 流存储解析：面向流场景的关键特性与典型案例

LISA微调技术解析：比LoRA更低的显存更快的速度

阿里云运维第一步（监控）：开箱即用的监控

LLM 应用可观测性：从 Trace 视角展开的探索与实践之旅

西游再现，一键部署 Flux 文生图大模型生成西游人物