官方博客-第31页-阿里云开发者社区

望宸

2025-02-20

644

大模型推理服务全景图

推理性能的提升涉及底层硬件、模型层，以及其他各个软件中间件层的相互协同，因此了解大模型技术架构的全局视角，有助于我们对推理性能的优化方案进行评估和选型。

望宸

644

亦达

2025-02-20

706

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

vLLM 是一种便捷的大型语言模型（LLM）推理服务，旨在简化个人和企业用户对复杂模型的使用。通过 vLLM，用户可以轻松发起推理请求，享受高效、稳定的 LLM 服务。针对大规模部署 vLLM 的挑战，如大模型参数量、高效推理能力和上下文理解等，阿里云函数计算（FC）提供了 GPU 预留实例闲置计费功能，优化了性能、成本和稳定性之间的平衡。此外，FC 支持简便的部署流程和多种应用集成方式，帮助企业快速上线并管理 vLLM 服务。总结来说，vLLM 结合 FC 的解决方案为企业提供了强大的技术支持和灵活的部署选项，满足不同业务需求。

亦达

706

柯灵

2025-03-11

1572

QwQ-32B一键部署，真正的0代码，0脚本，0门槛

阿里云发布的QwQ-32B模型通过强化学习显著提升了推理能力，核心指标达到DeepSeek-R1满血版水平。用户可通过阿里云系统运维管理（OOS）一键部署OpenWebUI+Ollama方案，轻松将QwQ-32B模型部署到ECS，或连接阿里云百炼的在线模型。整个过程无需编写代码，全部在控制台完成，适合新手操作。

柯灵

1,572

封崇

2025-04-16

1417

MCP 正当时：FunctionAI MCP 开发平台来了！

MCP 的价值是统一了 Agent 和 LLM 之间的标准化接口，有了 MCP Server 的托管以及开发态能力只是第一步，接下来重要的是做好 MCP 和 Agent 的集成，FunctionAI 即将上线 Agent 开发能力，敬请期待。

封崇

1,417

阿里云云原生

2025-04-28

962

对比测评：AI编程工具需要 Rules 能力

通义灵码Project Rules是一种针对AI代码生成的个性化规则设定工具，旨在解决AI生成代码不精准或不符合开发者需求的问题。通过定义编码规则（如遵循SOLID原则、OWASP安全规范等），用户可引导模型生成更符合项目风格和偏好的代码。例如，在使用阿里云百炼服务平台的curl调用时，通义灵码可根据预设规则生成Java代码，显著提升代码采纳率至95%以上。此外，还支持技术栈、应用逻辑设计、核心代码规范等多方面规则定制，优化生成代码的质量与安全性。

阿里云云原生

962

孤弋孚阳

2025-05-07

489

破茧成蝶：阿里云应用服务器让传统 J2EE 应用无缝升级 AI 原生时代

本文详细介绍了阿里云应用服务器如何助力传统J2EE应用实现智能化升级。文章分为三部分：第一部分阐述了传统J2EE应用在智能化转型中的痛点，如协议鸿沟、资源冲突和观测失明；第二部分展示了阿里云应用服务器的解决方案，包括兼容传统EJB容器与微服务架构、支持大模型即插即用及全景可观测性；第三部分则通过具体步骤说明如何基于EDAS开启J2EE应用的智能化进程，确保十年代码无需重写，轻松实现智能化跃迁。

孤弋孚阳

489

阿里云云原生

2025-05-28

484

不懂 PromQL，AI 智能体帮你玩转大规模指标数据分析

PromQL AI 智能体上线。本文将从自然语言生成 PromQL 实践视角，探讨如何构建知识库、与大模型进行交互、最终生成符合需求的 PromQL 语句。本文还介绍了在 MCP 和云监控控制台下使用 AI 智能体的用例。

阿里云云原生

484

阿里云云原生

2025-06-03

679

端午出游高定：通义灵码+高德 MCP 10 分钟定制出游攻略

本文介绍了如何使用通义灵码编程智能体与高德 MCP 2.0 制作北京端午3天旅行攻略页面。首先需下载通义灵码 AI IDE 并获取高德申请的 key，接着通过添加 MCP 服务生成 travel_tips.html 文件，最终在手机端查看已发布上线的攻略。此外还详细说明了利用通义灵码打造专属 MCP 服务的过程，包括开发计划、代码编写、部署及连接服务等步骤，并提供了自由探索的方向及相关资料链接。

阿里云云原生

679

资源编排ROS

2019-12-23

1854

资源编排ROS之自定制资源（多云部署AWS篇）

资源编排服务（Resource Orchestration Service，简称ROS）是阿里云提供的一项简化云计算资源管理的服务。您可以遵循ROS定义的模板规范编写资源栈模板，在模板中定义所需的云计算资源（例如ECS实例、RDS数据库实例）、资源间的依赖关系等。

资源编排ROS

1,854

官方博客-第31页-阿里云开发者社区

类目筛选

内容类型

大模型推理服务全景图

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

QwQ-32B一键部署，真正的0代码，0脚本，0门槛

MCP 正当时：FunctionAI MCP 开发平台来了！

对比测评：AI编程工具需要 Rules 能力

破茧成蝶：阿里云应用服务器让传统 J2EE 应用无缝升级 AI 原生时代

不懂 PromQL，AI 智能体帮你玩转大规模指标数据分析

端午出游高定：通义灵码+高德 MCP 10 分钟定制出游攻略

资源编排ROS之自定制资源（多云部署AWS篇）

官方博客-第31页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

大模型推理服务全景图

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

QwQ-32B一键部署，真正的0代码，0脚本，0门槛

MCP 正当时：FunctionAI MCP 开发平台来了！

对比测评：AI编程工具需要 Rules 能力

破茧成蝶：阿里云应用服务器让传统 J2EE 应用无缝升级 AI 原生时代

不懂 PromQL，AI 智能体帮你玩转大规模指标数据分析

端午出游高定：通义灵码+高德 MCP 10 分钟定制出游攻略

资源编排ROS之自定制资源（多云部署AWS篇）