官方博客-第23页-阿里云开发者社区

望宸

2025-02-20

644

大模型推理服务全景图

推理性能的提升涉及底层硬件、模型层，以及其他各个软件中间件层的相互协同，因此了解大模型技术架构的全局视角，有助于我们对推理性能的优化方案进行评估和选型。

望宸

644

亦达

2025-02-20

706

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

vLLM 是一种便捷的大型语言模型（LLM）推理服务，旨在简化个人和企业用户对复杂模型的使用。通过 vLLM，用户可以轻松发起推理请求，享受高效、稳定的 LLM 服务。针对大规模部署 vLLM 的挑战，如大模型参数量、高效推理能力和上下文理解等，阿里云函数计算（FC）提供了 GPU 预留实例闲置计费功能，优化了性能、成本和稳定性之间的平衡。此外，FC 支持简便的部署流程和多种应用集成方式，帮助企业快速上线并管理 vLLM 服务。总结来说，vLLM 结合 FC 的解决方案为企业提供了强大的技术支持和灵活的部署选项，满足不同业务需求。

亦达

706

橙唯

2025-02-21

896

基于LLM打造沉浸式3D世界

阿里云数据可视化产品DataV团队一直在三维交互领域进行前沿探索，为了解决LLMs与3D结合的问题，近期在虚幻引擎内结合通义千问大模型家族打造了一套基于LLM的实时可交互3D世界方案，通过自然语言来与引擎内的3D世界进行交互。

橙唯

896

封崇

2025-04-16

1417

MCP 正当时：FunctionAI MCP 开发平台来了！

MCP 的价值是统一了 Agent 和 LLM 之间的标准化接口，有了 MCP Server 的托管以及开发态能力只是第一步，接下来重要的是做好 MCP 和 Agent 的集成，FunctionAI 即将上线 Agent 开发能力，敬请期待。

封崇

1,417

孤弋孚阳

2025-05-07

489

破茧成蝶：阿里云应用服务器让传统 J2EE 应用无缝升级 AI 原生时代

本文详细介绍了阿里云应用服务器如何助力传统J2EE应用实现智能化升级。文章分为三部分：第一部分阐述了传统J2EE应用在智能化转型中的痛点，如协议鸿沟、资源冲突和观测失明；第二部分展示了阿里云应用服务器的解决方案，包括兼容传统EJB容器与微服务架构、支持大模型即插即用及全景可观测性；第三部分则通过具体步骤说明如何基于EDAS开启J2EE应用的智能化进程，确保十年代码无需重写，轻松实现智能化跃迁。

孤弋孚阳

489

阿里云云原生

2025-06-03

679

端午出游高定：通义灵码+高德 MCP 10 分钟定制出游攻略

本文介绍了如何使用通义灵码编程智能体与高德 MCP 2.0 制作北京端午3天旅行攻略页面。首先需下载通义灵码 AI IDE 并获取高德申请的 key，接着通过添加 MCP 服务生成 travel_tips.html 文件，最终在手机端查看已发布上线的攻略。此外还详细说明了利用通义灵码打造专属 MCP 服务的过程，包括开发计划、代码编写、部署及连接服务等步骤，并提供了自由探索的方向及相关资料链接。

阿里云云原生

679

王明橙鲤黄俊

2024-05-15

64114

通义千问开源模型在PAI灵骏的最佳实践

本文将展示如何基于阿里云PAI灵骏智算服务，在通义千问开源模型之上进行高效分布式继续预训练、指令微调、模型离线推理验证以及在线服务部署。

王明橙鲤黄俊等

64,114

隆基

2024-05-15

125835

深度剖析 RocketMQ 5.0，消息基础：RocketMQ 在业务消息场景的基础优势是什么？

本文主要介绍业务消息的应用解耦场景，具体解耦什么？ RocketMQ 在业务消息场景的基础特性。业界那么多消息队列能实现应用解耦，RocketMQ 在基础特性上有哪些增强？

隆基

125,835

隆基

2024-05-15

3777

深度剖析 RocketMQ 5.0，流存储：流场景的诉求是什么？

本文将从使用的角度出发，来更详细的展示一下流存储的场景，看看它和业务消息的场景有哪些区别。 RocketMQ 5.0 面向流存储的场景，提供了哪些特性。再结合两个数据集成的案例，来帮助大家了解流存储的用法。

隆基

3,777

官方博客-第23页-阿里云开发者社区

类目筛选

内容类型

大模型推理服务全景图

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

基于LLM打造沉浸式3D世界

MCP 正当时：FunctionAI MCP 开发平台来了！

破茧成蝶：阿里云应用服务器让传统 J2EE 应用无缝升级 AI 原生时代

端午出游高定：通义灵码+高德 MCP 10 分钟定制出游攻略

通义千问开源模型在PAI灵骏的最佳实践

深度剖析 RocketMQ 5.0，消息基础：RocketMQ 在业务消息场景的基础优势是什么？

深度剖析 RocketMQ 5.0，流存储：流场景的诉求是什么？

官方博客-第23页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

大模型推理服务全景图

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

基于LLM打造沉浸式3D世界

MCP 正当时：FunctionAI MCP 开发平台来了！

破茧成蝶：阿里云应用服务器让传统 J2EE 应用无缝升级 AI 原生时代

端午出游高定：通义灵码+高德 MCP 10 分钟定制出游攻略

通义千问开源模型在PAI灵骏的最佳实践

深度剖析 RocketMQ 5.0，消息基础：RocketMQ 在业务消息场景的基础优势是什么？

深度剖析 RocketMQ 5.0，流存储：流场景的诉求是什么？