官方博客-第28页-阿里云开发者社区

亦达

2025-02-20

695

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

vLLM 是一种便捷的大型语言模型（LLM）推理服务，旨在简化个人和企业用户对复杂模型的使用。通过 vLLM，用户可以轻松发起推理请求，享受高效、稳定的 LLM 服务。针对大规模部署 vLLM 的挑战，如大模型参数量、高效推理能力和上下文理解等，阿里云函数计算（FC）提供了 GPU 预留实例闲置计费功能，优化了性能、成本和稳定性之间的平衡。此外，FC 支持简便的部署流程和多种应用集成方式，帮助企业快速上线并管理 vLLM 服务。总结来说，vLLM 结合 FC 的解决方案为企业提供了强大的技术支持和灵活的部署选项，满足不同业务需求。

亦达

695

阿里云云原生

2025-05-19

583

Higress MCP Server 安全再升级：API 认证为 AI 连接保驾护航

Higress MCP Server 新增了 API 认证功能，为 AI 连接提供安全保障。主要更新包括：1) 客户端到 MCP Server 的认证，支持 Key Auth、JWT Auth 和 OAuth2；2) MCP Server 到后端 API 的认证，增强第二阶段的安全性。新增功能如可重用认证方案、工具特定后端认证、透明凭证透传及灵活凭证管理，确保安全集成更多后端服务。通过 openapi-to-mcp 工具简化配置，减少手动工作量。企业版提供更高可用性保障，详情参见文档链接。

阿里云云原生

583

阿里云云原生

2025-05-23

537

MCP Server 实践之旅第 3 站：MCP 协议亲和性的技术解析

本文将以 MCP Server 在函数计算平台的深度集成为研究载体，解构基于 SSE 长连接通信模型，剖析会话亲和、优雅升级等关键技术，揭示 Serverless 架构在 MCP 场景中的亲和性创新实践。

阿里云云原生

537

ModelScope

2024-05-15

925

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

基于单个开源小模型的工具调用Agent，由于模型容量和预训练能力获取的限制，无法在推理和规划、工具调用、回复生成等任务上同时获得比肩大模型等性能。

ModelScope

925

ModelScope

2024-05-15

3513

Qwen1.5-MoE开源，魔搭社区推理训练最佳实践教程来啦

通义千问团队推出Qwen系列的首个MoE模型，Qwen1.5-MoE-A2.7B。

ModelScope

3,513

阿里云云原生

2024-05-15

410

实践总结｜前端架构设计的一点考究（下）

作者将【DDD、六边形、洋葱、清洁、CQRS】进行深入学习并梳理总结的一个前端架构设计，并且经历一定应用实践的考验。

阿里云云原生

410

张昕东

2024-07-25

14023

通义灵码：AI 研发趋势与效果提升实践丨SDCon 全球软件技术大会演讲全文整理

SDCon 全球软件技术大会上，阿里云通义灵码团队分享了关于 AI 辅助编码的最新研究与实践，随着 AIGC 技术的发展，软件研发领域将迎来智能化的新高度，助力 DevOps 流程优化，提升研发效率和研发幸福感。

张昕东

14,023

谷乂

2024-08-16

19948

Apache RocketMQ 批处理模型演进之路

RocketMQ 早期批处理模型存在一定的约束条件，为进一步提升性能，RocketMQ 进行了索引构建流水线改造，同时 BatchCQ 模型和 AutoBatch 模型也优化了批处理流程，提供了更简便的使用体验，快点击本文查看详情及配置展示~

谷乂

19,948

明巍临城水德

2024-11-14

511

通义灵码 SWE-GPT：从静态代码建模迈向软件开发过程长链推理

在本文中，作者介绍了 Lingma SWE-GPT，一款专为解决复杂软件改进任务设计的开源大型语言模型系列。

明巍临城水德等

511

官方博客-第28页-阿里云开发者社区

类目筛选

内容类型

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

Higress MCP Server 安全再升级：API 认证为 AI 连接保驾护航

MCP Server 实践之旅第 3 站：MCP 协议亲和性的技术解析

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

Qwen1.5-MoE开源，魔搭社区推理训练最佳实践教程来啦

实践总结｜前端架构设计的一点考究（下）

通义灵码：AI 研发趋势与效果提升实践丨SDCon 全球软件技术大会演讲全文整理

Apache RocketMQ 批处理模型演进之路

通义灵码 SWE-GPT：从静态代码建模迈向软件开发过程长链推理

官方博客-第28页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

破解 vLLM + DeepSeek 规模化部署的“不可能三角”

Higress MCP Server 安全再升级：API 认证为 AI 连接保驾护航

MCP Server 实践之旅第 3 站：MCP 协议亲和性的技术解析

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

Qwen1.5-MoE开源，魔搭社区推理训练最佳实践教程来啦

实践总结｜前端架构设计的一点考究（下）

通义灵码：AI 研发趋势与效果提升实践丨SDCon 全球软件技术大会演讲全文整理

Apache RocketMQ 批处理模型演进之路

通义灵码 SWE-GPT：从 静态代码建模 迈向 软件开发过程长链推理

通义灵码 SWE-GPT：从静态代码建模迈向软件开发过程长链推理