官方博客-第12页-阿里云开发者社区

施晨尹丰彬筱文李林杨黄俊等

2023-11-07

43743

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

基于原始的阿里云计算平台产技文档，搭建一套基于大模型检索增强答疑机器人。本方案已在阿里云线上多个场景落地，将覆盖阿里云官方答疑群聊、研发答疑机器人、钉钉技术服务助手等。线上工单拦截率提升10+%，答疑采纳率70+%，显著提升答疑效率。

施晨尹丰彬筱文李林杨黄俊等

43,743

ModelScope

2024-05-15

1167

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

1,167

柳遵飞

2024-12-11

983

在 Spring Cloud 应用中可以非常低成本地集成 Nacos 实现配置动态刷新，在应用程序代码中通过 Spring 官方的注解 @Value 和 @ConfigurationProperties，引用 Spring enviroment 上下文中的属性值，这种用法的最大优点是无代码层面侵入性，但也存在诸多限制，为了解决问题，提升应用接入 Nacos 配置中心的易用性，Spring Cloud Alibaba 发布一套全新的 Nacos 配置中心的注解。

柳遵飞

983

阿里云云原生

2025-01-15

485

一键生成毛茸萌宠形象，基于函数计算极速部署 ComfyUI 生图系统

本次方案将帮助大家实现使用阿里云产品函数计算FC，只需简单操作，就可以快速配置ComfyUI大模型，创建出你的专属毛茸茸萌宠形象。内置基础大模型+常用插件+部分 Lora，以风格化图像生成只需用户让体验键配置简单方便，后续您可以根据自己的需要更换需要的模型、Lora、增加插件。

阿里云云原生

485

子白

2024-05-15

102467

大语言模型推理提速，TensorRT-LLM 高性能推理实践

大型语言模型（Large language models,LLM）是基于大量数据进行预训练的超大型深度学习模型，本文主要讲述TensorRT-LLM利用量化、In-Flight Batching、Attention、Graph Rewriting提升 LLM 模型推理效率。

子白

102,467

ModelScope

2024-05-15

1224

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

1,224

阿里云云原生

2024-05-16

57082

容器内存可观测性新视角：WorkingSet 与 PageCache 监控

本文介绍了 Kubernetes 中的容器工作内存（WorkingSet）概念，它用于表示容器内存的实时使用量，尤其是活跃内存。

阿里云云原生

57,082

青熙

2024-11-15

1246

AI经营｜多Agent择优生成商品标题

商品标题中关键词的好坏是商品能否被主搜检索到的关键因素，使用大模型自动优化标题成为【AI经营】中的核心能力之一，本文讲述大模型如何帮助商家优化商品素材，提升商品竞争力。

青熙

1,246

澄潭

2025-04-03

1864

开源 Remote MCP Server 一站式托管来啦！

MCP Server 的实施存在着诸多挑战，特别是在认证授权、服务可靠性和可观测性方面，Higress 作为 AI 原生的 API 网关，提供了完整的开源 MCP Server 托管解决方案，实现存量 API 到 MCP 的协议转换。即将上线的 MCP 市场，将大幅降低开发者构建 MCP Server 的时间和人力成本。

澄潭

1,864

官方博客-第12页-阿里云开发者社区

类目筛选

内容类型

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

vLLM部署Yuan2.0：高吞吐、更便捷

SpringCloud 应用 Nacos 配置中心注解

一键生成毛茸萌宠形象，基于函数计算极速部署 ComfyUI 生图系统

大语言模型推理提速，TensorRT-LLM 高性能推理实践

元象大模型开源30款量化版本加速低成本部署丨附教程

容器内存可观测性新视角：WorkingSet 与 PageCache 监控

AI经营｜多Agent择优生成商品标题

开源 Remote MCP Server 一站式托管来啦！

官方博客-第12页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

vLLM部署Yuan2.0：高吞吐、更便捷

SpringCloud 应用 Nacos 配置中心注解

一键生成毛茸萌宠形象，基于函数计算极速部署 ComfyUI 生图系统

大语言模型推理提速，TensorRT-LLM 高性能推理实践

元象大模型开源30款量化版本 加速低成本部署丨附教程

容器内存可观测性新视角：WorkingSet 与 PageCache 监控

AI经营｜多Agent择优生成商品标题

开源 Remote MCP Server 一站式托管来啦！

元象大模型开源30款量化版本加速低成本部署丨附教程