官方博客-第26页-阿里云开发者社区

ModelScope

2024-05-15

1125

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

1,125

阿里云实时数仓Hologres

2024-06-27

2933

实时数仓Hologres OLAP场景核心能力介绍

Hologres提供统一、实时、弹性、易用的一站式实时数仓引擎，解决复杂OLAP难题。

阿里云实时数仓Hologres

2,933

阿里云百炼

2024-07-09

1462

阿里云百炼应用实践系列-基于LlamaIndex的文档问答助手

本文以阿里云百炼官方文档问答助手为例，介绍如何基于阿里云百炼平台打造基于LlamaIndex的RAG文档问答产品。我们基于阿里云百炼平台的底座能力，以官方帮助文档为指定知识库，搭建了问答服务，支持钉钉、Web访问。介绍了相关技术方案和主要代码，供开发者参考。

阿里云百炼

1,462

邢云阳

2024-08-20

19099

AI 网关零代码解决 AI 幻觉问题

本文主要介绍了 AI Agent 的背景，概念，探讨了 AI Agent 网关插件的使用方法，效果以及实现原理。

邢云阳

19,099

计缘

2024-09-02

1632

基于阿里云函数计算（FC）x 云原生 API 网关构建生产级别 LLM Chat 应用方案最佳实践

本文带大家了解一下如何使用阿里云Serverless计算产品函数计算构建生产级别的LLM Chat应用。该最佳实践会指导大家基于开源WebChat组件LobeChat和阿里云函数计算（FC）构建企业生产级别LLM Chat应用。实现同一个WebChat中既可以支持自定义的Agent，也支持基于Ollama部署的开源模型场景。

计缘

1,632

铖朴层风

2024-11-06

1037

10 倍性能提升， GraalVM 应用可观测实践

本文介绍了 GraalVM 静态编译技术在云原生环境下的应用：ARMS 发布了支持 GraalVM 应用的 Java Agent 探针，可为 GraalVM 应用提供开箱即用的可观测能力。同时，文章还提供了使用 ARMS 对 GraalVM 应用进行可观测的详细步骤。

铖朴层风

1,037

片风

2025-01-14

492

政采云业务网关实践：使用 Higress 统一替代 APISIX/Kong/Istio Ingress

政采云基础架构团队技术专家朱海峰介绍了业务网关项目的背景和解决方案。

片风

492

阿里云网络

2025-01-16

967

NSDI'24 | 阿里云飞天洛神云网络论文解读——《Poseidon》揭秘新型超高性能云网络控制器

NSDI‘24于4月16-18日在美国加州圣塔克拉拉市举办，汇聚全球网络系统领域的专家。阿里云飞天洛神云网络的两篇论文入选，标志着其创新能力获广泛认可。其中，《Poseidon: A Consolidated Virtual Network Controller that Manages Millions of Tenants via Config Tree》介绍了波塞冬平台，该平台通过统一控制器架构、高性能配置计算引擎等技术，实现了对超大规模租户和设备的高效管理，显著提升了云网络性能与弹性。实验结果显示，波塞冬在启用EIP时的完成时间比Top 5厂商分别快1.8至55倍和2.6至4.8倍。

阿里云网络

967

望宸

2025-02-07

735

浏览量超 10w 的热图，描述 RAG 的主流架构

大模型性能的持续提升，进一步挖掘了 RAG 的潜力，RAG 将检索系统与生成模型相结合，带来诸多优势，如实时更新知识、降低成本等。点击本文，为您梳理 RAG 的基本信息，并介绍提升大模型生成结果的方法，快一起看看吧~

望宸

735

官方博客-第26页-阿里云开发者社区

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

实时数仓Hologres OLAP场景核心能力介绍

阿里云百炼应用实践系列-基于LlamaIndex的文档问答助手

AI 网关零代码解决 AI 幻觉问题

基于阿里云函数计算（FC）x 云原生 API 网关构建生产级别 LLM Chat 应用方案最佳实践

10 倍性能提升， GraalVM 应用可观测实践

政采云业务网关实践：使用 Higress 统一替代 APISIX/Kong/Istio Ingress

NSDI'24 | 阿里云飞天洛神云网络论文解读——《Poseidon》揭秘新型超高性能云网络控制器

浏览量超 10w 的热图，描述 RAG 的主流架构

官方博客-第26页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

实时数仓Hologres OLAP场景核心能力介绍

阿里云百炼应用实践系列-基于LlamaIndex的文档问答助手

AI 网关零代码解决 AI 幻觉问题

基于阿里云函数计算（FC）x 云原生 API 网关构建生产级别 LLM Chat 应用方案最佳实践

10 倍性能提升， GraalVM 应用可观测实践

政采云业务网关实践：使用 Higress 统一替代 APISIX/Kong/Istio Ingress

NSDI'24 | 阿里云飞天洛神云网络论文解读——《Poseidon》揭秘新型超高性能云网络控制器

浏览量超 10w 的热图，描述 RAG 的主流架构