官方博客-第14页-阿里云开发者社区

米基

2024-05-15

3860

大模型推理优化实践：KV cache复用与投机采样

在本文中，我们将详细介绍两种在业务中实践的优化策略：多轮对话间的 KV cache 复用技术和投机采样方法。我们会细致探讨这些策略的应用场景、框架实现，并分享一些实现时的关键技巧。

米基

3,860

才胜南也

2024-09-05

1014

RAG效果优化：高质量文档解析详解

本文关于如何将非结构化数据（如PDF和Word文档）转换为结构化数据，以便于RAG（Retrieval-Augmented Generation）系统使用。

才胜南也

1,014

阿里云瑶池数据库

2024-11-06

1768

大咖说｜Data+AI：企业智能化转型的核心驱动力

阿里云DMS+X：一站式Data+AI平台

阿里云瑶池数据库

1,768

施晨尹丰彬筱文李林杨黄俊等

2023-11-07

43776

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

基于原始的阿里云计算平台产技文档，搭建一套基于大模型检索增强答疑机器人。本方案已在阿里云线上多个场景落地，将覆盖阿里云官方答疑群聊、研发答疑机器人、钉钉技术服务助手等。线上工单拦截率提升10+%，答疑采纳率70+%，显著提升答疑效率。

施晨尹丰彬筱文李林杨黄俊等

43,776

扬流

2024-05-15

119166

Paimon 与 Spark 的集成（二）：查询优化

通过一系列优化，我们将 Paimon x Spark 在 TpcDS 上的性能提高了37+%，已基本和 Parquet x Spark 持平，本文对其中的关键优化点进行了详细介绍。

扬流

119,166

自扬

2024-08-16

8792

让X不断延伸, 从跨AZ到跨Region再到跨Cloud

本文从“空间”这一维度，聊一聊PolarDB-X在跨空间部署能力上的不断发展和延伸，以及在不同空间范围下的高可用和容灾能力，并着重介绍一下最新的产品能力——GDN(Global Database Network)。

自扬

8,792

赵世振

2025-01-07

2656

阿里云百炼xWaytoAGI共学课DAY1 - 必须了解的企业级AI应用开发知识点

本课程旨在介绍阿里云百炼大模型平台的核心功能和应用场景，帮助开发者和技术小白快速上手，体验AI的强大能力，并探索企业级AI应用开发的可能性。

赵世振

2,656

何亮阿里云云原生

2025-01-24

835

使用 Apifox、Postman 测试 Dubbo 服务，Apache Dubbo OpenAPI 即将发布

Apache Dubbo 3.3.3（即将发布）实现了与 OpenAPI 的深度集成，通过与 OpenAPI 的深度集成，用户能够体验到从文档生成到接口调试、测试和优化的全流程自动化支持。不论是减少手动工作量、提升开发效率，还是支持多语言和多环境，Dubbo 3.3.3 都展现了其对开发者体验的极大关注。结合强大的 Mock 数据生成和自动化测试能力，这一版本为开发者提供了极具竞争力的服务治理解决方案。如果你正在寻找高效、易用的微服务框架，Dubbo 3.3.3 将是你不容错过的选择。

何亮阿里云云原生

835

澄潭计缘望宸

2025-03-14

1024

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

通义千问最新推出的QwQ-32B推理模型，拥有320亿参数，性能媲美DeepSeek-R1（6710亿参数）。QwQ-32B支持在小型移动设备上本地运行，并可将企业大模型API调用成本降低90%以上。本文介绍了如何通过Higress AI网关实现DeepSeek-R1与QwQ-32B之间的无缝切换，涵盖环境准备、模型接入配置及客户端调用示例等内容。此外，还详细探讨了Higress AI网关的多模型服务、消费者鉴权、模型自动切换等高级功能，帮助企业解决TPS与成本平衡、内容安全合规等问题，提升大模型应用的稳定性和效率。

澄潭计缘望宸等

1,024

官方博客-第14页-阿里云开发者社区

类目筛选

内容类型

大模型推理优化实践：KV cache复用与投机采样

RAG效果优化：高质量文档解析详解

大咖说｜Data+AI：企业智能化转型的核心驱动力

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

Paimon 与 Spark 的集成（二）：查询优化

让X不断延伸, 从跨AZ到跨Region再到跨Cloud

阿里云百炼xWaytoAGI共学课DAY1 - 必须了解的企业级AI应用开发知识点

使用 Apifox、Postman 测试 Dubbo 服务，Apache Dubbo OpenAPI 即将发布

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

官方博客-第14页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

大模型推理优化实践：KV cache复用与投机采样

RAG效果优化：高质量文档解析详解

大咖说｜Data+AI：企业智能化转型的核心驱动力

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

Paimon 与 Spark 的集成（二）：查询优化

让X不断延伸, 从跨AZ到跨Region再到跨Cloud

阿里云百炼xWaytoAGI共学课DAY1 - 必须了解的企业级AI应用开发知识点

使用 Apifox、Postman 测试 Dubbo 服务，Apache Dubbo OpenAPI 即将发布

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要