官方博客-第19页-阿里云开发者社区

言澈

2025-02-28

1193

进行GPU算力管理

本篇主要简单介绍了在AI时代由‘大参数、大数据、大算力’需求下，对GPU算力管理和分配带来的挑战。以及面对这些挑战，GPU算力需要从单卡算力管理、单机多卡算力管理、多机多卡算力管理等多个方面发展出来的业界通用的技术。

言澈

1,193

澄潭计缘望宸

2025-03-14

997

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

通义千问最新推出的QwQ-32B推理模型，拥有320亿参数，性能媲美DeepSeek-R1（6710亿参数）。QwQ-32B支持在小型移动设备上本地运行，并可将企业大模型API调用成本降低90%以上。本文介绍了如何通过Higress AI网关实现DeepSeek-R1与QwQ-32B之间的无缝切换，涵盖环境准备、模型接入配置及客户端调用示例等内容。此外，还详细探讨了Higress AI网关的多模型服务、消费者鉴权、模型自动切换等高级功能，帮助企业解决TPS与成本平衡、内容安全合规等问题，提升大模型应用的稳定性和效率。

澄潭计缘望宸等

997

德灵

2024-05-15

118073

阿里云PAI大模型RAG对话系统最佳实践

本文为大模型RAG对话系统最佳实践，旨在指引AI开发人员如何有效地结合LLM大语言模型的推理能力和外部知识库检索增强技术，从而显著提升对话系统的性能，使其能更加灵活地返回用户查询的内容。适用于问答、摘要生成和其他依赖外部知识的自然语言处理任务。通过该实践，您可以掌握构建一个大模型RAG对话系统的完整开发链路。

德灵

118,073

阿里云云原生

2024-05-15

44123

得物 ZooKeeper SLA 也可以 99.99%丨最佳实践

在本文中，作者探讨了ZooKeeper（ZK）的一个内存占用问题，特别是当有大量的Watcher和ZNode时，导致的内存消耗。

阿里云云原生

44,123

阿里云云原生

2024-05-15

79784

让研发规范管得住，在流水线之上做研发流程

研发规范的目标，是为了解决或降低出现软件危机的风险。但传统流水线受限于工具的定位，无法解决研发规范的落地问题，需要在更高的层面来解决。阿里云云效团队经过内部启发后推出的新产品：云效应用交付平台 AppStack 给出了解决方案，快来使用体验吧！

阿里云云原生

79,784

ModelScope

2024-05-15

1141

LISA微调技术解析：比LoRA更低的显存更快的速度

LISA是Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning的简写，由UIUC联合LMFlow团队于近期提出的一项LLM微调技术，可实现把全参训练的显存使用降低到之前的三分之一左右，而使用的技术方法却是非常简单。

ModelScope

1,141

阿里云大数据Al技术

2024-08-09

9131

基于RAG搭建企业级知识库在线问答

本文介绍如何使用搜索开发工作台快速搭建基于RAG开发链路的知识库问答应用。

阿里云大数据Al技术

9,131

青风义泊牧思

2024-09-03

856

面向OpenTelemetry的Golang应用无侵入插桩技术

文章主要讲述了阿里云 ARMS 团队与程序语言与编译器团队合作研发的面向OpenTelemetry的Golang应用无侵入插桩技术解决方案，旨在解决Golang应用监控的挑战。

青风义泊牧思等

856

丛霄章进十眠

2024-11-06

1727

Serverless 微服务治理神器：阿里云 SAE 全链路灰度揭秘

SAE 会继续致力于为用户提供极简易用、成本低廉、功能强大的 Serverless 应用全托管平台：“我们希望让用户做的更少而收获更多，通过 Serverless 化，深度用云就像用水电煤一样简单”。

丛霄章进十眠等

1,727

官方博客-第19页-阿里云开发者社区

类目筛选

内容类型

进行GPU算力管理

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

阿里云PAI大模型RAG对话系统最佳实践

得物 ZooKeeper SLA 也可以 99.99%丨最佳实践

让研发规范管得住，在流水线之上做研发流程

LISA微调技术解析：比LoRA更低的显存更快的速度

基于RAG搭建企业级知识库在线问答

面向OpenTelemetry的Golang应用无侵入插桩技术

Serverless 微服务治理神器：阿里云 SAE 全链路灰度揭秘

官方博客-第19页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

进行GPU算力管理

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

阿里云PAI大模型RAG对话系统最佳实践

得物 ZooKeeper SLA 也可以 99.99%丨最佳实践

让研发规范管得住，在流水线之上做研发流程

LISA微调技术解析：比LoRA更低的显存更快的速度

基于RAG搭建企业级知识库在线问答

面向OpenTelemetry的Golang应用无侵入插桩技术

Serverless 微服务治理神器： 阿里云 SAE 全链路灰度揭秘

Serverless 微服务治理神器：阿里云 SAE 全链路灰度揭秘