官方博客-第8页-阿里云开发者社区

骆天

2024-05-15

3684

高并发架构设计三大利器：缓存、限流和降级

软件系统有三个追求：高性能、高并发、高可用，俗称三高。本篇讨论高并发，从高并发是什么到高并发应对的策略、缓存、限流、降级等。

骆天

3,684

米基

2024-05-15

3778

大模型推理优化实践：KV cache复用与投机采样

在本文中，我们将详细介绍两种在业务中实践的优化策略：多轮对话间的 KV cache 复用技术和投机采样方法。我们会细致探讨这些策略的应用场景、框架实现，并分享一些实现时的关键技巧。

米基

3,778

牧申景穆

2024-09-02

3176

【算法精讲系列】阿里云百炼SFT微调实践分享

本内容为您提供了百炼平台SFT微调的实践案例，帮助您方便并快速借助模型微调定制化您自己的专属模型。

牧申景穆

3,176

赵世振

2024-12-24

1274

探索大型语言模型LLM推理全阶段的JSON格式输出限制方法

本篇文章详细讨论了如何确保大型语言模型（LLMs）输出结构化的JSON格式，这对于提高数据处理的自动化程度和系统的互操作性至关重要。

赵世振

1,274

ModelScope

2025-06-16

535

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

生成式模型在文本生成图片等领域的快速发展，为社区带来了日新月异的诸多文生图模型。

ModelScope

535

施晨尹丰彬筱文李林杨黄俊等

2023-11-07

43715

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

基于原始的阿里云计算平台产技文档，搭建一套基于大模型检索增强答疑机器人。本方案已在阿里云线上多个场景落地，将覆盖阿里云官方答疑群聊、研发答疑机器人、钉钉技术服务助手等。线上工单拦截率提升10+%，答疑采纳率70+%，显著提升答疑效率。

施晨尹丰彬筱文李林杨黄俊等

43,715

望宸

2025-02-28

1081

DeepSeek加速了模型平权，大模型推理需求激增，性能提升主战场从训练转向推理。SSE（Server-Sent Events）和WebSocket成为大模型应用的标配网络通信协议。SSE适合服务器单向推送实时数据，如一问一答场景；WebSocket支持双向实时通信，适用于在线游戏、多人协作等高实时性场景。两者相比传统HTTPS协议，能更好地支持流式输出、长时任务处理和多轮交互，满足大模型应用的需求。随着用户体量扩大，网关层面临软件变更、带宽成本及恶意攻击等挑战，需通过无损上下线、客户端重连机制、压缩算法及安全防护措施应对。

望宸

1,081

刘佳旭

2023-09-26

138992

云原生场景下高可用架构的最佳实践

刘佳旭

138,992

阿里云存储

2024-05-15

140387

用软硬协同设计下的飞天盘古降低存储系统开销

历经 15 载，如今的飞天盘古系统已迭代至第三代，数千万行代码和 1,000 余项专利，从大规模、到高性能、到高效能的分布式存储系统的演进，更高效地让数据中心成为一台计算机。

阿里云存储

140,387

官方博客-第8页-阿里云开发者社区

类目筛选

内容类型

高并发架构设计三大利器：缓存、限流和降级

大模型推理优化实践：KV cache复用与投机采样

【算法精讲系列】阿里云百炼SFT微调实践分享

探索大型语言模型LLM推理全阶段的JSON格式输出限制方法

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

大模型推理主战场：通信协议的标配

云原生场景下高可用架构的最佳实践

用软硬协同设计下的飞天盘古降低存储系统开销

官方博客-第8页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

高并发架构设计三大利器：缓存、限流和降级

大模型推理优化实践：KV cache复用与投机采样

【算法精讲系列】阿里云百炼SFT微调实践分享

探索大型语言模型LLM推理全阶段的JSON格式输出限制方法

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

大模型推理主战场：通信协议的标配

云原生场景下高可用架构的最佳实践

用软硬协同设计下的飞天盘古降低存储系统开销