Cache 新春 | Tair KVCache 商业化暨开源发布会邀您线上观看!

简介: AI 推理正面临“显存墙”困境:GPU 显存告急、扩容成本高、长序列卡顿。2月4日立春阿里云将发布 Tair KVCache 商业版并开源 KVCache Manager 与 HiSim 仿真工具,联合 NVIDIA Dynamo AIConfigurator 等伙伴打造存算分离的AI基础设施,开启推理效率新范式。

随着 DeepSeek R1、Qwen 2.5 等长文本模型与 Agentic AI 的爆发,推理系统的瓶颈正从“算力”向“显存”转移。GPU 显存告急、扩容成本高昂、长序列推理卡顿,是否成为了阻碍业务创新的“显存墙”?


立春之日,破冰之时,阿里云诚挚邀请您参加《Tair KVCache 商业化暨开源发布会》,一同推开 AI 推理效率的新大门!


💻技术盛宴:六大核心议题,全景揭秘下一代推理底座

  • 从理论突破、开源工具到生产实践、商业服务,覆盖完整落地链路
  • 汇集 NVIDIA Dynamo AIConfigurator、RTP 、Mooncake 等生态伙伴,展现全栈优化实力
  • 企业级 Tair KVCache 商业化服务开箱即用,助力业务快速跨越“显存墙”


本次发布会,阿里云数据库 Tair 团队将重磅开源企业级全局管理服务 Tair KVCache Manager 及高保真仿真工具 Tair-KVCache-HiSim。我们将深度解密 Tair 如何通过存算分离架构,联 NVIDIA Dynamo AIConfigurator、RTP、Mooncake 等生态伙伴,打造“计算-存储-调度”一体化的 AI 基础设施。同时,Tair KVCache 商业版将正式亮相,为企业提供开箱即用、极致性价比的推理加速服务。这不仅是一次产品的发布,更是一场关于 AI 记忆管理的范式革命。


📅 直播时间

2026年2月4日(立春) 14:00

👉 直播链接

点此预约,获取开播提醒:https://www.aliyun.com/activity/database/tair-kvcache-release

发布会海报.jpeg

相关文章
|
9月前
|
人工智能 关系型数据库 分布式数据库
|
2月前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
4480 148
|
7月前
|
存储 关系型数据库 分布式数据库
阿里云PolarDB PolarStore获得顶会 FAST'26 最佳论文提名
阿里云瑶池数据库PolarStore团队论文《PolarStore: High-Performance Data Compression for Large-Scale Cloud-Native Databases》获得顶会 FAST'26 最佳论文提名(全球仅5篇)。
阿里云PolarDB PolarStore获得顶会 FAST'26 最佳论文提名
|
9月前
|
监控 安全 Unix
iOS 崩溃排查不再靠猜!这份分层捕获指南请收好
从 Mach 内核异常到 NSException,从堆栈遍历到僵尸对象检测,阿里云 RUM iOS SDK 基于 KSCrash 构建了一套完整、异步安全、生产可用的崩溃捕获体系,让每一个线上崩溃都能被精准定位。
2959 163
|
存储 缓存 NoSQL
阿里云 Tair 联手 SGLang 共建 HiCache,构建面向“智能体式推理”的缓存新范式
本文系统剖析面向智能体推理的 KVCache 技术演进,针对传统机制在长上下文、多轮决策与多智能体协同中的状态膨胀、持久化缺失和缓存孤立三大瓶颈,介绍阿里云 Tair KVCache 团队联合 SGLang 社区推出的 HiCache 分层缓存体系。该方案通过显存-内存-3FS 多级卸载与全局共享,实现缓存命中率提升至80%,TTFT 降低56%,推理 QPS 翻倍,支撑智能体时代的大模型高效推理。
|
8月前
|
Kubernetes 应用服务中间件 API
应对 Nginx Ingress 退役,是时候理清这些易混淆的概念了
本文希望提供一种更简单的方式,来理解这些容易混淆的技术概念:Nginx、Ingress、Ingress Controller、Ingress API、Nginx Ingress、Higress、Gateway API。
3975 181