首次!龙蜥社区联合清华、阿里云、江波龙提出CXL保护型键值存储架构,仅引入微量开销

简介: 基于 CXL 的共享内存键值存储也可以在较低安全开销下实现细粒度保护。

CXL(Compute Express Link)分布式共享内存为内存键值存储系统突破单机容量限制提供了新的路径。传统基于 TCP/IP 或 RDMA 的横向扩展会引入较高延迟开销,而 CXL 能让多主机以接近本地内存的方式共享字节可寻址内存。

为此,龙蜥社区 CXL SIG 成员单位——清华大学、阿里云与江波龙(Longsys)——联合首次提出 SHMemora,一个基于 CXL 共享内存的保护型多主机内存键值存储框架。该系统通过 MPK 隔离、基于 capability 的保护机制和元数据批处理,在真实 CXL 硬件上实现了安全访问与高性能扩展;相比 Redis,多主机场景平均吞吐提升 3.45 倍,安全保护平均吞吐开销仅 1.68%。

SHMemora 已被数据管理领域国际顶级会议 ICDE 2026 (IEEE International Conference on Data Engineering) 正式录用。它由龙蜥社区 CXL SIG 的三家核心成员单位清华大学、阿里云与江波龙 (Longsys)联合研发。江波龙为项目提供了真实的 CXL 2.0 硬件平台,支撑了 SHMemora 的原型实现与端到端评测;三方在龙蜥 CXL SIG 的框架下,围绕 CXL 内存池化、共享内存与系统软件方向持续深度协同,推动 CXL 生态从实验室原型走向真实业务场景的规模化落地。

一、方法

(图1SHMemora 系统架构概述)

SHMemora 的出现针对的是 CXL 共享内存环境下的安全缺口。现有 CXL 共享内存系统主要关注功能与性能,但当共享内存暴露给多个主机和线程时,缺少保护机制会使任意线程可能读取或破坏共享键值数据。

研究团队验证了在 CXL 共享内存上构建保护型 IMKVS 的可行性。SHMemora 通过受控 API 访问共享内存,所有 token 的创建、使用和撤销都经过保护路径,使多主机能够共享统一内存空间,同时避免未授权访问。

(图2:传统 IMKVS 模型与 SHMemora 共享内存模型概览


与传统 client-server 模型不同,SHMemora 利用 CXL 的原生 load/store 语义,让各主机直接访问共享内存中的元数据和 KV 数据。通过绕过显式网络通信与数据复制,SHMemora 能够更好地匹配 CXL 低延迟、细粒度访问的特性。

(图3SHMemora保护token生命周期图)

系统整体架构

3 展示了 SHMemora 的保护 token 生命周期。系统在插入新 KV 对时生成 token,将 token 注册到保护表中,并返回给客户端;后续 get update 操作携带 token 进入系统,由运行时检查 HMAC、有效位、访问边界和权限。

SHMemora 将共享内存划分为元数据、IMKVS 索引结构、IMKVS 数据和其他应用区域。元数据段维护保护哈希表,每个条目记录 Token ID、有效标记、偏移、大小和读写权限。

CXL安全访问

在每次共享内存访问过程中,线程必须通过 SHMemora 提供的保护 API。系统使用 Intel MPK 将共享内存默认设置为不可访问,只有可信库运行时能够在 API 内临时打开权限,并在访问结束后立即撤销。

Capability token 使用 64-bit Token ID 256-bit MAC 组成。访问时,系统重新计算 MAC 并检查权限;若 token 无效、越界或权限不匹配,请求会被拒绝。

二、评估

研究团队在江波龙真实 CXL 2.0 硬件上实现了 SHMemora,并通过微基准与真实工作负载评估其安全保护开销和多主机扩展能力,实验结果详见图5和图6。

(Figure 4. Latency and throughput comparison across varying host numbers.


实验数据表明,SHMemora 在不同主机数量下保持稳定扩展。与 Redis 相比,SHMemora 在多主机场景下平均吞吐提升 3.45 倍;在 12 主机配置下,系统平均吞吐达到 4.05 MOPS,delete 操作接近 6 MOPS。安全保护带来的平均吞吐开销仅为 1.68%。

此外,随着 value size 增大,系统延迟总体保持稳定。与未保护版本相比,SHMemora 仅在较大数据规模下出现轻微额外延迟,主要来自共享内存协调和权限检查。

(Figure 5. Latency and throughput comparison for YCSB workloads.

端到端工作负载结果表明,在 YCSB-A、B、C、D 多种访问模式下,SHMemora 维持了较高吞吐。与未保护版本相比,YCSB 工作负载中的平均延迟开销约 1.75%,吞吐下降约 2.25%。

此外,研究团队通过形式化证明和渗透测试验证了系统的保护能力。测试覆盖 Token 伪造、元数据篡改和越界访问等攻击场景,结果表明 SHMemora 能够正确保护元数据和数据。这表明基于 CXL 的共享内存键值存储也可以在较低安全开销下实现细粒度保护。

龙蜥社区 CXL SIG

龙蜥社区 CXL SIG 汇聚了芯片、模组、云厂商与高校研究团队,围绕 CXL 内存池化、共享内存、协议栈、驱动与调度,以及键值存储、数据库等上层系统持续深耕。欢迎业界同仁、研究者与开发者加入 SIG,与我们一起推动 CXL 在中国的规模化落地与生态繁荣:https://openanolis.cn/sig/cxl

—— 完 ——

相关文章
|
21天前
|
存储 人工智能 关系型数据库
湖库一体:2026年数据库架构的“终极答案”还是新瓶装旧酒?
2026年6月,OceanBase发布湖库一体AI数据库,阿里云PolarDB年初已推出AI数据湖库(Lakebase),Databricks也在6月推出了LTAP架构。“湖库一体”成为2026年数据库圈最热的概念之一。本文从湖库一体的概念定义出发,拆解其技术原理,对比“湖仓一体”与“湖库一体”的差异,分析三大厂商的落地路径,并讨论这一趋势对DBA和架构师的现实意义。
|
22天前
|
存储 弹性计算 前端开发
阿里云四款价格最便宜的云服务器解析:配置、价格、适用场景与选购指南参考
本文汇总了阿里云四款高性价比低价云服务器,覆盖不同用户需求。新用户可每日10点、15点抢购轻量应用服务器,2核2G峰值200M带宽仅38元/年,2核4G同带宽配置低至9.9元/月或199元/年,不限流量且预装建站、AI镜像,适合个人博客与小型网站。新老用户同享经济型e实例,2核2G固定3M带宽99元/年,续费同价可锁定至2030年,适配开发测试场景。企业用户可享通用算力型u1实例,2核4G 5M带宽199元/年,独享算力保障企业级稳定运行,覆盖电商、游戏等业务场景,是个人开发者与小微企业低成本上云的优质选择。
|
21天前
|
运维 负载均衡 数据可视化
手把手教你在阿里云上百炼调用DeepSeek-V4-Pro(Chatbox图形化界面)
本文介绍如何通过阿里云百炼平台调用DeepSeek-V4开源模型。用户只需开通百炼、获取API Key,下载Chatbox客户端并配置deepseek-v4-pro模型,即可在图形界面中零命令行操作完成调用。平台提供免运维、自动扩缩容与高稳定API服务,并赠送新人免费额度。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
21天前
|
达摩院 编译器 C语言
龙蜥与玄铁共建 RISC-V 编译器生态:五大 GCC 优化实践解法
围绕指令集功能支持与性能优化两大方向,剖析当前支持状态及与其他架构的差距,并分享了玄铁最新成果
|
21天前
|
SQL 监控 Serverless
阿里云国际版:函数计算FC超时怎么办?依赖、内存与日志排查指南
函数计算FC超时的本质,是函数在用户设定的最大执行时间内没能返回结果。这个时间理论上最长可以配到300秒甚至更久,但很多业务场景里,即便把上限拉满,一次冷启动配合模型推理依然会让函数撞线。
147 2
|
21天前
|
缓存 边缘计算 运维
阿里云国际站CDN:配置后网站不加速?
网站接入阿里云CDN后,控制台里能看到请求量,页面却还是老样子——源站带宽没降,响应时间未见缩短。这类现象的症结多半集中在同一个指标上:缓存命中率太低,导致本该在边缘解决的请求不断穿透回源。阿里云CDN缓存命中率低怎么解决,需要先把“配置了但没加速”的根因拆开来看。
192 1
|
22天前
|
数据采集 人工智能 监控
用GEO智能体做AI优化排名,你可能被坑的不止是钱?
本文揭露GEO智能体营销陷阱:成本仅数百元/月,却被包装成“AI核武器”售价上万;排名监控无效、AI生成内容易致降权;更严重的是浪费时间窗口、贬值内容资产、削弱团队能力、制造虚假成就感。GEO无捷径,核心在于沉淀独家知识与真实案例——弹药必须自己造。(239字)

热门文章

最新文章