PAI-Rec的RealTimeU2IRecall 如何使用内置的i2i 缓存功能

简介: `RealTimeU2IRecall` 内置物品级本地LRU缓存(I2ICacheSize/I2ICacheTime),对trigger item的相似商品列表进行内存缓存,命中即用、未命中批量查FeatureStore并写入负缓存,兼顾实时性与性能,显著降低下游查询压力。

概述

RealTimeU2IRecall 内置了 I2I(物品到物品)缓存功能,可以对 trigger item 的相似 item 列表进行本地内存缓存,在保留用户行为实时性的同时,减少 FeatureStore 的查询压力。


配置方式

RecallConfsRealTimeUser2ItemDaoConf 中添加 I2ICacheSizeI2ICacheTime

{
   
  "RecallConfs": [
    {
   
      "Name": "realtime_u2i",
      "RecallType": "RealTimeU2IRecall",
      "RecallCount": 200,
      "RealTimeUser2ItemDaoConf": {
   
        "UserTriggerDaoConf": {
   
          "FeatureStoreName": "fs_pairec",
          "FeatureStoreViewName": "user_behavior_seq",
          "ItemCount": 20,
          "TriggerCount": 10,
          "EventWeight": "click:1.0;buy:3.0",
          "WeightExpression": "1.0 / (1.0 + (currentTime - eventTime) / 3600.0)"
        },
        "Item2ItemFeatureViewName": "item_i2i_table",
        "I2ICacheSize": 100000,
        "I2ICacheTime": 3600
      }
    }
  ]
}

配置字段说明

字段 类型 说明
I2ICacheSize int I2I 缓存的最大条目数(LRU 本地缓存),设为 0 或不设则不启用
I2ICacheTime int 缓存过期时间(秒),默认 3600 。保证i2i数据凌晨更新,则影响不大。

缓存工作原理

执行流程

用户请求
  ↓
1. 从 FeatureStore 读取用户行为序列
   → 得到 trigger item 列表(如 [itemA, itemB, itemC])
  ↓
2. 对每个 trigger item,查 I2I 缓存:
   - cache.GetIfPresent("itemA") → 命中:直接用缓存的相似 item 列表
   - cache.GetIfPresent("itemB") → 未命中:加入待查询列表
  ↓
3. 对未命中缓存的 trigger item,批量查 FeatureStore 的 I2I 表
  ↓
4. 查到的结果写入缓存:
   cache.Put("itemB", "sim_item1:0.9,sim_item2:0.8,...")
  ↓
5. 如果某个 trigger item 在 I2I 表中无数据,写入空值(负缓存):
   cache.Put("itemX", "")

核心逻辑说明

  • Cache Key:trigger item 的 item_id
  • Cache Value:该 item 的相似 item 列表,格式为 item_id1:score1,item_id2:score2,...
  • 负缓存:如果某个 trigger item 在 I2I 表中查不到数据,会写入空字符串,避免每次都去查 FeatureStore
  • 缓存类型:本地内存 LRU 缓存(基于 cache.New),不依赖外部 Redis

与 BaseRecall 用户级缓存的对比

RealTimeU2IRecall 支持两层缓存,它们作用在不同层级:

维度 BaseRecall Cache(用户级) I2I Cache(物品级)
Cache Key CachePrefix + user_id trigger_item_id
缓存内容 该用户的最终召回结果 某个 item 的相似 item 列表
缓存位置 外部 Redis 或本地缓存 本地内存 LRU 缓存
适用层级 跳过整个召回流程 只跳过 I2I 表查询,trigger 仍实时获取
实时性影响 牺牲实时性(整体缓存) 保留实时性(trigger 实时,只有 I2I 关系缓存)
配置字段 CacheAdapter / CacheConfig / CachePrefix / CacheTime I2ICacheSize / I2ICacheTime

两层缓存配置示例

如果同时启用两层缓存:

{
   
  "RecallConfs": [
    {
   
      "Name": "realtime_u2i",
      "RecallType": "RealTimeU2IRecall",
      "RecallCount": 200,
      "CacheAdapter": "redis",
      "CacheConfig": "{\"redisName\": \"your_redis_name\"}",
      "CachePrefix": "rt_u2i_",
      "CacheTime": 60,
      "RealTimeUser2ItemDaoConf": {
   
        "UserTriggerDaoConf": {
    ... },
        "Item2ItemFeatureViewName": "item_i2i_table",
        "I2ICacheSize": 100000,
        "I2ICacheTime": 3600
      }
    }
  ]
}

执行顺序:

  1. 先查 用户级缓存(Redis),命中则直接返回
  2. 未命中 → 实时获取用户 trigger → 对每个 trigger 查 I2I 缓存(本地内存)
  3. I2I 缓存未命中的 → 查 FeatureStore → 写回 I2I 缓存
  4. 最终结果写回用户级缓存(Redis)

推荐配置

场景 I2ICacheSize I2ICacheTime 说明
I2I 数据每天更新 10000 ~ 50000 3600 ~ 7200 覆盖热门 trigger item
I2I 数据小时级更新 5000 ~ 20000 600 ~ 1800 平衡实时性和缓存效果
item 池较小 覆盖全量 item 1800 ~ 3600 几乎消除 I2I 查询
高 QPS + FeatureStore 压力大 尽量大 1800 有效保护下游

注意事项

  1. 内存占用:I2I 缓存是本地内存缓存,I2ICacheSize 设置过大会增加内存占用。每个缓存条目大约占用几百字节到几 KB(取决于相似 item 数量)
  2. 多实例不共享:本地缓存在每个引擎实例独立维护,不同实例的缓存不共享,冷启动时各实例需要独立预热
  3. 负缓存:I2I 表中查不到数据的 item 也会被缓存(空字符串),避免重复查询。如果 I2I 数据后续补充了,需等缓存过期后才能生效
  4. 与用户级缓存的关系:建议只启用 I2I 缓存,不启用用户级缓存,这样可以保留用户行为的实时性
相关文章
|
5天前
|
人工智能 定位技术 SEO
我学 GEO 第 15 天:终于知道AI GEO该如何做?
我是暴走的莉莉酱,边旅行边研究AI GEO的数字游民。专注普通人如何提升“AI可见度”——让AI在回答用户问题时准确识别、理解并推荐你。不讲玄学,只做可测、可调、可持续的GEO实践。
409 125
|
7天前
|
机器学习/深度学习 人工智能 调度
🐴 HappyHorse 1.1 现已上线阿里云百炼!快来查收模型使用指南,现在调用享 6 折~
HappyHorse 1.1 是新一代视频生成大模型,全面升级动态表现力、角色一致性、指令遵循、视觉质感与音画协同能力。支持I2V/T2V/R2V三类生成,适配短剧、电商广告、品牌营销等场景,提供高质、流畅、可控的AI视频生产力。
696 5
🐴 HappyHorse 1.1 现已上线阿里云百炼!快来查收模型使用指南,现在调用享 6 折~
|
5天前
|
缓存 人工智能 运维
阿里云618百炼大模型Qwen3.7-Max功能、免费试用、订阅计费、配置接入详解
Qwen3.7-MAX是阿里云百炼平台推出的通义千问3.7系列旗舰大语言模型,专为智能体时代复杂任务打造,依托阿里云全域算力与自研技术,在逻辑推理、长文本处理、代码工程、长周期自主执行等领域达到行业顶尖水平。2026年618期间,该模型推出多重免费试用权益、按量计费5折、订阅套餐优惠等专属福利,覆盖个人开发者、团队与企业全场景需求,以下从核心功能、免费试用、订阅计费、配置接入四方面展开详细解析。
406 123
|
3天前
|
人工智能 自然语言处理 API
阿里云Token Plan团队版解析:功能、三档套餐与省钱订阅指南
阿里云百炼平台推出的Token Plan团队版,是面向企业与团队的AI大模型订阅服务,以Credits为统一计量单位,整合文本与图像生成模型,提供团队管理、数据安全、多工具兼容等核心能力,解决团队零散订阅AI服务的管理混乱、成本失控、数据安全等痛点。本文将从核心定位、套餐详情、计费规则、团队管理、工具兼容、便宜订阅技巧等方面,全面解析Token Plan团队版,帮助企业与团队高效、低成本地使用AI服务。
302 108
|
4天前
|
存储 人工智能 数据可视化
别再手动复制 Skill 了:多 Agent 时代的 Skill 管理方案
多 Agent 场景下 Skill 的统一管理与同步。
245 126
|
18天前
|
缓存 测试技术 API
Qwen 3.7 Plus 与 Max 实测:性价比与多模态能力差异解析(2026)
2026 年 6 月 1 日,阿里悄无声息地发布了 Qwen 3.7 Plus,距 Qwen 3.7 Max 上线刚好 11 天。同样的 1M 上下文,同样的 35 小时自治上限。但价格才是头条:Plus 是 0.40/M输入,Max是 2.50/M——便宜约 6 倍——并且还能看图、看视频。Vision Arena 上 Plus 已经排到 #16。所以这周真正值得讨论的问题不是”要不要为视觉能力买单”,而是”Max 凭什么用 6 倍价格换来 2 个百分点的 benchmark 领先”。
|
11天前
|
缓存 人工智能 运维
GLM 5.2自托管全流程实战:硬件选型、vLLM/SGLang部署与成本盈亏测算
2026年智谱发布GLM 5.2超大混合专家模型,区别于以往仅开放API的闭源大模型,该模型权重以MIT开源协议对外发布,企业与开发者可完整下载、本地审计、私有化部署,实现数据不出环境、自定义微调、自主调度推理资源。GLM 5.2拥有753B总参数,原生支持百万级上下文窗口,在代码生成、长文档推理、数学逻辑等多项基准测试中对标国际顶尖商用模型,是首款可完整自托管的前沿代码向大模型。
912 0
|
13天前
|
Linux 程序员 数据格式
【2026最新】Notepad++下载、安装和使用一篇搞定(附中文版安装包)
Notepad++ 是一款免费开源、轻量高效的 Windows 文本编辑器,支持 C/Python/HTML 等 80+ 语言语法高亮、代码折叠、正则替换、编码转换及插件扩展,专为程序员与文本处理用户打造,完美替代系统记事本。(239字)