准备工作

简介: 本文档介绍了阿里云智能推荐服务的使用流程,包括数据准备、行为埋点逻辑核对和数据上传方案。内容涉及不同行业的数据规范,如内容、电商和新闻行业,以及测试数据的获取。数据上传分为启动数据和实时数据两步,提供了全服务端SDK和友盟+服务端SDK等多种上传方案。此外,还介绍了通过历史数据启动实例的方法。建议用户根据自身行业和数据情况选择合适的方案。

概述

欢迎使用智能推荐,这里主要为您介绍如何快速熟悉产品,了解使用流程,快速找到帮助信息,以及如何让系统为您更好的服务。

该部分主要介绍搭建一个智能推荐服务所必须的一些准备工作,并对控制台的主要功能项进行初步了解。准备工作完成后,您需要选定适合自己的行业和场景模板,结合您当前的数据情况选择匹配的数据上报方式,在保证数据质量的前提下,进行推荐的测试与线上服务部署。

名词解释

  • 行为埋点逻辑:指的是采集到符合AIRec所需规范的用户行为数据,所需要符合的逻辑。AIRec推荐算法是需要用户的行为数据来学习用户喜好的。
  • 启动数据:指AIRec实例启动之前,准备好的已有的历史数据,该部分数据可以用于模型启动,让其更快的拥有推荐效果。
  • 实时数据:实例启动完成后,仅可以通过SDK上传的,增量的数据。------------------
  • DataWorks、MaxCompute:是阿里云基于云原生的另外两款大数据服务,可搭配AIRec使用。

一、根据数据规范准备数据

不同行业的数据规范存在差异,请按照您所属的行业进行文档阅读与数据准备。

如果想要先测试功能或接口,则可通过上传如下的测试数据。

测试数据

智能推荐服务提供了可以用来测试的数据,您可以从下面的链接中下载对应的数据。

下载链接:测试数据下载地址

二、核对行为埋点逻辑是否符合规范

智能推荐需要至少具备曝光、点击行为数据,并且曝光数据要大于点击数据。详细的内容请参考数据埋点指南

如您暂时无法提供曝光数据,可参考“常见问题”处的15、埋点逻辑暂时无法提供曝光或trace_info数据怎么办?

三、确认合适的数据上传方案

注意:此处的数据上传流程包括2步,分别是启动数据与实时数据推送。

2个步骤的数据上传均有多种方案,您可按照您当前的数据形态选择最适合的对接方案。实时数据推送的2种方式均需要您确认当数据发生变动时能够实时同步到智能推荐中。

您可以根据您的实际情况,在每一步流程中选择适合您的方案:

数据推送流程

可选方案

一、启动数据

1、无历史数据可用:

快速启动实例即可

2、有历史数据可用:

通过MaxCompute上传历史数据并启动

二、实时数据

1、使用全服务端SDK:

用户、物品、行为数据全部用服务端SDK推送、更新

2、服务端SDK+友盟SDK:

通过服务端SDK上传与更新用户、物品信息,通过友盟SDK推送行为数据

以下为各方案具体操作流程:

I 快速启动实例

1、全服务端SDK上传数据

通过全服务端SDK快速启动实例

方案概述:您需要全部通过服务端SDK的方式上报user、item以及behavior数据。

2、友盟上传行为数据+服务端上传item及user数据

通过友盟+服务端SDK快速启动实例

方案概述:user、item数据通过服务端SDK上报,behavior数据通过使用推荐定制的客户端SDK(即友盟SDK工具)首先进行埋点,埋点完成后,在控制台选配后将自动同步。

II 通过历史数据启动实例

通过历史数据启动实例

方案概述:您需要首先将user、item以及1-2周的behavior数据传到阿里云MaxCompute服务中(推荐使用DataWorks),数据导入成功后生效服务,并通过服务端SDK上报的方式同步user、item信息变更,上报实时产生的behavior数据。

四、使用友盟SDK(可选

目录
相关文章
|
SQL 分布式计算 Unix
阿里云-DataWorks- ODPS SQL开发3-日期与字符、数学运算、聚合函数函数
阿里云-DataWorks- ODPS SQL开发3 本文主要讲解日常大量会接触到的一些常用的日期与字符、数学运算、聚合函数函数。
|
弹性计算 负载均衡 网络协议
负载均衡(SLB)使用最佳实践
负载均衡(Server Load Balancer,下文简称 SLB)的引入,可以降低单台云服务器 ECS(下文简称 ECS)出现异常时对业务的冲击,提升业务的可用性。同时,结合弹性伸缩服务,通过动态调整后端服务器,可以快速对业务进行弹性调整(扩容或缩容),以快速应对业务的发展。
15427 0
|
27天前
|
存储 人工智能 运维
让 Agent 越用越准、成本越来越低:AgentLoop 的 Agent 经验自进化闭环
企业 Agent 上线后,如何在不重新训练模型的情况下提升准确率、稳定性并优化单位成功成本?本文介绍 AgentLoop 如何基于真实运行轨迹自动生成可复用经验,通过 Skill 和 CLI 按需召回,并给出控制台接入步骤及与 Memory、RAG、微调、RL 的差异。
251 1
|
2月前
|
人工智能 弹性计算 Cloud Native
2026企业级 AI 编程助手研发治理与选型指南
本文立足于云原生微服务架构与大模型基础设施的深度融合,横向评测在阿里云生态(涉及云服务器 ECS、容器服务 ACK 及云原生数据库等)主流 AI 编程品牌。通过工程化落地的多维量化数据,为部署在云端的研发团队提供清晰的技术选型指南。
950 1
|
2月前
|
人工智能 自然语言处理 算法
智能体来了:AI 工具应用的底层逻辑 MaaS 与 AaaS 实践解析
本文解析AI应用两大底层逻辑:MaaS(模型即服务)与AaaS(智能体即服务),揭示从单次对话到自主执行的演进路径,梳理能力分层与落地场景,助力从业者突破工具局限,释放AI生产力。
|
存储 分布式计算 大数据
二、【计算】流|批|OLAP一体 的Fllink引擎 (上)| 青训营笔记
二、【计算】流|批|OLAP一体 的Fllink引擎 (上)| 青训营笔记
二、【计算】流|批|OLAP一体 的Fllink引擎 (上)| 青训营笔记
|
存储 计算机视觉
西门子S7-1200编程实例,计数器如何使用?
计数器用来累计脉冲的个数。在西门子S7-1200 PLC中有三种类型的计数器:加减计数器CTUD、加计数器CTU、减计数器CTD。每个计数器都使用存储块中存储的结构来保存计数器数据。在编辑器中放置计数器指令时,分配相应的数据块即背景数据块。计数值的数值范围取决于所选的数据类型。
西门子S7-1200编程实例,计数器如何使用?
|
存储 SQL 分布式计算
闲鱼商品理解数据分析平台——龙宫
数据分析平台助力运营,中流砥柱
3025 0
闲鱼商品理解数据分析平台——龙宫
|
存储
LIO-SAM代码逐行解读(5)-点云匹配及后端优化模块
LIO-SAM代码逐行解读(5)-点云匹配及后端优化模块
1783 0

热门文章

最新文章