基于 MaxCompute 构建 Noxmobi 全球化精准营销系统| 学习笔记

简介: 快速学习基于 MaxCompute 构建 Noxmobi 全球化精准营销系统

开发者学堂课程【MaxCompute 行业应用及调优基于 MaxCompute 构建 Noxmobi 全球化精准营销系统】学习笔记,与课程紧密联系,让用户快速学习知识。

课程地址:https://developer.aliyun.com/learning/course/88/detail/1346


基于 MaxCompute 构建 Noxmobi 全球化精准营销系统


内容简介:

一、行业及公司背景介绍

二、广告业务和系统

三、相关技术及 MaxCompute 应用

四、遇到的问题

 

一、行业及公司背景介绍

数字营销含义:

全球广告市场规模约6000亿,其中约30%为互联网和移动互联网广告。

数字营销、互联网广告、在线广告、计算广告、程序化广告……。解决如何在互联网媒体上投放广告的问题。

广告主(需求方) :如何成本更低,效果更好。效果如何定义,品牌 or 效果媒体(供应方) :如何收益更高,长期or短期。

中间商:连接供需,赚差价.规模效应和垄断。

数字营销,应用最新的互联网技术来提高效率。

广告主:减少浪费,让最合适的人看到广告。

媒体:把广告位卖给最需要的人。

中间商:高效撮合交易。

 

二、广告业务和系统

广告业务的主要流程,广告系统的架构和我们的演进过程。

 

三、相关技术及 MaxCompute 应用

相关技术应用介绍:流式计算、高线计算、标签抽取、TargelingCTR 规估、Pacing

 

相关技术介绍

()流式计算 Spark Streaming 应用

主要解决实时报表和部分实时特征的计算问题

1、要求:

必须稳定,7x24小时

可按受秒级延迟

可根招吞吐量横向扩展

存在高要全球聚合的任务

2、方案:

Spark Streaming +Kata + Rds +Redis

原始日志压缩流式回传

中心节点部署,方便开发

3、问题:

稳定性和扩展性都高度依赖高速通道


()离线计算  MaxCompute 应用

解决各类数据计算问题,BI数据、广告报表、反作弊、标签抽取、特征数据计算、统一 用户标识、爬虫数据处理等。

从自建 Hadoop 集群,到EMR按量付费集群,再到 MaxCompute.

 

优势:

再也不用运维集群了

计算速度更快

真正按量付费,成本大幅降低

SQL 开发效事高、调试方便,资料足够

有一个还行的调度系统

直接享受大公司待遇

数据导入导出方案:

优先用数据同步服务,流式数据用 sdk ,实在不行就写脚本+tunnel

 

()特征计算和标签抽取

大部分特征和标签使用 SQL 计算

定义特征,最近-周内活跃天数, 则有0~7的取值定义标签规则,例如:

一周内活跃天、1天、2~3天、 4~5天、 6-7天的分别是不活跃、低活跃、中活跃、高活跃、极高活跃用户。

做好定义,然后就是展现SQL技巧的时候了

多用 with,注意代码风格

优先使用内建函数,无法满足的时候考虑使用 UDFUDAF. UDTF,还不行或者跑的太慢的时候使用 MapReduce,比如对一大批特征做等频高散化。

向未实现平台化,还需写代码,好像有个服务能实现上面的功能,待试用

 

()Targeting

相对于把特征输入模型而言,标签式 Targeting 主要是

方便人来操作,使用投放人的经验来优化。

Look-alike 方式的定向为寻找相似的人,种于用户为正

例,从所有用户中找到正例概率较大的人群。

 

()Ctr预估

预估转化事,可能是 ctr. CVT ctr'cvr

Ecpma ctr* price

Ecpm 为本次广告展现的收益期望值,将指导绝大部分投放相关策略。

Online model

Deep leaming


()Pacing

不止考虑单次展现的收益,而要在单次竞价时考虑对

全局收益的影响。

通过对流量分层和分时的统计和预估,用数学方法来

保证收益最大化。

方案来源于 Yahoo


四、遇到的问题

在实践中遇到了一些问题,有一些解决了,有一些还没有全球化部署。

相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
相关文章
|
机器学习/深度学习 算法 大数据
构建数据中台,为什么“湖仓一体”成了大厂标配?
在大数据时代,数据湖与数据仓库各具优势,但单一架构难以应对复杂业务需求。湖仓一体通过融合数据湖的灵活性与数据仓的规范性,实现数据分层治理、统一调度,既能承载海量多源数据,又能支撑高效分析决策,成为企业构建数据中台、推动智能化转型的关键路径。
|
SQL 分布式计算 大数据
大数据新视界 --大数据大厂之Hive与大数据融合:构建强大数据仓库实战指南
本文深入介绍 Hive 与大数据融合构建强大数据仓库的实战指南。涵盖 Hive 简介、优势、安装配置、数据处理、性能优化及安全管理等内容,并通过互联网广告和物流行业案例分析,展示其实际应用。具有专业性、可操作性和参考价值。
大数据新视界 --大数据大厂之Hive与大数据融合:构建强大数据仓库实战指南
|
消息中间件 分布式计算 大数据
大数据-166 Apache Kylin Cube 流式构建 整体流程详细记录
大数据-166 Apache Kylin Cube 流式构建 整体流程详细记录
372 5
|
存储 SQL 分布式计算
大数据-162 Apache Kylin 全量增量Cube的构建 Segment 超详细记录 多图
大数据-162 Apache Kylin 全量增量Cube的构建 Segment 超详细记录 多图
388 3
|
传感器 人工智能 大数据
高科技生命体征探测器、情绪感受器以及传感器背后的大数据平台在健康监测、生命体征检测领域的设想与系统构建
本系统由健康传感器、大数据云平台和脑机接口设备组成。传感器内置生命体征感应器、全球无线定位、人脸识别摄像头等,搜集超出现有科学认知的生命体征信息。云平台整合大数据、云计算与AI,处理并传输数据至接收者大脑芯片,实现实时健康监测。脑机接口设备通过先进通讯技术,实现对健康信息的实时感知与反馈,确保身份验证与数据安全。
|
存储 分布式计算 物联网
美的楼宇科技基于阿里云 EMR Serverless Spark 构建 LakeHouse 湖仓数据平台
美的楼宇科技基于阿里云 EMR Serverless Spark 建设 IoT 数据平台,实现了数据与 AI 技术的有效融合,解决了美的楼宇科技设备数据量庞大且持续增长、数据半结构化、数据价值缺乏深度挖掘的痛点问题。并结合 EMR Serverless StarRocks 搭建了 Lakehouse 平台,最终实现不同场景下整体性能提升50%以上,同时综合成本下降30%。
1260 58
|
分布式计算 Shell MaxCompute
odps测试表及大量数据构建测试
odps测试表及大量数据构建测试
|
存储 SQL 分布式计算
MaxCompute x 聚水潭:基于近实时数仓解决方案构建统一增全量一体化数据链路
聚水潭作为中国领先的电商SaaS ERP服务商,致力于为88,400+客户提供全链路数字化解决方案。其核心ERP产品助力企业实现数据驱动的智能决策。为应对业务扩展带来的数据处理挑战,聚水潭采用MaxCompute近实时数仓Delta Table方案,有效提升数据新鲜度和计算效率,提效比例超200%,资源消耗显著降低。未来,聚水潭将进一步优化数据链路,结合MaxQA实现实时分析,赋能商家快速响应市场变化。
537 0
|
SQL 存储 HIVE
鹰角基于 Flink + Paimon + Trino 构建湖仓一体化平台实践项目
本文整理自鹰角网络大数据开发工程师朱正军在Flink Forward Asia 2024上的分享,主要涵盖四个方面:鹰角数据平台架构、数据湖选型、湖仓一体建设及未来展望。文章详细介绍了鹰角如何构建基于Paimon的数据湖,解决了Hudi入湖的痛点,并通过Trino引擎和Ranger权限管理实现高效的数据查询与管控。此外,还探讨了湖仓一体平台的落地效果及未来技术发展方向,包括Trino与Paimon的集成增强、StarRocks的应用以及Paimon全面替换Hive的计划。
2108 1
鹰角基于 Flink + Paimon + Trino 构建湖仓一体化平台实践项目

热门文章

最新文章