【行业应用】阿里云实时计算 Flink 版广告行业解决方案

本文涉及的产品
实时计算 Flink 版,1000CU*H 3个月
简介: 互联网广告领域经过长期发展,分工逐渐精细化,除了各种代理商之外,还出现了 ADN、SSP、ADX、DSP 等各种平台,市场结构极为复杂,形成了一个巨大的生态。

行业背景

广告业务一直是互联网公司的主要利润来源,其市场规模 2017 年已达 3000 亿元,据统计全球互联网市值前十的公司广告收入占比高达 40%,可见其重要性。而与互联网广告相关的技术,我们称之为计算广告,也是最为成熟,市场规模最大的大数据应用领域。互联网广告领域经过长期发展,分工逐渐精细化,除了各种代理商之外,还出现了 ADN、SSP、ADX、DSP 等各种平台,市场结构极为复杂,形成了一个巨大的生态。

互联网广告从诞生那一刻起就与技术紧密相关,这也是互联网广告相比传统线下广告更有优势的地方,通过大数据和机器学习等技术,互联网广告能够在个性化技术的基础上实现更精准的受众定位,不断提高受众与广告的匹配度,让目标群体在具象化的场景中看到精准投放的广告,达成三方共赢。

广告投放的基本流程是确定的,但每次决策会随着场景的变化产生不同的结果,其决策依据便来源于离线数据处理模块和在线数据处理模块,可以说这两部分是整个计算广告系统的神经中枢,也是决定计算广告系统最终效果的关键部分

解决方案

大数据的数据处理以离线计算为开端,所以很多应用实施在了离线计算引擎上,但随着在线计算引擎的发展,越来越多的业务都可以在线化、实时化。比如离线处理中人为决策的部分,其实可以改造成实时报表,甚至实时数仓,另外在线机器训练也越来越普及,在线业务的好处显而易见。

在广告行业中,整个广告的决策过程是一个实时、在线的过程,传统的离线技术则很难满足全部业务发展的需求。广告行业场景全面向实时化转型,包括:

  • 在线反作弊:互联网广告的核心是流量,流量作假将直接影响收益。据 ANA 统计,大约有 37% 的在线广告点击存在作弊,可见在线反作弊模块的重要性,处理不当可能造成巨大的资金浪费。
  • 在线计费:很多广告系统是程序化交易(如 DSP),每次点击都会扣除广告主相应的费用,这要求系统能够快速完成结算、扣除费用,并下线费用不足的广告。并且计费需要扣除作弊流量,维护广告主的权益。
  • 在线受众定向受众定向主要是计算用户的各种标签,有时用户短期内的行为更有参考价值,产出的短期标签更有效,比如受众突然看到某篇文章进而对某类产品产生了兴趣。这在效果类广告上更加明显。
  • 在线点击反馈:可以根据用户在线点击情况去调整 CTR 模型以更好的预估点击率。
  • 实时索引:广告是一种商业行为,广告主会根据当前广告的效果调整广告策略,每次调整后都需要尽快生效,否则将造成资金浪费,因此需要实时把广告的更新或发布都建到广告索引中去。
  • 实时广告链接检测:根据访问日志快速判断某些广告链接是否失效,如果失效则快速将其下线,防止资损。

成功案例

趣头条

“趣头条”是一款由上海基分文化传播有限公司开发的 APP。团队致力于通过大数据算法和云计算等技术,为用户提供内容及服务。在 2018 年,经过谨慎的技术架构对比,抛弃了 Spark Streaming 和 Storm,直接基于 Flink 搭建了实时计算平台。

Flink 目前在基分的应用非常广泛,支撑整个集团的产品,包括趣头条、米读、米读极速版、萌推等。业务场景主要是计费、监控、仓库、用户画像、算法、内容线六部分:

  • 计费,主要是计算广告商接入的计费成本,并与其进行结算。每次广告点击完成后,每个月可能会产生类似于离线报表的数据,目前如果需要切换成实时,基本只需要点击就会产生扣费环节,是非常核心的任务。
  • 监控,业务存在不同类型的监控需求,如:机器层面、应用层面等。
  • 仓库,目前基本是批量落数据,比如五分钟、十分钟,类似于窗口的间隔时间去落数据。
  • 用户画像,即将用户画像的一些数据通过 Flink 进行清洗,完成之后会落到 HDFS 上,用来做训练。
  • 算法,目前除了用户画像,还有推荐,当前不同用户打开 APP 之后会推荐不同的内容。
  • 内容线,主要用于风控,部分用户存在利用 APP 刷金币的行为,比如打开某个内容之后,不看内容而可在后台跑一百多个程序进行刷金币,目前通过 Flink 可以做到实时风控,能实时识别出某台设备是否是真正的用户,如果不是,就会将其屏蔽掉。

通过使用实时计算技术,平台可构建用户实时画像并对广告进行精准投放,提高点击率和转化率;实现精细化运营,提升平台对用户的吸引力,进而提高用户留存时长;对核心业务的实时监控,也保证了整体链路的稳定性和安全性。

实时计算 Flink 版产品交流群

test

阿里云实时计算Flink - 解决方案:
https://developer.aliyun.com/article/765097
阿里云实时计算Flink - 场景案例:
https://ververica.cn/corporate-practice
阿里云实时计算Flink - 产品详情页:
https://www.aliyun.com/product/bigdata/product/sc

相关实践学习
基于Hologres+Flink搭建GitHub实时数据大屏
通过使用Flink、Hologres构建实时数仓,并通过Hologres对接BI分析工具(以DataV为例),实现海量数据实时分析.
实时计算 Flink 实战课程
如何使用实时计算 Flink 搞定数据处理难题?实时计算 Flink 极客训练营产品、技术专家齐上阵,从开源 Flink功能介绍到实时计算 Flink 优势详解,现场实操,5天即可上手! 欢迎开通实时计算 Flink 版: https://cn.aliyun.com/product/bigdata/sc Flink Forward Asia 介绍: Flink Forward 是由 Apache 官方授权,Apache Flink Community China 支持的会议,通过参会不仅可以了解到 Flink 社区的最新动态和发展计划,还可以了解到国内外一线大厂围绕 Flink 生态的生产实践经验,是 Flink 开发者和使用者不可错过的盛会。 去年经过品牌升级后的 Flink Forward Asia 吸引了超过2000人线下参与,一举成为国内最大的 Apache 顶级项目会议。结合2020年的特殊情况,Flink Forward Asia 2020 将在12月26日以线上峰会的形式与大家见面。
相关文章
|
3月前
|
存储 JSON 数据处理
Flink基于Paimon的实时湖仓解决方案的演进
本文源自Apache CommunityOverCode Asia 2025,阿里云专家苏轩楠分享Flink与Paimon构建实时湖仓的演进实践。深度解析Variant数据类型、Lookup Join优化等关键技术,提升半结构化数据处理效率与系统可扩展性,推动实时湖仓在生产环境的高效落地。
382 0
Flink基于Paimon的实时湖仓解决方案的演进
|
4月前
|
存储 分布式计算 数据处理
「48小时极速反馈」阿里云实时计算Flink广招天下英雄
阿里云实时计算Flink团队,全球领先的流计算引擎缔造者,支撑双11万亿级数据处理,推动Apache Flink技术发展。现招募Flink执行引擎、存储引擎、数据通道、平台管控及产品经理人才,地点覆盖北京、杭州、上海。技术深度参与开源核心,打造企业级实时计算解决方案,助力全球企业实现毫秒洞察。
482 0
「48小时极速反馈」阿里云实时计算Flink广招天下英雄
|
9月前
|
存储 缓存 数据挖掘
Flink + Doris 实时湖仓解决方案
本文整理自SelectDB技术副总裁陈明雨在Flink Forward Asia 2024的分享,聚焦Apache Doris与湖仓一体解决方案。内容涵盖三部分:一是介绍Apache Doris,一款高性能实时分析数据库,支持多场景应用;二是基于Doris、Flink和Paimon的湖仓解决方案,解决批流融合与数据一致性挑战;三是Doris社区生态及云原生发展,包括存算分离架构与600多位贡献者的活跃社区。文章深入探讨了Doris在性能、易用性及场景支持上的优势,并展示了其在多维分析、日志分析和湖仓分析中的实际应用案例。
675 17
Flink + Doris 实时湖仓解决方案
|
9月前
|
存储 运维 监控
阿里妈妈基于 Flink+Paimon 的 Lakehouse 应用实践
本文总结了阿里妈妈数据技术专家陈亮在Flink Forward Asia 2024大会上的分享,围绕广告业务背景、架构设计及湖仓方案演进展开。内容涵盖广告生态运作、实时数仓挑战与优化,以及基于Paimon的湖仓方案优势。通过分层设计与技术优化,实现业务交付周期缩短30%以上,资源开销降低40%,并大幅提升系统稳定性和运营效率。文章还介绍了阿里云实时计算Flink版的免费试用活动,助力企业探索实时计算与湖仓一体化解决方案。
979 3
阿里妈妈基于 Flink+Paimon 的 Lakehouse 应用实践
|
9月前
|
存储 运维 BI
万字长文带你深入广告场景Paimon+Flink全链路探索与实践
本文将结合实时、离线数据研发痛点和当下Paimon的特性,以实例呈现低门槛、低成本、分钟级延迟的流批一体化方案,点击文章阅读详细内容~
|
9月前
|
SQL 弹性计算 DataWorks
Flink CDC 在阿里云 DataWorks 数据集成入湖场景的应用实践
Flink CDC 在阿里云 DataWorks 数据集成入湖场景的应用实践
412 6
|
9月前
|
存储 关系型数据库 MySQL
Flink基于Paimon的实时湖仓解决方案的演进
Flink基于Paimon的实时湖仓解决方案的演进
282 0
|
运维 数据处理 数据安全/隐私保护
阿里云实时计算Flink版测评报告
该测评报告详细介绍了阿里云实时计算Flink版在用户行为分析与标签画像中的应用实践,展示了其毫秒级的数据处理能力和高效的开发流程。报告还全面评测了该服务在稳定性、性能、开发运维及安全性方面的卓越表现,并对比自建Flink集群的优势。最后,报告评估了其成本效益,强调了其灵活扩展性和高投资回报率,适合各类实时数据处理需求。
|
存储 分布式计算 流计算
实时计算 Flash – 兼容 Flink 的新一代向量化流计算引擎
本文介绍了阿里云开源大数据团队在实时计算领域的最新成果——向量化流计算引擎Flash。文章主要内容包括:Apache Flink 成为业界流计算标准、Flash 核心技术解读、性能测试数据以及在阿里巴巴集团的落地效果。Flash 是一款完全兼容 Apache Flink 的新一代流计算引擎,通过向量化技术和 C++ 实现,大幅提升了性能和成本效益。
3603 73
实时计算 Flash – 兼容 Flink 的新一代向量化流计算引擎

相关产品

  • 实时计算 Flink版