汇量科技使用倚天710云实例 高效处理大流量广告请求

简介: 汇量科技为全球移动开发者提供广告技术与营销技术服务,已累计服务全球7000多家互联网企业,其广告推理业务对云实例的CPU性能及内网带宽需求日益提高,通过使用阿里云g8y倚天云实例,实现了性能和网络带宽双双提升。汇量科技顺利承接了大流量广告业务请求,同时,与上一代g6系列对比单机成本更优,综合性价比进一步提升。

640.png

案例速览


行业:互联网广告服务

挑战:支撑业务快速发展、广告模型结构升级,提升技术需求的同时,实现降本增效

解决方案与产品:基于倚天710芯片的g8y倚天云实例、ESS弹性伸缩服务、Spot抢占式实例

成果:通过使用阿里云解决方案,汇量科技顺利承接了大流量接入广告业务请求。性能提升的同时,单机成本降低15-20%,综合性价比提升30%以上。


背景


汇量科技成立于2013年,是全球领先的第三方技术平台,提供包括用户获取、效果衡量、创意自动化、广告变现等全方位能力的Saas服务矩阵。其中,Mintegral、Nativex、热力引擎等品牌及旗下产品,形成了丰富且互为补充的产品形态。目前已累计服务112个国家的7000多家互联网企业,覆盖247个国家及地区。


随着汇量科技广告业务不断发展的同时,客户重点方向转向提升客户满意度、增强客户忠诚度,从而提高企业的市场竞争力,另外也要通过降本增效提高企业的运营效率,减少企业运营成本,提高经济效益等。


业务挑战


降本&技术需求:广告投放业务每日所需的用云资源量波动巨大,为满足各地业务所需波峰与波谷,希望实现灵活、稳定、成本优化。


广告推理和流量介入性能需求:广告推理服务精排模块,随广告模型结构不断升级,在线推理模型请求参数变多,客户对ECS实例的性能及内网带宽需求更高,部分AI业务算力存在性能不足情况。具体而言,大量用户对效果广告进行点击时,业务系统需要对海量流量进行推理分析等操作,如此大流量介入场景下,原来使用的第六代企业级实例g6的网络带宽等性能无法承载如此大流量,同时性价比不如预期。汇量科技希望在实现业务诉求的基本上实现成本优化。


产品&解决方案


在通用计算方面,早期g6系列整体内网带宽等性能指标不满足需求,通过使用第八代ECS云实例g8y,即倚天云实例,实现了同时提升CPU性能和内网带宽,与g6系列对比单机成本降低15-20%,综合性价比提升30%以上。


搭载倚天710芯片的倚天云实例自设计初就是一款云原生产品,倚天710是平头哥半导体发布的首颗为云而生的  CPU  芯片,单芯片容纳高达600亿晶体管;在芯片架构上,基于ARMv9架构,内含128核CPU,主频2.75GHz,能同时兼顾性能和功耗。在内存和接口方面,集成DDR5、PCIe5.0等技术,能有效提升芯片的传输速率,并且可适配云的不同应用场景。阿里云提供丰富的生态工具,支持全应用生态适配,0代码修改即可完成主流业务迁移。性能方面,倚天710相对于传统CPU架构有三大优势,第一,内部128核为独享物理核,避免了超线程核性能争抢问题;第二,低功耗设计,高规格实例可以实现线性性能增长,避免功耗过高导致降频问题;第三,大Cache设计,提升云场景访存性能。因此,倚天云实例在广告在线推理业务上有很大的性能优势。


随着业务发展与广告模型结构不断升级,在线推理模型请求参数增长速度越来越快,内网带宽要求越来越高,为了适应业务不断增长带宽需求,阿里云推出基于CIPU(Cloud  infrastructure Processing  Units,云基础设施处理器)与倚天硬件架构的ECS实例,通过将虚拟化与IO转发等任务卸载到专用硬件上进行加速,并在VPC环境下支持弹性RDMA加速能力,相比TCP时延降低70%以上,满足了广告推理业务对带宽和时延的要求。


通过结合ESS弹性伸缩服务与Spot抢占式实例等产品,并采用了按量付费的节省计划计费模式,在线的非数据库依赖模块全采用动态伸缩的形式进行资源调控,在高峰期时及时开放资源,低谷期时缩减资源,保障资源利用率始终在一个合理的水平,从而确保了成本的最优化。


弹性伸缩是阿里云的一种资源管理服务,可以根据用户的业务运行状况和弹性策略,自动创建和释放资源。而抢占式实例是阿里云推出的一种低成本竞价实例,类似于广告竞价模式。企业需要在创建抢占式实例时指定出价价格,当指定实例的市场价格低于企业出价且库存充足时,用户即可按照出价购买并使用该实例1小时。而1小时后,当市场价格高于企业指定价格,实例会自动释放。


关于部分AI业务性能不足的问题,通过升级最新算力提升性价比,基于神龙计算架构的异构计算云实例,同时具备了IO低延时和计算低延时,进一步降低了广告请求的延时,提高了业务效率。


客户收益


通过使用阿里云倚天实例,汇量科技顺利承接了大流量接入广告业务请求。性能提升的同时,单机成本降低15-20%,综合性价比提升30%以上。

 

汇量科技的在线计算广告平台和大数据平台,总体有72% Spot资源运行,达到成本极致优化的同时,线上稳定性保持在高水平,并通过一系列成本优化手段,成本优化率大幅提升。


使用阿里云各种API和服务,总体效率也得到了极大的提升,综合运维操作和管理的日常效率提高了超过90%。


汇量科技首席人工智能官朱小强表示:“广告推理服务精排模块,随广告模型结构不断升级,在线推理模型请求参数变多,对ECS实例的CPU性能及内网带宽需求更高。早期g6系列整体内网带宽等性能指标不满足需求,通过使用g8y倚天云实例同时提升CPU性能和内网带宽,和g6系列对比单机成本降低15-20%,综合性价比提升30%以上。”

相关实践学习
通义万相文本绘图与人像美化
本解决方案展示了如何利用自研的通义万相AIGC技术在Web服务中实现先进的图像生成。
7天玩转云服务器
云服务器ECS(Elastic Compute Service)是一种弹性可伸缩的计算服务,可降低 IT 成本,提升运维效率。本课程手把手带你了解ECS、掌握基本操作、动手实操快照管理、镜像管理等。了解产品详情: https://www.aliyun.com/product/ecs
相关文章
|
编解码 弹性计算 人工智能
|
机器学习/深度学习 自然语言处理 算法
Machine Learning机器学习之文本分析
Machine Learning机器学习之文本分析
|
3月前
|
存储 人工智能 算法
大模型训推公有云报告:阿里云市场份额第一
国际数据公司(IDC)发布了《中国AI软件市场半年度追踪,2025H2》报告,阿里云在2025年中国大模型训推公有云市场中市场份额达到42.2%,稳居第一。
|
10月前
|
存储 NoSQL Go
英伟达谷歌都在用的(开源特征存储平台Feast)-架构学习指南
欢迎来到Feast的世界!这是一个开源的生产级机器学习特征存储系统,专为解决特征数据高效管理与服务而设计。本指南将带你从零掌握其架构、核心概念与实战技巧,助你像架构师一样思考,像工匠一样编码,轻松应对训练与推理的一致性挑战。
1740 2
|
10月前
|
Cloud Native IDE Go
升级 GoLand 2025.1 = 云原生开发提速 80%!微服务 + 容器化一键适配+安装包
GoLand 2025.1 是 JetBrains 推出的 Go 语言旗舰 IDE,全面支持 Go 1.23 新特性,强化泛型、模块化与并发开发体验。内置 AI 辅助、多版本切换、云原生工具链,深度优化性能,提升编码、调试、测试全流程效率,助力开发者高效构建现代 Go 应用。
468 2
|
SQL JSON NoSQL
如何物业管理(园区式)系统的客户服务板块?(附架构图+流程图+代码参考)
本文深入解析了物业管理系统的构建思路与落地实践,强调以客户服务为主线,重点涵盖投诉建议、合同管理与客户管理三大核心模块。文章不仅提供了系统架构设计、开发技巧、部署运维建议,还结合核心 SQL 与后端代码示例,帮助团队快速实现最小可行产品(MVP)。同时,针对实际开发中常见的并发控制、幂等性、数据一致性等问题,给出了详尽解决方案,适合物业系统开发者与管理者参考实践。
|
9月前
|
机器学习/深度学习 弹性计算 人工智能
最新版:云服务器租用价格表(一年/按月/按小时报价明细)
阿里云服务器主要包含轻量应用服务器、云服务器 ECS 和 GPU 服务器三大类,不同类型、配置及计费方式的价格存在差异。以下结合最新信息,整理各类服务器的收费标准、价格构成及不同场景下的参考价格,为用户成本核算提供依据。
|
9月前
|
存储 缓存 网络协议
阿里云服务器通用型g7、g7a、g8a、g8ae、g8i、g8y、g9i实例对比,均衡性能适配多场景,精准选型
在阿里云丰富的云服务器实例产品线中,通用型实例凭借其均衡的性能配置与广泛的应用适应性,已成为众多企业级用户及开发者的首选方案,其中比较热门的通用型实例规格主要有g7、g7a、g8a、g8ae、g8i、g8y、g9i等,本文通过详尽的技术解析与对比分析,帮助用户深入理解这几个实例的差异化特性,从而为用户的业务部署提供科参考和选型依据。
624 2
|
存储 缓存 安全
阿里云九代云服务器c9i/g9i/r9i实例性能、适用场景解析及活动价格参考
阿里云九代云服务器c9i、g9i、r9i实例是其最新推出的高性能企业级云服务器,凭借其卓越的性能和丰富的功能,广泛应用于机器学习推理、数据分析、高网络包收发等众多场景。接下来,我们将深入探讨这三款实例的性能、适用场景以及价格等方面的详细信息。
939 17
|
人工智能 自然语言处理 程序员
一文彻底搞定从0到1手把手教你本地部署大模型
Ollama 是一个开源工具,旨在简化大型语言模型(LLM)在本地环境的部署与使用。它支持多种预训练模型(如Llama 3、Phi 3等),允许用户根据设备性能选择不同规模的模型,确保高效运行。Ollama 提供了良好的数据隐私保护,所有处理均在本地完成,无需网络连接。安装简便,通过命令行即可轻松管理模型。适用于开发测试、教育研究和个人隐私敏感的内容创作场景。
5602 0
一文彻底搞定从0到1手把手教你本地部署大模型

热门文章

最新文章