阿里云峰会 | AI搜题加速在线教育行业场景创新

本文涉及的产品
智能开放搜索 OpenSearch行业算法版,1GB 20LCU 1个月
OpenSearch LLM智能问答版免费试用套餐,存储1GB首月+计算资源100CU
推荐全链路深度定制开发平台,高级版 1个月
简介: 过去的2020年的让所有人难忘的一年,受新冠疫情的影响,各行各业都在挑战中变化,在教育方面也催生了新的商业格局。在线教育平台发展迅猛,阿里云也积极相应,为在线教育的众多客户提供了高效稳定的技术保障。本文介绍了阿里云开放搜索为在线教育掠夺流量的重要工具-拍照搜索的技术原理。

分享人:徐光伟(昆卡)   阿里巴巴达摩院算法专家

了解更多解决方案详情:https://www.aliyun.com/page-source/data-intelligence/activity/edusearch

搜索是在线教育企业流量获取的利器

   截至2020年12月份教育行业月活TOP10的统计,其中具备搜题能力的软件多达5个,拍照搜题作为产品能力,可以帮助客户获取大量用户以及流量,从而为其他产品提供变现能力,正是由于这样定位,拍照搜题整体准确性和搜索效率都成为至关重要的一点,所以开放搜索对此做了很多订制优化。

教育搜题业务特点


对于教育搜题业务场景归纳了三大特点:

第一点海量题库,教育题库都是属于千万级别甚至到亿级别,而且不断的持续增长;同时搜题业务存在很明显的高峰现象,例如晚上七八点,节假日最后一天,这时搜题会存在非常高的QPS的波峰;搜索延迟会严重影响用户的体验。

第二点场景丰富,拍照搜题涵盖的场景越来越丰富,包括不同的年龄段,例如低年级搜题主要围绕拍照看图识字或连线题,需要更多的图片信息的题目;还包括不同的学科,目前支持的学科多达十多种,因此丰富的场景就会对搜索效果带来更大的挑战。

第三点算法需求,拍照搜题产品形态一般只会展现TOP3或者TOP5的结果,正是因为这样设定,准确性对于拍照搜题来说至关重要,同时拍照搜题还会涉及到多模态和多语言处理能力,解决图文搜索和多语言处理的需求。

开放搜索教育搜题方案架构

阿里云开放搜索的拍照搜题解决方案,当用户通过拍照经过OCR识别之后的文本,经过开放搜索引擎处理后会返回TOP3-5的结果给用户得到展示,并且针对企业题库数据严格保证数据的安全和隐私。

教育搜题算法能力

查询分析算法优化完整的处理流程

教育行业分词和学科类目预测

分词在拍照搜题场景下存在两大难点,第一点英文题目OCR识别之后空格缺失,左边第一个图可以看到,即便针对很长没有空格的英文文本,模型也是可以非常准确的做正确的切分。第二个难点是数学题目公式表示之后的切分,左边第二个图可以看到数学符号部分都做出正确的切分。

类目预测在拍照搜题场景下对应的就是学科的预测和题型的预测,我们结合图片以及OCR识别之后的文本信息做多模态预测,从而提高搜题准确率。

多路召回排序技术

由于拍照搜题业务场景的特殊性,开放搜索还引入了多路召回排序技术。

为什么要做多路召回呢?

教育拍照搜题相比传统的网页或者电商的搜索存在明显的差异,第一点是搜索的Query特别长,第二点是搜索的Query由拍照OCR识别之后得到的文本,其中关键TERM识别错误的话,就会严重影响召回排序。

传统的纯文本查询方案包括两种,第一种是OR逻辑查询,第二种AND逻辑查询,AND逻辑查询上基于我们刚才说到的针对教育领域优化定制的Query模块分析之后大幅提高效果,现在可以做到准确性接近OR逻辑。

如何兼顾搜索计算开销以及搜索的准确率呢?

引入了文本的向量召回,对文本向量召回技术优化了三点,

第一点是其中的BERT模型我们采用达摩院自研的StructBERT,并针对于教育行业做了定制,同时对BERT模型做压缩加速。

第二点是向量检索引擎采用达摩院自研的Proxma引擎,准确性和速度都超越开源系统。

第三点训练数据可以基于客户的搜索日志不断积累,效果持续提升。

从右边的图可以看到,最终我们在基于两侧的BERT模型就可以达到非常好的效果,准确性超过OR逻辑3%—5%,整体召回DOC数量减少40倍,Latecy降低10倍以上。

搜题效果展示

举例两个具体搜题的case,左边这个case可以看到其中因为问题中的文字描述和题库中文字描述不一致,传统搜索引擎返回的结果相关性极差,经过我们引入语意向量召回之后右边TOP3结果完全符合题意。第二个case因为这个题目中包含图片的信息,传统的搜索引擎无法做到准确的召回,基于我们多路召回引入图象信息之后TOP1返回完全一致的题目。

开放搜索解决方案优势

案例一:某K12的教育用户,用户数达到千万级别,题库量在八千万左右而且在持续增加,客户接入开放搜索之后返回搜题准确率提升45%,延迟降到50%毫秒。


案例二:某高职教育客户,产品DAU三百万,月活一千万,客户接入之后反馈对比他们原先自建的系统,在高峰时候耗时大于两秒,现在开放搜索可以稳定在50毫秒,同比下降40倍。TOP5题目搜索准确率提升2.4%搜索结果从原来40%降到不到1%,业务高峰期可以实现秒级平滑扩容。


获得专家指导:

https://survey.aliyun.com/apps/zhiliao/6R4u6vilI


如果您对搜索与推荐相关技术感兴趣,欢迎加入钉钉群内交流

image.png



目录
相关文章
|
12天前
|
人工智能 Java Serverless
阿里云函数计算助力AI大模型快速部署
随着人工智能技术的快速发展,AI大模型已经成为企业数字化转型的重要工具。然而,对于许多业务人员、开发者以及企业来说,探索和利用AI大模型仍然面临诸多挑战。业务人员可能缺乏编程技能,难以快速上手AI模型;开发者可能受限于GPU资源,无法高效构建和部署AI应用;企业则希望简化技术门槛,以更低的成本和更高的效率利用AI大模型。
65 12
|
10天前
|
机器学习/深度学习 人工智能 自然语言处理
转载:【AI系统】AI的领域、场景与行业应用
本文概述了AI的历史、现状及发展趋势,探讨了AI在计算机视觉、自然语言处理、语音识别等领域的应用,以及在金融、医疗、教育、互联网等行业中的实践案例。随着技术进步,AI模型正从单一走向多样化,从小规模到大规模分布式训练,企业级AI系统设计面临更多挑战,同时也带来了新的研究与工程实践机遇。文中强调了AI基础设施的重要性,并鼓励读者深入了解AI系统的设计原则与研究方法,共同推动AI技术的发展。
转载:【AI系统】AI的领域、场景与行业应用
|
2天前
|
机器学习/深度学习 人工智能 算法
X-AnyLabeling:开源的 AI 图像标注工具,支持多种标注样式,适于目标检测、图像分割等不同场景
X-AnyLabeling是一款集成了多种深度学习算法的图像标注工具,支持图像和视频的多样化标注样式,适用于多种AI训练场景。本文将详细介绍X-AnyLabeling的功能、技术原理以及如何运行该工具。
21 2
X-AnyLabeling:开源的 AI 图像标注工具,支持多种标注样式,适于目标检测、图像分割等不同场景
|
3天前
|
机器学习/深度学习 人工智能 运维
阿里云技术公开课直播预告:基于阿里云 Elasticsearch 构建 AI 搜索和可观测 Chatbot
阿里云技术公开课预告:Elastic和阿里云搜索技术专家将深入解读阿里云Elasticsearch Enterprise版的AI功能及其在实际应用。
阿里云技术公开课直播预告:基于阿里云 Elasticsearch 构建 AI 搜索和可观测 Chatbot
|
1天前
|
人工智能 大数据 测试技术
自主和开放并举 探索下一代阿里云AI基础设施固件创新
12月13日,固件产业技术创新联盟产业峰会在杭州举行,阿里云主导的开源固件测试平台发布和PCIe Switch固件技术亮相,成为会议焦点。
|
1天前
|
弹性计算 人工智能 数据管理
AI场景下的对象存储OSS数据管理实践
本文介绍了ECS和OSS的操作流程,分为两大部分。第一部分详细讲解了ECS的登录、密码重置、安全组设置及OSSUTIL工具的安装与配置,通过实验创建并管理存储桶,上传下载文件,确保资源及时释放。第二部分则聚焦于OSSFS工具的应用,演示如何将对象存储挂载为磁盘,进行大文件加载与模型训练,强调环境搭建(如Conda环境)及依赖安装步骤,确保实验结束后正确清理AccessKey和相关资源。整个过程注重操作细节与安全性,帮助用户高效利用云资源完成实验任务。
36 10
|
1天前
|
存储 人工智能 开发工具
AI场景下的对象存储OSS数据管理实践
本文介绍了对象存储(OSS)在AI业务中的应用与实践。内容涵盖四个方面:1) 对象存储作为AI数据基石,因其低成本和高弹性成为云上数据存储首选;2) AI场景下的对象存储实践方案,包括数据获取、预处理、训练及推理阶段的具体使用方法;3) 国内主要区域的默认吞吐量提升至100Gbps,优化了大数据量下的带宽需求;4) 常用工具介绍,如OSSutil、ossfs、Python SDK等,帮助用户高效管理数据。重点讲解了OSS在AI训练和推理中的性能优化措施,以及不同工具的特点和应用场景。
28 10
|
16天前
|
人工智能 NoSQL MongoDB
阿里云与MongoDB庆祝合作五周年,展望AI赋能新未来
阿里云与MongoDB庆祝合作五周年,展望AI赋能新未来
|
10天前
|
人工智能 Cloud Native 调度
阿里云容器服务在AI智算场景的创新与实践
本文源自张凯在2024云栖大会的演讲,介绍了阿里云容器服务在AI智算领域的创新与实践。从2018年推出首个开源GPU容器共享调度方案至今,阿里云容器服务不断推进云原生AI的发展,包括增强GPU可观测性、实现多集群跨地域统一调度、优化大模型推理引擎部署、提供灵活的弹性伸缩策略等,旨在为客户提供高效、低成本的云原生AI解决方案。
|
5天前
|
机器学习/深度学习 人工智能 自然语言处理
AI技术深度解析:从基础到应用的全面介绍
人工智能(AI)技术的迅猛发展,正在深刻改变着我们的生活和工作方式。从自然语言处理(NLP)到机器学习,从神经网络到大型语言模型(LLM),AI技术的每一次进步都带来了前所未有的机遇和挑战。本文将从背景、历史、业务场景、Python代码示例、流程图以及如何上手等多个方面,对AI技术中的关键组件进行深度解析,为读者呈现一个全面而深入的AI技术世界。
52 10
下一篇
DataWorks