如何提升云小蜜知识解决率

简介: 在XXX项目中,配置知识库时,发现问题的解决率在前期一直不搞。怎么提高解决率,是所有项目成员一直渴望解决的痛点。 在经历多次调整和多轮标注,总结出一套行之可用的方法论,依照此方法,解决率持续提高。下面依照项目总结出的方法分享给大家。

一、如何标注(以外部机器人4天标注为例)

1、下载源文件:进入数据看板----会话历史  选择机器人外部,数据来源C端,时间筛选你想标注的时间段,最后点击下载(若无法下载,按照这个步骤隐私设置和安全性-----网站设置----更多设置----不安全内容----允许修改浏览器相关配置即可)

 云1.png

2、处理源文件:

按照提问时间去重(因为导出的历史记录存在一个问题,就是针对回复类型为推荐类型的提问会根据推荐的知识条数进行拆分,会导致用户只提了一个问题,但是导出有三个相同的问题,例如下图数字3标红处,这样既会影响标注的效率,又会影响后续准确率的计算)

具体操作:选中提问时间这一列(效果如图数字1处),点击筛选里面的高级筛选(如图数字2处),筛选弹窗出来后勾选第二张图所示的选择不重复记录按钮,点击确定。这时就是去掉系统导致的重复后的数据,因为后续要进行标注等一系列操作,所以可以将筛选出来的数据复制到第二个sheet中进行处理。

云2.png

云2-2.png

云2-3.png

3、标注准备工作:去掉无意义多余列,新增一列标注列,并且将该列(除第一行标题)插入下拉框,这样避免重复打字浪费时间,这样准备工作就做完了,可以开始标注了。

云3.png

4、标注标准:

正确:命中知识,并且提问和答案是符合的

错误:(错误的大前提是知识库里面配置过该问题的答案。)一方面由于提问方式多样化而未命中知识,另一方面就是错误命中其他不相干知识。

业务未覆盖:就是知识库知识没有覆盖该提问。

语义不明:不明白在说什么,例如随便发一串数字,单独一个地名,抱怨,脏话,不相干提问等等,或者说话说半句导致无法明白客户要问什么。

 

举例如下:错误=》餐总交接表在知识库里面是配置过的,但是客户提问却没有直接命中,所以就是错误,对于错误知识,我们可以在标注的时候直接配置到相应知识的相似问里面去,这样也避免后续再去处理浪费时间。

云4.png

相关实践学习
阿里小蜜中的机器阅读技术
阿里云智能对话机器人(原云小蜜)依托阿里云AI技术,为企业提供一体化对话机器人服务,帮助企业构建新一代全时段智能交互系统,精准理解用户意图,支持界面化流程配置、自定义三方业务集成等功能,降本增效,广泛适用于智能客服问答、智能办公助理、售前业务咨询等场景。
相关文章
|
8月前
|
人工智能 JSON 前端开发
|
安全 Shell 网络安全
基于Vulnhub靶场—DC4渗透测试过程
Vulhub是一个开源项目,专注于安全漏洞的复现和学习。包括Web应用、容器和操作系统漏洞。项目特点包括丰富的漏洞场景、详细的复现指南、便捷的环境部署和持续更新。通过Vulhub,安全从业者可以学习和研究漏洞利用技术。此外,文章还介绍了如何下载和搭建Vulhub靶机DC-4,并详细描述了利用Burp Suite进行密码爆破和命令执行,最终获取root权限的过程。
2159 0
|
8月前
|
弹性计算 Linux 网络安全
学习笔记:阿里云新手账号注册、实名认证、选购ECS云服务器、部署管理指南
阿里云ECS(弹性计算服务)是一种无需购买物理服务器即可使用计算资源的服务,让您像使用水电一样便捷获取服务器算力。本指南将详细拆解从账号注册到服务器管理的完整流程,帮助新手用户快速掌握云服务器使用技巧。
824 1
|
10月前
|
JavaScript 前端开发 安全
TypeScript 与 ArkTS 全面对比:鸿蒙生态下的语言演进
本文深入对比TypeScript与华为鸿蒙原生语言ArkTS,从类型系统、UI开发、性能优化到生态定位,全面解析二者差异。ArkTS基于TS演进,面向操作系统层级重构,具备强类型安全、声明式UI、AOT编译与分布式能力,助力“一次开发,多端部署”。结合10亿鸿蒙设备爆发趋势,为开发者提供技术选型指南与平滑迁移路径,是进军全场景智慧生态的关键钥匙。(238字)
1215 1
|
11月前
|
存储 弹性计算 固态存储
阿里云服务器按量、包月及包年收费价格,云服务器最新活动价格参考
2025年租用阿里云服务器一年多少钱?不同时期阿里云服务器的租用价格不同,2核2G200M轻量应用云服务器特价38元1年起,经济型e实例2核2G3M带宽 40G ESSD Entry云盘特惠价99元1年,通用算力型u1实例2核4G5M带宽80G ESSD Entry云盘特惠价199元1年。2025年阿里云服务器租用价格表如下文所示。
2598 2
阿里云服务器按量、包月及包年收费价格,云服务器最新活动价格参考
|
自然语言处理 算法 搜索推荐
NLP中TF-IDF算法
TF-IDF(词频-逆文档频率)是一种用于信息检索与数据挖掘的加权技术,通过评估词语在文档中的重要性来过滤常见词语,保留关键信息。本文介绍了TF-IDF的基本概念、公式及其在Python、NLTK、Sklearn和jieba中的实现方法,并讨论了其优缺点。TF-IWF是TF-IDF的优化版本,通过改进权重计算提高精度。
2285 1
|
小程序 Java 关系型数据库
基于SpringBoot招聘管理系统设计和实现(源码+LW+调试文档+讲解等)
基于SpringBoot招聘管理系统设计和实现(源码+LW+调试文档+讲解等)
|
存储 人工智能 自然语言处理
AI 工程学习 - 三张图说明白什么是 RAG
RAG(检索增强生成)是一种结合信息检索和生成模型的自然语言处理框架,通过引入外部知识库(如文档库、数据库等),增强生成模型的回答准确性与相关性。其核心在于避免模型仅依赖训练数据产生不准确或“幻觉”内容,而是通过实时检索外部资料,确保回答更精准、丰富且上下文相关。RAG的实现包括建立索引(清洗、分割、嵌入存储)和检索生成(计算相似度、选择最优片段、整合提示词模板提交给大模型)。
3076 0
|
边缘计算 网络协议 5G
SRv6 的好处:深入探讨下一代网络技术
【8月更文挑战第28天】
1286 0
SRv6 的好处:深入探讨下一代网络技术
|
SQL 中间件 数据库
Django 架构详解
【8月更文挑战第24天】
800 0

热门文章

最新文章