【论文速递】ACL 2020 - 一种用于关系三元组抽取的级联二元标记框架

简介: 从非结构化文本中抽取关系三元组对于大规模知识图构建至关重要。然而,现有的工作很少能解决重叠三元组问题,即同一句子中的多个关系三元组共享相同的实体。

【论文原文】:A Novel Cascade Binary Tagging Framework for Relational Triple Extraction


【作者信息】:Zhepei Wei, Jianlin Su, Yue Wang, Yuan Tian, Yi Chang


论文:https://arxiv.org/pdf/1909.03227.pdf
代码:https://github.com/weizhepei/CasRel


博主关键词:关系抽取、级联二元标记框架、重叠三元组


推荐论文:TPLinker:http://t.csdn.cn/hIITO


摘要


从非结构化文本中抽取关系三元组对于大规模知识图构建至关重要。然而,现有的工作很少能解决重叠三元组问题,即同一句子中的多个关系三元组共享相同的实体。在这项工作中,我们引入了一个新的视角来重新审视关系三重抽取任务,并提出了一种新的级联二元标记框架(CASREL),该框架源自一个原则性问题公式。我们的新框架将关系建模为将句子中的subject映射到object的函数,而不是像以前的作品那样将关系视为离散标签,这自然会处理重叠问题。实验表明,即使其编码器模块使用随机初始化的BERT编码器,CASREL框架已经优于现有技术的方法,显示了新标记框架的效果。当采用预训练的BERT编码器时,它的性能进一步提高,在两个公共数据集NYT和WebNLG上,F1得分分别以17.5和30.2的绝对增益超过最强基线。对重叠三元组的不同场景的深入分析表明,该方法在所有这些场景中提供了一致的性能增益。


1、简介


关系三元组抽取的早期工作采用流水线方法(Zelenko等人,2003年;Zhou等人,2005年;Chan和Roth,2011年)。它首先识别句子中的所有实体,然后对每个实体对执行关系分类。由于早期阶段中的错误不能在后期阶段中被纠正,因此这种方法倾向于遭受错误传播问题。为了解决这个问题,随后的工作提出了实体和关系的联合学习,其中包括基于特征的模型(Yu和Lam,2010;Li和Ji,2014;Miwa和Sasaki,2014;Ren等人,2017),以及最近的基于神经网络的模型(Gupta等人,2016;Katiyar和Cardie,2017;Zheng等人,2014;Zeng等人,2018;Fu等人,2019)。通过用学习表示代替人工构建的特征,神经网络模型在三元组抽取任务中取得了相当大的成功。


442cefc24fe6444aa3d78bcf72117cce.png


然而,大多数现有方法不能有效地处理句子包含多个相互重叠的关系三元组的场景。图1说明了这些场景,其中三元组在一个句子中共享一个或两个实体。这种重叠的三元组问题直接挑战了传统的序列标记方案,该方案假设每个token只带有一个标签(Zheng等人,2017)。这也给关系分类方法带来了很大的困难,其中假设实体对最多持有一个关系(Miwa和Bansal,2016)。Zeng等人(2018)是最早考虑关系三元组抽取中重叠三元组问题的人之一。他们介绍了不同重叠模式的类别,如图1所示,并提出了一个具有复制机制的序列到序列(Seq2Seq)模型来抽取三元组。基于Seq2Seq模型,他们进一步研究了抽取顺序的影响(Zeng等人,2019),并通过强化学习获得了显著的改进。Fu等人(2019)还通过使用基于图卷积网络(GCN)的模型将文本建模为关系图,研究了重叠三元组问题。


尽管他们取得了成功,但以前关于抽取重叠三元组的工作仍有很多不足之处。具体来说,它们都将关系视为要分配给实体对的离散标签。这个公式使得关系分类成为一个困难的机器学习问题。首先,类别分布高度不平衡。在所有抽取的实体对中,大多数都没有形成有效的关系,产生了太多负样本。第二,当同一实体参与多个有效关系(重叠的三元组)时,分类器可能会被混淆。如果没有足够的训练实例,分类器很难判断实体参与了哪个关系。因此,抽取的三元组通常是不完整和不准确的。


在这项工作中,我们从三重层次的关系三重抽取权的原则公式开始。这产生了一个通用的算法框架,通过设计来处理重叠的三重问题。该框架的核心是一个全新的视角,即我们可以将关系建模为将subject映射到object的函数,而不是将关系视为实体对上的离散标签。更准确地说,我们学习关系特定标签f r ( s ) → o ,代替学习关系分类器f ( s , o ) → r , 其中每一个识别特定关系下给定subject的可能object;或不返回object,表示给定的subject和object不存在三元组。在这个框架下,三元组抽取是一个两步过程:首先我们识别句子中所有可能的subject;然后,对于每个subject,我们应用特定于关系的标记符来同时识别所有可能的关系和对应的object。


我们在端到端级联二元标记框架CASREL中实现了上述思想。它由基于BERT的编码器模块、subject标记模块和特定关系object标记模块组成。经验实验表明,即使在BERT编码器未经预训练的情况下,所提出的框架仍以较大幅度优于SOTA方法,表明了新框架本身的优越性。在采用预训练的BERT编码器后,该框架获得了更大的性能增益,表明了丰富的先验知识在三元组抽取任务中的重要性。


这项工作有以下主要贡献:


1.我们引入了一个新的视角来重新审视关系三元组抽取任务,并提出了一个原则性的问题公式,这意味着一个通过设计解决重叠三元组问题的通用算法框架。


2.我们将上述框架实例化为Transformer编码器之上的一个新的级联二元标记模型。这允许该模型将新颖标记框架的功能与预训练的大规模语言模型中的先验知识相结合。


3.在两个公共数据集上的广泛实验表明,所提出的框架显著优于最先进的方法,在两个数据集上分别获得17.5和30.2的F1分数绝对增益。详细分析表明,我们的模型在所有场景中都得到了一致的改进。


df060f93116346488f9cd50a3caed17a.png


2、实验结果


078e01bf4e344289a3901267ea76a4f9.png

9e0f0322e90b448cbb31bb77c5c3d7ac.png

9c3301439f154e98bb402fb38efe2b1b.png


720fec2719474aec94513680ccb51389.png


CasRel全文阅读


【论文速递 | 精选】


fcc8fa9f87404652beb9e08a0ac9652d.png


论坛地址:https://bbs.csdn.net/forums/paper

目录
相关文章
|
7月前
【论文速递】ICLR2018 - 用于小样本语义分割的条件网络
【论文速递】ICLR2018 - 用于小样本语义分割的条件网络
83 0
|
7月前
|
机器学习/深度学习 缓存 算法
【论文速递】IJCV2022 - CRCNet:基于交叉参考和区域-全局条件网络的小样本分割
【论文速递】IJCV2022 - CRCNet:基于交叉参考和区域-全局条件网络的小样本分割
|
7月前
|
机器学习/深度学习 人工智能 自然语言处理
【论文精读】AAAI 2022- 统一的命名实体识别作为词与词之间的关系分类
【论文精读】AAAI 2022- 统一的命名实体识别作为词与词之间的关系分类
【论文精读】AAAI 2022- 统一的命名实体识别作为词与词之间的关系分类
|
机器学习/深度学习 自然语言处理
【论文速递】ACL 2022 - 查询和抽取:将事件抽取细化为面向类型的二元解码
事件抽取通常被建模为一个多分类问题,其中事件类型和论元角色被视为原子符号。这些方法通常仅限于一组预定义的类型。
141 1
|
机器学习/深度学习 自然语言处理 BI
FourIE:基于图卷积网络的跨任务实例表征交互和标签依赖的联合信息抽取模型
现有的信息抽取(IE)工作主要是分别解决四个主要任务(实体提及识别、关系抽取、事件触发词检测和论元抽取),无法从任务之间的相互依赖中获益。
120 2
|
机器学习/深度学习 人工智能 自然语言处理
GraphIE:通过建模实例间和标签间依赖性联合抽取实体、关系和事件 论文解读
事件触发词检测、实体提及识别、事件论元抽取和关系抽取是信息抽取中的四个重要任务,它们被联合执行(联合信息抽取- JointIE),以避免错误传播并利用任务实例之间的依赖关系
186 1
【Hammerstein模型的级联】快速估计构成一连串哈默斯坦模型的结构元素研究(Matlab代码实现)
【Hammerstein模型的级联】快速估计构成一连串哈默斯坦模型的结构元素研究(Matlab代码实现)
110 0
|
自然语言处理
【论文速递】ACL 2021-CasEE: 一种用于重叠事件抽取的级联解码联合学习框架
【论文原文】:A Joint Learning Framework with Cascade Decoding for Overlapping Event Extraction
115 0
|
机器学习/深度学习 人工智能 自然语言处理
CasEE: 一种用于重叠事件抽取的级联解码联合学习框架 论文解读
事件抽取(Event extraction, EE)是一项重要的信息抽取任务,旨在抽取文本中的事件信息。现有方法大多假设事件出现在句子中没有重叠,这不适用于复杂的重叠事件抽取。
273 0
|
机器学习/深度学习 自然语言处理 测试技术
【论文速递】CASE 2022 - EventGraph: 将事件抽取当作语义图解析任务
事件抽取涉及到事件触发词和相应事件论元的检测和抽取。现有系统经常将事件抽取分解为多个子任务,而不考虑它们之间可能的交互。
124 0