ACL2023 - An AMR-based Link Prediction Approach for Document-level Event Argument Extraction

简介: 最近的工作引入了用于文档级事件论元提取(文档级EAE)的抽象语义表示(AMR),因为AMR提供了对复杂语义结构的有用解释,并有助于捕获长距离依赖关系

An AMR-based Link Prediction Approach for Document-level Event Argument Extraction


b705d742087a465b9039ba0e11597d7c.png


论文:https://arxiv.org/abs/2305.19162

代码:https://github.com/ayyyq/TARA


期刊/会议:ACL 2023


摘要


最近的工作引入了用于文档级事件论元提取(文档级EAE)的抽象语义表示(AMR),因为AMR提供了对复杂语义结构的有用解释,并有助于捕获长距离依赖关系。然而,在这些工作中,AMR仅隐含地使用,作为附加特征或训练信号。由于所有的事件结构都可以从AMR中推断出来,这项工作将EAE重新表述为AMR图上的链接预测问题。


由于AMR是一种通用结构,并不完全适合EAE,我们提出了一种新的图结构,即定制AMR图(Tailored AMR Graph, TAG),它压缩信息量较小的子图和边缘类型,集成跨度信息,并突出显示同一文档中的周围事件。利用TAG,我们进一步提出了一种新的方法,使用图神经网络作为链接预测模型来查找事件论元。


我们在WikiEvents和RAMS上进行的大量实验表明,这种更简单的方法分别比最先进的模型高3.63pt和2.33pt F1,并减少了56%的推理时间。


1、简介


先前的工作通过强化神经序列模型隐式地使用AMR信息,而不是显式地使用离散结构。离散AMR结构可以迫使模型更好地关注谓词论元结构和与EAE最相关的内容,因此比隐式AMR具有更强的效果。


我们的目标是通过将EAE转化为链路预测任务,利用显式AMR的潜力来改进EAE,图1说明了该框架。我们将输入文档解析为图结构,并采用链接预测模型来查找事件论元。我们通过一个节点是否连接到触发词节点来确定它是否是一个论元。将EAE公式化为链接预测问题的优点有三方面:1)AMR图通常比原始文本更紧凑(见第2.2节),因此处理AMR以查找论元将是简单有效的。2) 多个论元和事件之间的依赖关系被明确地捕获,而之前的工作(Liao and Grishman,2010;Du et al,2022)已经指出了这些依赖关系的重要性,这些依赖关系仅在特征空间中被隐含地考虑。3) 正如我们的实验所示,更简单的模型架构和稀疏图可以提高效率(最多节省56%的推理时间)。


549962471f2c40d6b3cf1f2e4b65a41e.png


所提出的方法假设AMR图包含EAE的所有必要信息。然而,由于现成的AMR解析器生成的原始AMR图不满足这一假设。首先,它们只覆盖了WikiEvents中72.2%的事件论元,阻碍了EAE模型直接在解析的AMR图上的性能。主要问题是AMR图是在单词级别定义的,但事件论元可能是文本跨度。其次,最先进的AMR解析器的Smatch分数约为85(Bai et al. 2022),这也会导致信息丢失。为了解决上述问题,我们提出了一种新的定制AMR图(TAG),它压缩与EAE无关的信息,通过跨度建议模块将单词合并到文本跨度中,并突出显示同一文档中的周围事件,以鼓励他们的交流。特别是,TAG中的节点数量大约相当于WikiEvents中单词的47%,这是一个显著的减少。由于过多的分散注意力的信息是文档级任务的一个主要挑战,我们还期望通过关注TAG来提高性能,我们的实验结果证明了这一点。如果跨度建议模块增加了足够的文本跨度,TAG可以覆盖所有EAE样本,我们将在附录-A.3中讨论跨度召回和模型效率之间的权衡。


尽管链接预测模型有很大的设计空间,但我们选择了一种简单的架构,将GNN层堆叠在预训练的文本编码器之上。整个模型被称为TARA,用于基于定制AMR的论元提取。我们在最新的文档级EAE数据集WikiEvents(Li et al,2021)和RAMS(Ebner et al,2020)上进行了广泛的实验。TARA分别比SOTA提高了3.63pt和2.33pt。由于GNN中的交互是稀疏的,因此我们的模型的计算成本也更低,节省了高达56%的推理时间。


据我们所知,我们是第一个将EAE转化为AMR图上的链接预测问题的人。


2、方法


在本节中,我们首先解释了如何将EAE转化为链路预测问题,并讨论了这样做的好处(第2.1节)。为了使AMR图更好地适应EAE任务并确保公式化是无损失的,我们对AMR图进行了一系列修改,生成了一个紧凑且信息丰富的图,称为Tailored AMR图(TAG)(第2.2节)。


2.1 EAE作为链路预测问题


形式上,给定文档D和事件类型为e ee的事件触发词τ ,文档级EAE的目标是提取一组与τ 相关的事件论元A 。我们将EAE转化为链路预测问题,该问题是在TAG上定义的。假设TAG中的所有节点都与输入序列中的文本跨度对齐,在图中捕获触发词和论元,并标记与事件触发词对应的节点(我们将在第2.2节中讨论如何满足这些条件)。


因此,我们将链接预测模型应用于文档D 的定制AMR图G t 。如果该模型预测存在连接节点u和事件触发词τ 的类型为r 的边,则我们说u的相应文本跨度是一个论元,并且它在具有触发词τ 的事件中起到r 的作用。我们在图1中说明了这一过程,它还显示了定制的AMR图删除了输入文本中大量分散注意力的信息。请注意,删除的文本参与构建初始节点表示,因此模型仍然可以作为上下文访问它们的信息。详细实施见第2.3节。


2.2 为EAE定制AMR图


TAG可以建立在现成的AMR解析器生成的原始的AMR图上(Bai et al, 2022; Astudillo et al, 2020),该解析器还提供节点和单词之间的对齐信息。如上所述,原始的AMR图不足以解决EAE,因此我们通过压缩膨胀的子图来清理图,用跨度建议模块导出的跨度边界信息丰富图,并突出周围的事件以鼓励多个事件之间的交互。


**聚集边缘(Coalescing edges)**我们遵循先前的工作(ang and Ji, 2021; Xu et al, 2022),将细粒度AMR边缘类型聚类为表1所示的主要类别,并在完全连接所有句子的根节点之前逐句解析文档。


57156fd3f6cd4c1a9f15b119b5ecad87.png


**压缩子图(Compressing Subgraphs)**AMR是严格的,并尽量反映所有细节。例如,图2显示了一个普通的AMR图使用五个节点来表示一个实体“Los Angeles”。由于EAE不需要这样详细的信息,我们可以将子图压缩到单个节点。我们发现,大约36%的节点和37%的边可以通过压缩来去除。注意,要压缩的子图的所有传入和传出边都将被继承,这样压缩就不会影响图的其余部分。流线型图不仅提高了效率和节省了内存,而且还促进了GNN的训练,因为更大的图通常需要更深的GNN。压缩过程只依赖于普通的AMR图,因此对于每个样本来说都是一次性开销。详细的压缩规则见附录B。


e590b120d27948b5ae144b0709de07e2.png


**缺失片段(Missing Spans)**普通的AMR图无法覆盖跨度形式的论元,因为它是在单词级别定义的,这损害了20%以上EAE样本的性能。为了克服这个问题,我们将跨度建议模块生成的跨度信息S添加到G t 中,如图3所示。我们遵循Zhang和Ji(2021)中介绍的想法,将生成的跨度与现有AMR节点合并。如果生成的跨度根据对齐信息与节点在文本序列中的位置完全匹配,我们会在节点的初始表示中添加一个特殊的节点类型嵌入,这样模型就可以知道跨度建议模块宣布了这个节点。如果生成的跨度与节点部分匹配,我们添加一个新节点来表示该跨度,并从部分匹配的节点继承连接词。我们还在这个节点和新节点之间添加了一条特殊的边,以指示它们的重叠。如果生成的跨度与任何现有节点都不匹配,我们添加一个新节点,并用一条特殊的边将其连接到其左侧和右侧最近的节点。


e3989469c4f342578922f72f6ec93d2d.png


**周围的事件(Surrounding Events)**文档中的事件不是孤立的。最近的一项工作(Du et al, 2022)用包含其他事件的文本来增强输入,但AMR图的使用提供了一个更简单的解决方案。我们添加节点类型嵌入来指示节点是同一文档中的当前触发词或周围事件触发词。这种修改鼓励多个事件结构之间的通信,并且事件结构间的一致性可以帮助提取尽可能多的正确论元。例如,在同一份文件中,Attack事件的Victim很可能是Die事件的Victim,而不太可能是ChargeIndict事件的Defendant。


2.3 实施


我们提出了一个新的模型来发现基于TAG的事件论元,图3概述了我们的方法。我们首先使用AMR解析器和对齐器解析输入文档,以获得普通的AMR图,如第2.2节所述,合并边并压缩子图以对其进行预处理。然后,我们用跨度建议模块生成的跨度来丰富图。接下来,我们使用预训练的文本编码器输出的token级特征来根据对齐信息初始化节点表示。最后,将基于GNN的链接预测模型应用于事件论元的预测。


image.png


其中,当对应跨度的偏移量与标准论元跨度匹配时,y yy被分配为真标签,否则为假标签。


image.png


T是节点类型的查找表,包括{ t r i g g e r , s u r r o u n d i n g   t r i g g e r , c a n d i d a t e   s p a n , o t h e r } 四种类型。新插入的节点通过新的边类型上下文连接到它们的相邻节点,这些节点在文本序列中很接近。


我们使用L 层堆叠的R-GCN(Schlichtkrull et al, 2018)通过具有不同关系类型的边来对不同节点之间的相互作用进行建模。第l + 1 层中节点的隐藏状态可以公式化为:


image.png


我们使用具有超参数λ λλ的多任务损失函数L = L c + λ L s 来训练模型。因此,论元识别可以对论元分类产生积极影响。


3、实验


fd17a9908f8a46f9b21dbc4feed6ef8d.png

e8a1d4d5eec34b729758c1007fb1ddc7.png

bd4bec4b80bf413c8558f3fb1d357b9a.png

5e11837b4f2b4e7db30a7342e8894bd5.png

65a078a7407d41d5a628a4c709156f89.png

589edb2d5fa04c299f42a36a430ecd8f.png


4、总结


我们提出在定制的AMR图上,将文档级事件论元抽取重新表述为链接预测问题。通过添加缺失的跨度、标记周围事件和消除噪声,AMR图针对EAE任务进行了定制。我们还介绍了一个基于TAG的链路预测模型来实现EAE。详细的实验表明,显式使用AMR图有利于论元提取。


更多论文解读

目录
相关文章
|
JSON JavaScript 前端开发
在Python中调用和执行JavaScript
在Python中调用和执行JavaScript主要通过`PyExecJS`库实现。安装库后,可以使用`execjs.compile`编译JS代码并用`eval`或`call`执行。此外,还能加载JavaScript库和框架,调用外部JS文件,处理返回值,以及在两者间传递数据。Python和JavaScript各有优劣,适用于不同场景,结合使用可增强项目功能和灵活性。
1785 0
|
编译器
overleaf 参考文献引用,创建引用目录.bib文件,在文档中引用参考文献,生成参考文献列表
overleaf 参考文献引用,创建引用目录.bib文件,在文档中引用参考文献,生成参考文献列表
12700 0
|
机器学习/深度学习 人工智能 数据库
RAG 2.0 深入解读
本文从RAG 2.0 面临的主要挑战和部分关键技术来展开叙事,还包括了RAG的技术升级和关键技术等。
2370 85
|
JSON 监控 API
京东商品详情API秘籍!轻松获取商品详情数据
京东商品详情API提供商品SPU/SKU的完整信息,涵盖基础属性、价格、库存及促销等120+字段,支持HTTPS协议与JSON格式,适用于电商多场景。
|
9月前
|
弹性计算 人工智能 安全
阿里云服务器:ECS介绍、费用价格、功能优势及使用全解析,2026有问必答FAQ
阿里云ECS是国产份额第一的弹性云服务器,安全可靠、弹性伸缩、按需付费。2026年推经济型e实例(¥99/年起)、通用u1/u2i等新规格,支持免费试用、新老同享优惠,适配建站、AI、游戏等全场景。
695 1
|
10月前
|
人工智能 自然语言处理 搜索推荐
2025AI数字人企业厂商排名与重点榜单推荐及新选择指南
AI数字人正以智能交互、情感表达与任务执行能力重塑产业生态。依托AIGC、3D建模与大模型技术,广泛应用于电商、金融、教育等领域,实现服务自动化、内容高效创作与人机协同升级。像衍科技、阿里、百度等企业引领技术创新,推动数字人从“工具”迈向“伙伴”,成为连接虚拟与现实的新型数字力量。
|
JavaScript 前端开发 安全
【逆向】Python 调用 JS 代码实战:使用 pyexecjs 与 Node.js 无缝衔接
本文介绍了如何使用 Python 的轻量级库 `pyexecjs` 调用 JavaScript 代码,并结合 Node.js 实现完整的执行流程。内容涵盖环境搭建、基本使用、常见问题解决方案及爬虫逆向分析中的实战技巧,帮助开发者在 Python 中高效处理 JS 逻辑。
|
机器学习/深度学习 人工智能 自然语言处理
【EMNLP2024】基于多轮课程学习的大语言模型蒸馏算法 TAPIR
阿里云人工智能平台 PAI 与复旦大学王鹏教授团队合作,在自然语言处理顶级会议 EMNLP 2024 上发表论文《Distilling Instruction-following Abilities of Large Language Models with Task-aware Curriculum Planning》。
|
消息中间件 缓存 NoSQL
Redis原理—5.性能和使用总结
本文详细探讨了Redis的阻塞原因、性能优化、缓存相关问题及数据库与缓存的一致性问题。同时还列举了不同缓存操作方案下的并发情况,帮助读者理解并选择合适的缓存管理策略。最终得出结论,在实际应用中应尽量采用“先更新数据库再删除缓存”的方案,并结合异步重试机制来保证数据的一致性和系统的高性能。
Redis原理—5.性能和使用总结
|
数据采集 Java Python
Python并发编程:多线程(threading模块)
本文详细介绍了Python的threading模块,包括线程的创建、线程同步、线程池的使用,并通过多个示例展示了如何在实际项目中应用这些技术。通过学习这些内容,您应该能够熟练掌握Python中的多线程编程,提高编写并发程序的能力。 多线程编程可以显著提高程序的并发性能,但也带来了新的挑战和问题。在使用多线程时,需要注意避免死锁、限制共享资源的访问,并尽量使用线程池来管理和控制线程。