指代消解原理

指代,在下文采用简称或者代称来代替上文已经出现的某一词语,语言学中把这种现象叫做指代现象。

指代,是语言学中的一种语言现象,使用指代词来代替文本中已经出现的某个语言单元的表达方式。将代表同一实体的不同表述划分到一个等价集合的过程称为指代消解。指代消解在信息抽取、智能问答等任务中,具有十分重要的作用。

人称代词:【李明】怕高妈妈一人呆在家里寂寞,【他】便将家里的电视搬了过来。
指示代词:【很多人都想创造一个美好的世界留给孩子】,【这】可以理解,但不完全正确
有定描述:【贸易制裁】似乎成了【美国政府在对华关系中惯用的大棒】。然而,这【大棒】果真如美国政府所希望的那样灵验吗?

指代消解:形式上,将代表同一实体的不同指称划分到一个等价集合(指代链)的过程称为指代消解。

概念

照应语Anaphor,指代上文语言单元的词语;

先行语Antencedent,指代词所指向的语言单元。

实体,Entity,客观存在的一个或一类物体。

指称,Mention,指代某个实体的表述。

实体可以使用名字来表示,也可以使用名词、代词、短语来表示,代表同一实体的 不同表达方式都称为指称。

指代分两种:

1)回指:照应语和先行语之间存在语义关联,指代关系依赖上下文,不同语境下照应语指代不同实体。

2)共指,两个指称语表示现实世界的同一实体,指代关系独立于上下文客观存在。

中文指代类别:

1)代词指代,你我他、这个、那个等

2)名词短语指代

场景

  • 全文理解:完整的文章中有大量的指代,要理解文章内容需要知道每一个代词指向的是哪一个实体。
  • 文本摘要:使用代词会使行文更加自然,而不是全文均为实体自身名称。
  • 问答系统:比如搜索“谁娶了Claudia Ross”,出来“He married Claudia Ross in 1971”,则系统必须消解“He”是谁。
  • 信息抽取:当关系抽取或者事件抽取时,缺乏关键实体或论元时,关系或事件无法成立,特别在一些公文或法律文书中,类似“原告”、“被告”并不是常规的实体,因此需要将指向对应的实体上。

发展

(1)基于启发式规则

        Hobbs算法:基于句法解析树,对实体短语和先行语之间的关系进行指代判别。RAP算法:依靠句法分析特征和动态关注状态解决第三人称代词和反身代词的指代消解问题。基于规则的指代消解方案,大多利用句法分析和语义角色信息,通过指定严密的规则约束来达到匹配指代词和先行语的目的。

(2)基于统计模型

    基于统计的方阿飞中,先行语和指代词之间的共现频率为重要的考虑指标,同时融合二者之间的词汇、语法、句法、语义一致性等特征进行指代关系判断。

(3)基于机器学习分类模型

        1)指称对模型

        将指代消解任务转化为判断先行与与指代词之间是否匹配的分类任务。

        2)实体-指称模型

        同一指代链中各指代语指向概念相同的同一实体,实体-指称模型不再是判断两个实体是否是指代关系,而是判断当前实体是否能够并入指代链当中的过程。

        3)排序模型

        指代词选择多个候选先行语中概率最高的一个,建立指代关系。

        基于中心理论构建tournament模型,对两个候选先行语进行比较,选择二者概率较大的建立指代关系。另外还有有监督的最大熵排序指代消解算法。排序算法能够为当前实体找到候选指代链中的选择最优,但是该模型不能解决当前实体是否是指代词的问题。

        

基于深度学习模型

        Clark基于高维度指代链特征,学习clstering-paire特征,学习合并不同的指代链,并形成最终的指代决策。

        Lee等人提出端到端的深度学习指代消解模型,zhang等人采用双仿射注意力机制,在端到端指代消解模型当中对指称识别和指代关系构建两个子任务进行联合。

        Aralikatte将指代消解任务转化为阅读理解任务,2020年Wu等人将阅读理解任务融入到端到端的指代消解模型。

相关推荐

  1. 消解原理

    2024-05-01 13:04:03       29 阅读
  2. Map和Set的迭原理

    2024-05-01 13:04:03       23 阅读
  3. [Unity] 基于迭器的协程底层原理详解

    2024-05-01 13:04:03       66 阅读

最近更新

  1. docker php8.1+nginx base 镜像 dockerfile 配置

    2024-05-01 13:04:03       98 阅读
  2. Could not load dynamic library ‘cudart64_100.dll‘

    2024-05-01 13:04:03       106 阅读
  3. 在Django里面运行非项目文件

    2024-05-01 13:04:03       87 阅读
  4. Python语言-面向对象

    2024-05-01 13:04:03       96 阅读

热门阅读

  1. Day41 HTTP编程

    2024-05-01 13:04:03       32 阅读
  2. 邦芒面试:面试时,如何展现卓越的口才

    2024-05-01 13:04:03       30 阅读
  3. 程序员商业模式画布

    2024-05-01 13:04:03       26 阅读
  4. 云计算与云服务

    2024-05-01 13:04:03       37 阅读
  5. 云计算知识点-02

    2024-05-01 13:04:03       34 阅读
  6. LLM系列(2):开源LLM Promp调优之道进阶指南

    2024-05-01 13:04:03       39 阅读
  7. typescript学习笔记

    2024-05-01 13:04:03       39 阅读
  8. html中引用视频文件的方式有哪些?

    2024-05-01 13:04:03       118 阅读
  9. 基于docker-compose使用虚拟机搭建redis集群

    2024-05-01 13:04:03       34 阅读
  10. GBCD:图卷积宽度跨域推荐系统

    2024-05-01 13:04:03       39 阅读
  11. C/C++中的逻辑运算与汇编指令的交互

    2024-05-01 13:04:03       107 阅读