当前位置:   article > 正文

【干货书】大规模文本数据的结构化知识挖掘

大规模文本数据的结构化知识挖掘

55cc6467a80fae5f8ab00952356dc44f.png

  1. 来源:专知
  2. 本文为教程,建议阅读5分钟我们研究了从大量非结构化文本语料库中挖掘事实知识结构(例如,实体及其关系)的原则和方法。

f9045211d19bb7f2342e30edc396fbe1.png

现实世界的数据虽然庞大,但在很大程度上是非结构化的,以自然语言文本的形式存在。从大量的文本数据中挖掘结构,而不需要大量的人工注释和标记,这是一个挑战,但也是非常理想的。在这本书中,我们研究了从大量非结构化文本语料库中挖掘事实知识结构(例如,实体及其关系)的原则和方法。与许多现有的结构提取方法不同,现有的方法严重依赖于人工注释数据进行模型训练,我们的轻工作量方法利用存储在外部知识库中的人工管理事实作为远程监督,并利用大型文本语料库中的丰富数据冗余进行上下文理解。这种轻工作量挖掘方法为构建文本语料库带来了一系列新的原则和强大的方法,包括:(1)实体识别、打字和同义词发现;(2)实体关系抽取;(3)开放域属性值挖掘与信息提取。本书介绍了这一新的研究前沿,并指出了一些有前景的研究方向。

https://www.morganclaypool.com/doi/10.2200/S00860ED1V01Y201806DMK015

49ff0dd6f8ac37148ffe4b8a943dd77b.png

fab94acb3e83c4755a9cd74fb8bb2d8b.png

758980ffbf09bbd69d0b9cfa529b42f1.png

418c0768bc1239f0451be96b247252da.png

a0047855ea3b0acec55616d4181613ce.png

d7cb67a518b8f70c24a0e01ff9e393ca.png

声明:本文内容由网友自发贡献,不代表【wpsshop博客】立场,版权归原作者所有,本站不承担相应法律责任。如您发现有侵权的内容,请联系我们。转载请注明出处:https://www.wpsshop.cn/w/花生_TL007/article/detail/348992
推荐阅读
相关标签
  

闽ICP备14008679号