%0 Journal Article %A 惠浩添 %A 钱龙华 %A 张民 %A 朱苏阳 %T 基于自监督学习的维基百科家庭关系抽取 %D 2015 %R 10.11772/j.issn.1001-9081.2015.04.1013 %J 计算机应用 %P 1013-1016 %V 35 %N 4 %X

传统有监督的关系抽取方法需要大量人工标注的训练语料,而半监督方法则召回率较低,对此提出了一种基于自监督学习来抽取人物家庭关系的方法。该方法首先将中文维基百科的半结构化信息——家庭关系三元组映射到自由文本中,从而自动生成已标注的训练语料;然后,使用基于特征的关系抽取方法从中文维基百科的文本中获取人物间的家庭关系。在一个人工标注的家庭关系网络测试集上的实验结果表明,该方法优于自举方法,其F1指数达到77%,说明自监督学习可以较为有效地抽取人物家庭关系。

%U http://www.joca.cn/CN/10.11772/j.issn.1001-9081.2015.04.1013