期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
基于边界定位与纠偏的中文命名实体提取规则研究 被引量:4
1
作者 刘盼 郭延明 +2 位作者 雷军 老明瑞 李国辉 《计算机科学》 CSCD 北大核心 2023年第3期276-281,共6页
相对于英文天然由单词组成而言,中文由于没有分词符,汉字之间的组词更灵活,在命名实体识别时,其边界更加难以确定。当前的主流方法将命名实体识别任务转化为序列标注任务,文中采用BIOES标注方案,针对预测的标签序列进行研究。通过单独... 相对于英文天然由单词组成而言,中文由于没有分词符,汉字之间的组词更灵活,在命名实体识别时,其边界更加难以确定。当前的主流方法将命名实体识别任务转化为序列标注任务,文中采用BIOES标注方案,针对预测的标签序列进行研究。通过单独比较实体头部标签B或尾部标签E,计算实体边界准确率,结果表明提高边界准确率能够进一步提升实体识别准确率;对具有连续标签的实体边界进行拓展和重定位,采用实体最后一个字符的类型标签对实体类型进行纠偏,利用分词信息对标签不完整的实体进行填充;最后,提出增加边界标记的BIO+ES标注方案,用于区分实体边界的非实体字符,以进一步提升中文命名实体识别的性能。 展开更多
关键词 中文命名实体识别 标注方案 实体提取
在线阅读 下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部