期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
基于层级类别信息的标题自动分类研究 被引量:6
1
作者 葛文镇 刘柏嵩 +1 位作者 王洋洋 赵福青 《计算机应用研究》 CSCD 北大核心 2016年第7期2030-2033,共4页
针对标题文本特征少、特征维度高和分布不均匀导致分类性能不佳的问题,提出了一种利用分类体系结构信息的双向特征选择算法,并在该算法的基础上实现标题分类。该方法以具有严格层级关系的分类体系为应用前提,利用类别与词的同现及分布... 针对标题文本特征少、特征维度高和分布不均匀导致分类性能不佳的问题,提出了一种利用分类体系结构信息的双向特征选择算法,并在该算法的基础上实现标题分类。该方法以具有严格层级关系的分类体系为应用前提,利用类别与词的同现及分布关系进行特征词和候选类别的双向选择,构建类别向量空间;通过分析标题文本特征词在层级类别向量空间的分布所表现出的类别语义信息,确定文本所在层级以及所在层级的候选类别;之后利用分类器对未能成功分类的标题进行分类。在人工标引数据集上的实验结果表明,该方法在不进行语料扩展和外部知识库添加的基础上仍可有效地确定文本所在层级,实现多级学科的分类;并可在识别类别语义信息的基础上,降低候选类别数目,提高分类效率。 展开更多
关键词 标题分类 特征选择 层级结构分类体系 同现分析 向量空间
在线阅读 下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部