期刊导航
期刊开放获取
上海教育软件发展有限公..
期刊文献
+
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
检索
高级检索
期刊导航
共找到
1
篇文章
<
1
>
每页显示
20
50
100
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
显示方式:
文摘
详细
列表
相关度排序
被引量排序
时效性排序
基于向量空间模型的文本分类系统的研究与实现
被引量:
43
1
作者
陈治纲
何丕廉
+1 位作者
孙越恒
郑小慎
《中文信息学报》
CSCD
北大核心
2005年第1期36-41,共6页
文本分类是信息处理的一个重要的研究课题 ,它可以有效的解决信息杂乱的现象并有助于定位所需的信息。本文综合考虑了频度、分散度和集中度等几项测试指标 ,提出了一种新的特征抽取算法 ,克服了传统的从单一或片面的测试指标进行特征抽...
文本分类是信息处理的一个重要的研究课题 ,它可以有效的解决信息杂乱的现象并有助于定位所需的信息。本文综合考虑了频度、分散度和集中度等几项测试指标 ,提出了一种新的特征抽取算法 ,克服了传统的从单一或片面的测试指标进行特征抽取所造成的特征“过度拟合”问题 ,并基于此实现了二级分类模式的文本分类系统。和类中心分类法相比 ,实验结果表明二级分类模式具有较高的精度和召回率。
展开更多
关键词
计算机应用
中文信息处理
文本
分类
测试指标
特征抽取
二级分类模式
在线阅读
下载PDF
职称材料
题名
基于向量空间模型的文本分类系统的研究与实现
被引量:
43
1
作者
陈治纲
何丕廉
孙越恒
郑小慎
机构
天津大学电子信息工程学院
出处
《中文信息学报》
CSCD
北大核心
2005年第1期36-41,共6页
基金
天津市科技发展计划项目 (0 2 310 0 5 11)
文摘
文本分类是信息处理的一个重要的研究课题 ,它可以有效的解决信息杂乱的现象并有助于定位所需的信息。本文综合考虑了频度、分散度和集中度等几项测试指标 ,提出了一种新的特征抽取算法 ,克服了传统的从单一或片面的测试指标进行特征抽取所造成的特征“过度拟合”问题 ,并基于此实现了二级分类模式的文本分类系统。和类中心分类法相比 ,实验结果表明二级分类模式具有较高的精度和召回率。
关键词
计算机应用
中文信息处理
文本
分类
测试指标
特征抽取
二级分类模式
Keywords
computer application
Chinese information processing
text classification
test criterion
feature extraction
two-level classification mode
分类号
TP391 [自动化与计算机技术—计算机应用技术]
在线阅读
下载PDF
职称材料
题名
作者
出处
发文年
被引量
操作
1
基于向量空间模型的文本分类系统的研究与实现
陈治纲
何丕廉
孙越恒
郑小慎
《中文信息学报》
CSCD
北大核心
2005
43
在线阅读
下载PDF
职称材料
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
上一页
1
下一页
到第
页
确定
用户登录
登录
IP登录
使用帮助
返回顶部