期刊导航
期刊开放获取
上海教育软件发展有限公..
期刊文献
+
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
检索
高级检索
期刊导航
共找到
1
篇文章
<
1
>
每页显示
20
50
100
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
显示方式:
文摘
详细
列表
相关度排序
被引量排序
时效性排序
基于PLSA主题模型的多标记文本分类
被引量:
5
1
作者
蒋铭初
潘志松
尤峻
《数据采集与处理》
CSCD
北大核心
2016年第3期541-547,共7页
为解决多标记文本分类时文本标记关系不明确以及特征维数过大的问题,提出了基于概率隐语义分析(Probabilistic latent semantic analysis,PLSA)模型的多标记假设重用文本分类算法。该方法首先将训练样本通过PLSA模型映射到隐语义空间,...
为解决多标记文本分类时文本标记关系不明确以及特征维数过大的问题,提出了基于概率隐语义分析(Probabilistic latent semantic analysis,PLSA)模型的多标记假设重用文本分类算法。该方法首先将训练样本通过PLSA模型映射到隐语义空间,以文本的主题分布表示一篇文本,在去噪的同时可以大大降低数据维度。在此基础上利用多标记假设重用算法(Multi-label algorithm of hypothesis reuse,MAHR)进行分类,由于经过PLSA降维后的特征组本身就具有语义信息,因此算法能够精确地挖掘出多标记之间的关系并用于训练基分类器,从而避免了人为输入标记关系的缺陷。实验验证了该方法能够充分利用PLSA降维得到的语义信息来改善多标记文本分类的性能。
展开更多
关键词
文本分类
多标记
学习
概率隐语义分析
多标记假设重用算法
在线阅读
下载PDF
职称材料
题名
基于PLSA主题模型的多标记文本分类
被引量:
5
1
作者
蒋铭初
潘志松
尤峻
机构
解放军理工大学指挥信息系统学院
出处
《数据采集与处理》
CSCD
北大核心
2016年第3期541-547,共7页
基金
国家自然科学基金(61473149)资助项目
文摘
为解决多标记文本分类时文本标记关系不明确以及特征维数过大的问题,提出了基于概率隐语义分析(Probabilistic latent semantic analysis,PLSA)模型的多标记假设重用文本分类算法。该方法首先将训练样本通过PLSA模型映射到隐语义空间,以文本的主题分布表示一篇文本,在去噪的同时可以大大降低数据维度。在此基础上利用多标记假设重用算法(Multi-label algorithm of hypothesis reuse,MAHR)进行分类,由于经过PLSA降维后的特征组本身就具有语义信息,因此算法能够精确地挖掘出多标记之间的关系并用于训练基分类器,从而避免了人为输入标记关系的缺陷。实验验证了该方法能够充分利用PLSA降维得到的语义信息来改善多标记文本分类的性能。
关键词
文本分类
多标记
学习
概率隐语义分析
多标记假设重用算法
Keywords
Key words: text classification
multi-label learning
probabilistic latent semantic analysis (PLSA)
multi-label algorithm of hypothesis reuse (MAHR)
分类号
TP391 [自动化与计算机技术—计算机应用技术]
在线阅读
下载PDF
职称材料
题名
作者
出处
发文年
被引量
操作
1
基于PLSA主题模型的多标记文本分类
蒋铭初
潘志松
尤峻
《数据采集与处理》
CSCD
北大核心
2016
5
在线阅读
下载PDF
职称材料
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
上一页
1
下一页
到第
页
确定
用户登录
登录
IP登录
使用帮助
返回顶部