期刊导航
期刊开放获取
上海教育软件发展有限公..
期刊文献
+
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
检索
高级检索
期刊导航
共找到
1
篇文章
<
1
>
每页显示
20
50
100
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
显示方式:
文摘
详细
列表
相关度排序
被引量排序
时效性排序
基于统计学习框架的中文新词检测方法
被引量:
10
1
作者
张海军
栾静
+1 位作者
李勇
齐向伟
《计算机科学》
CSCD
北大核心
2012年第2期232-235,共4页
新词自动检测是中文信息处理的重要基础,但中文字符极强的构词能力给新词检测带来了巨大困难。提出一种新词检测的形式化描述模型,用以建立特征和新词检测结果之间的统计联系。在此基础上提出应用统计学习模型作为框架来整合不同类型的...
新词自动检测是中文信息处理的重要基础,但中文字符极强的构词能力给新词检测带来了巨大困难。提出一种新词检测的形式化描述模型,用以建立特征和新词检测结果之间的统计联系。在此基础上提出应用统计学习模型作为框架来整合不同类型的可用特征,以充分发挥特征之间的组合作用,进一步改善新词检测效果。实验表明,统计框架方法的性能明显地优于特征的简单叠加,能有效提高新词检测效果,开放实验和封闭实验的F值分别为49.72%和69.83%,达到了目前的较好水平。
展开更多
关键词
统计框架
新词检测
重复模式
语言知识特征
统计
特征
在线阅读
下载PDF
职称材料
题名
基于统计学习框架的中文新词检测方法
被引量:
10
1
作者
张海军
栾静
李勇
齐向伟
机构
新疆师范大学计算机科学技术学院
中国科学技术大学计算机科学与技术学院
出处
《计算机科学》
CSCD
北大核心
2012年第2期232-235,共4页
基金
国家自然科学基金(61163045)
新疆师范大学博士博士后科研启动基金(XJNUBS1111)资助
文摘
新词自动检测是中文信息处理的重要基础,但中文字符极强的构词能力给新词检测带来了巨大困难。提出一种新词检测的形式化描述模型,用以建立特征和新词检测结果之间的统计联系。在此基础上提出应用统计学习模型作为框架来整合不同类型的可用特征,以充分发挥特征之间的组合作用,进一步改善新词检测效果。实验表明,统计框架方法的性能明显地优于特征的简单叠加,能有效提高新词检测效果,开放实验和封闭实验的F值分别为49.72%和69.83%,达到了目前的较好水平。
关键词
统计框架
新词检测
重复模式
语言知识特征
统计
特征
Keywords
Statistical framework
New words detection
Repeats
Linguistic knowledge feature
Statistical feature
分类号
TP391 [自动化与计算机技术—计算机应用技术]
在线阅读
下载PDF
职称材料
题名
作者
出处
发文年
被引量
操作
1
基于统计学习框架的中文新词检测方法
张海军
栾静
李勇
齐向伟
《计算机科学》
CSCD
北大核心
2012
10
在线阅读
下载PDF
职称材料
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
上一页
1
下一页
到第
页
确定
用户登录
登录
IP登录
使用帮助
返回顶部