期刊文献+
共找到89篇文章
< 1 2 5 >
每页显示 20 50 100
基于狄利克雷模型的分布鲁棒机组组合 被引量:32
1
作者 张玉敏 韩学山 +4 位作者 杨明 王明强 张利 叶平峰 徐波 《中国电机工程学报》 EI CSCD 北大核心 2019年第17期5074-5084,共11页
在应对风电不确定性电源发电的机组组合决策中,针对风电随机过程难以表达为确切概率密度与分布的问题,提出基于非精确狄利克雷模型的分布鲁棒机组组合优化模型与求解方法。其核心体现在:首先,依据历史信息,采用非精确狄利克雷模型(impre... 在应对风电不确定性电源发电的机组组合决策中,针对风电随机过程难以表达为确切概率密度与分布的问题,提出基于非精确狄利克雷模型的分布鲁棒机组组合优化模型与求解方法。其核心体现在:首先,依据历史信息,采用非精确狄利克雷模型(imprecise Dirichlet model,IDM)构造包含风电输出功率所有可能概率分布的模糊集;其次,依据该模糊集,在满足一定置信水平下,推演风电输出功率不确定性区间的表达,从而使其与传统自适应鲁棒优化模型相衔接;由此,构建了分布鲁棒优化决策模型,同时采用列约束生成(column and constraint generation,C&CG)算法对其求解;最后,通过IEEE118节点系统算例,验证模型和方法的有效性。 展开更多
关键词 非精确狄利克雷模型 模糊集 C&CG算法 概率分布不确定性 自适应鲁棒机组组合
在线阅读 下载PDF
中国人口结构变动下的家庭户消费模式——基于狄利克雷模型的多时点分析 被引量:8
2
作者 孙亮亮 蒋耒文 《人口与经济》 CSSCI 北大核心 2021年第5期56-68,共13页
2000年以后,初步完成人口转型的中国进入以人口年龄、城乡结构持续转变为特点的后人口转变时期,长期以来的快速经济增长带动了居民消费的巨大变化;消费规模的扩大也同时成为经济增长的主要拉动力。但关于新时期人口结构和空间分布的转... 2000年以后,初步完成人口转型的中国进入以人口年龄、城乡结构持续转变为特点的后人口转变时期,长期以来的快速经济增长带动了居民消费的巨大变化;消费规模的扩大也同时成为经济增长的主要拉动力。但关于新时期人口结构和空间分布的转变对消费结构模式影响的研究非常缺乏。利用中国家庭动态追踪调查(CFPS)2012—2016三期微观调查数据,通过构建狄利克雷多分类比例回归模型,探究该时期家庭人口特征对家庭户消费模式的影响和两者关系在不同年份和区域的差异。结果显示,在控制收入的影响后,我国家庭人口特征对消费模式的变化发挥了重要的作用:从整体来看,城乡差异和城市化进程作用明显,全国消费规模的扩大主要来源于城市,而消费结构的变化主要体现在农村;从人口因素和消费结构的关系来看,户主年龄对居住、医疗、交通通信、文教娱乐支出比例的影响呈"U"型关系,但对日用品和衣着支出比例的影响呈倒"U"型,规模较大、受教育程度高和女性户主的家庭,非食品消费支出比例更大;从区域差异来看,中西部地区家庭食品消费支出比例低于东部,但家庭人口特征对消费结构的影响模式在不同区域基本稳定;从纵向的视角来看,城乡家庭消费结构差异随时间持续扩大,而受教育程度高和女性户主家庭非食品消费支出比例高的情况有所弱化。 展开更多
关键词 消费模式 家庭人口特征 区域差异 狄利克雷模型
在线阅读 下载PDF
基于隐含狄利克雷分配模型的企业创新测量方法研究 被引量:1
3
作者 叶琴 蔡建峰 张秋韵 《科技进步与对策》 CSSCI 北大核心 2024年第2期90-98,共9页
如何准确测量企业创新是国家创新驱动发展战略背景下学界和业界亟待解决的关键问题。近年来,专利和研发支出作为当前主流企业创新代理指标备受质疑。为此,基于上市公司分析师报告文本,引入机器学习领域非监督学习方法,通过构建隐含狄利... 如何准确测量企业创新是国家创新驱动发展战略背景下学界和业界亟待解决的关键问题。近年来,专利和研发支出作为当前主流企业创新代理指标备受质疑。为此,基于上市公司分析师报告文本,引入机器学习领域非监督学习方法,通过构建隐含狄利克雷分配主题模型,开发一种新的测量企业创新的方法,并与当前主流方法进行比较。研究发现:①基于文本的企业创新测量方法既适用于专利和研发企业,也适用于非专利和非研发企业;②对于专利和研发企业而言,基于文本的企业创新与企业专利申请和研发支出显著相关;对于非专利和非研发企业而言,新测量方法能够有效识别企业利用新技术、开辟新市场等创新实践;③时间序列分析表明,基于文本分析的企业创新能够准确反映样本区间企业创新活动宏观趋势。 展开更多
关键词 隐含狄利克雷分配模型 企业创新 文本分析 主题模型 分析师报告
在线阅读 下载PDF
基于潜在狄利克雷分布模型的多文档情感摘要 被引量:9
4
作者 荀静 刘培玉 +1 位作者 杨玉珍 张艳辉 《计算机应用》 CSCD 北大核心 2014年第6期1636-1640,共5页
针对当前方法难以获取评论文本全局情感倾向性的问题,提出一种基于潜在狄利克雷分布(LDA)模型的多文档情感摘要方法。该方法首先对给定的句子进行情感分析,抽取带有主观性评价的句子;然后,应用LDA模型表示已抽取的句子,并通过词汇的重... 针对当前方法难以获取评论文本全局情感倾向性的问题,提出一种基于潜在狄利克雷分布(LDA)模型的多文档情感摘要方法。该方法首先对给定的句子进行情感分析,抽取带有主观性评价的句子;然后,应用LDA模型表示已抽取的句子,并通过词汇的重要度和句子的特征计算句子的权重;最终提取情感文摘。实验结果表明,该方法能够有效地识别情感关键句,在准确率、召回率和F值上均有不错的效果。 展开更多
关键词 潜在狄利克雷分布模型 主观句子 情感分析 多文档摘要
在线阅读 下载PDF
基于加权隐含狄利克雷分配模型的新闻话题挖掘方法 被引量:14
5
作者 李湘东 巴志超 黄莉 《计算机应用》 CSCD 北大核心 2014年第5期1354-1359,共6页
针对传统新闻话题挖掘准确率不高、话题可解释性差等问题,结合新闻报道的体例结构特点,提出一种基于加权隐含狄利克雷分配(LDA)模型的新闻话题挖掘方法。首先从不同角度改进词汇权重并构造复合权值,扩展LDA模型生成特征词的过程,以获取... 针对传统新闻话题挖掘准确率不高、话题可解释性差等问题,结合新闻报道的体例结构特点,提出一种基于加权隐含狄利克雷分配(LDA)模型的新闻话题挖掘方法。首先从不同角度改进词汇权重并构造复合权值,扩展LDA模型生成特征词的过程,以获取表意性较强的词汇;其次,将类别区分词(CDW)方法应用于建模结果的词序优化上,以消除话题歧义和噪声、提高话题的可解释性;最后,依据模型话题概率分布的数学特性,从文档对话题的贡献度以及话题权值概率角度对话题进行量化计算,以获取热门话题。仿真实验表明:与传统LDA模型相比,改进方法的漏报率、误报率分别平均降低1.43%、0.16%,最小标准代价平均降低2.68%,验证了该方法的可行性和有效性。 展开更多
关键词 新闻报道 话题挖掘 加权隐含狄利克雷分配模型 类别区分词 词序优化
在线阅读 下载PDF
融合纹理结构的潜在狄利克雷分布铁路扣件检测模型 被引量:9
6
作者 罗建桥 刘甲甲 +1 位作者 李柏林 狄仕磊 《计算机应用》 CSCD 北大核心 2016年第2期574-579,共6页
针对潜在狄利克雷分布(LDA)模型忽略图像结构的问题,提出一种融合图像纹理结构信息的LDA扣件检测模型TS_LDA。首先,设计一种单通道局部二值模式(LBP)方法获得图像纹理结构,将单词的纹理信息作为标注,用单词和标注的联合分布反映了... 针对潜在狄利克雷分布(LDA)模型忽略图像结构的问题,提出一种融合图像纹理结构信息的LDA扣件检测模型TS_LDA。首先,设计一种单通道局部二值模式(LBP)方法获得图像纹理结构,将单词的纹理信息作为标注,用单词和标注的联合分布反映了图像的结构特点;然后,将标注信息嵌入LDA,由单词和标注共同推导图像主题,改进之后的主题分布考虑了图像结构;最后,以该主题分布训练分类器,检测扣件状态。相比LDA方法,正常扣件与失效扣件在TS_LDA主题空间中的区分度增加了5%~35%,平均漏检率降低了1.8%~2.4%。实验结果表明,TS_LDA能够提高扣件图像建模精度,从而更加准确地检测扣件状态。 展开更多
关键词 纹理结构 视觉单词 单词标注 潜在狄利克雷分布模型 铁路扣件检测
在线阅读 下载PDF
基于隐含狄利克雷分配模型的消费者在线评论复杂网络构建及其应用 被引量:10
7
作者 刘晓君 那日萨 崔雪莲 《系统工程学报》 CSCD 北大核心 2017年第3期305-312,共8页
为研究消费者在线评论的相互关系及整体演化发展,以隐含狄利克雷分配模型对消费者在线评论进行话题挖掘为基础,通过Pearson相似度确定评论间话题关系,构建了以评论为节点的复杂网络模型.以京东等平台上的手机评论语料库为例,对相应复杂... 为研究消费者在线评论的相互关系及整体演化发展,以隐含狄利克雷分配模型对消费者在线评论进行话题挖掘为基础,通过Pearson相似度确定评论间话题关系,构建了以评论为节点的复杂网络模型.以京东等平台上的手机评论语料库为例,对相应复杂网络的拓扑特性进行分析.研究表明,相同产品相同规模的评论网络统计特性相近;而相同平台上同一产品不同规模的评论网络性质差异明显,即小规模评论(产品销售初期)构成的网络是一个无标度网络,大规模评论(产品销售中后期)构成的网络演化为一个度分布为钟形分布的小世界网络.揭示了消费者发表在线评论行为之间相互作用,会影响整体评论网络的拓扑性质和演化规律,并为市场营销和管理实践提出了指导性建议. 展开更多
关键词 在线评论 隐含狄利克雷分配模型 复杂网络 皮尔森相似度 度分布
在线阅读 下载PDF
基于狄利克雷混合模型的刀具磨损量在线估计 被引量:8
8
作者 于劲松 时祎瑜 +1 位作者 梁爽 唐荻音 《仪器仪表学报》 EI CAS CSCD 北大核心 2017年第3期689-694,共6页
提出了一种基于狄利克雷混合模型的刀具磨损状态监测和磨损量估计的新方法。该方法将刀具磨损过程描述为磨损量的累积过程,通过对磨损增量的连续估计获得刀具当前的磨损量估计。首先对原始力信号进行特征提取,接着在不确定磨损增量状态... 提出了一种基于狄利克雷混合模型的刀具磨损状态监测和磨损量估计的新方法。该方法将刀具磨损过程描述为磨损量的累积过程,通过对磨损增量的连续估计获得刀具当前的磨损量估计。首先对原始力信号进行特征提取,接着在不确定磨损增量状态数量的前提下采用狄利克雷混合模型对特征自动分类,然后利用吉布斯采样方法确定模型参数,最终得到描述力信号特征与磨损增量映射关系的刀具磨损状态混合模型。根据该混合模型以及当前的力信号信息即可完成刀具磨损量的在线估计。真实应用案例证明了该方法能自适应学习磨损状态并有效估计刀具的连续磨损值。 展开更多
关键词 刀具健康状态监测 刀具磨损 狄利克雷混合模型 吉布斯采样
在线阅读 下载PDF
基于数据关联狄利克雷混合模型的电网净负荷不确定性表征研究 被引量:7
9
作者 李远征 孙天乐 +2 位作者 刘云 赵勇 曾志刚 《自动化学报》 EI CAS CSCD 北大核心 2022年第3期747-761,共15页
针对电网净负荷时序数据关联的特点,提出基于数据关联的狄利克雷混合模型(Data-relevance Dirichlet process mixture model,DDPMM)来表征净负荷的不确定性.首先,使用狄利克雷混合模型对净负荷的观测数据与预测数据进行拟合,得到其混合... 针对电网净负荷时序数据关联的特点,提出基于数据关联的狄利克雷混合模型(Data-relevance Dirichlet process mixture model,DDPMM)来表征净负荷的不确定性.首先,使用狄利克雷混合模型对净负荷的观测数据与预测数据进行拟合,得到其混合概率模型;然后,提出考虑数据关联的变分贝叶斯推断方法,改进后验分布对该混合概率模型进行求解,从而得到混合模型的最优参数;最后,根据净负荷预测值的大小得到其对应的预测误差边缘概率分布,实现不确定性表征.本文基于比利时电网的净负荷数据进行检验,算例结果表明:与传统的狄利克雷混合模型和高斯混合模型(Gaussian mixture model,GMM)等方法相比,所提出的基于数据关联狄利克雷混合模型可以更为有效地表征净负荷的不确定性. 展开更多
关键词 狄利克雷混合模型 净负荷 不确定性表征 时序序列 预测误差
在线阅读 下载PDF
基于潜在狄利克雷分配模型预测克隆代码不一致变化的可能性 被引量:3
10
作者 尹丽丽 张丽萍 +2 位作者 王春晖 涂颖 刘东升 《计算机应用》 CSCD 北大核心 2014年第6期1788-1791,1811,共5页
程序员对源代码的拷贝、粘贴及修改活动会导致软件中出现大量的克隆代码,而在版本的进化过程中,克隆代码的不一致变化是引起程序错误的主要原因,同时会增加维护成本。为了解决该问题,提出一种新的研究方法:首先构建版本间克隆群的映射关... 程序员对源代码的拷贝、粘贴及修改活动会导致软件中出现大量的克隆代码,而在版本的进化过程中,克隆代码的不一致变化是引起程序错误的主要原因,同时会增加维护成本。为了解决该问题,提出一种新的研究方法:首先构建版本间克隆群的映射关系,其次借助潜在狄利克雷分配(LDA)模型提取直系克隆群集主题,最后预测克隆代码不一致变化的可能性。对一款软件的8个版本进行了实验,实验结果的区分度明显,可以有效地预测不一致变化的可能性,评估软件质量和可信性。 展开更多
关键词 预测 克隆代码 不一致变化 潜在狄利克雷分配模型 进化
在线阅读 下载PDF
基于隐含狄利克雷分配模型的图像分类算法 被引量:9
11
作者 杨赛 赵春霞 《计算机工程》 CAS CSCD 2012年第14期181-183,共3页
概率隐含语义分析模型不适用于大规模图像数据集,为此,提出一种基于隐含狄利克雷分配模型(LDA)的图像分类算法。以BOF特征作为图像内容的初始描述,利用Gibbs抽样算法近似估算LDA模型参数,得到图像的隐含主题分布特征,并采用k近邻算法对... 概率隐含语义分析模型不适用于大规模图像数据集,为此,提出一种基于隐含狄利克雷分配模型(LDA)的图像分类算法。以BOF特征作为图像内容的初始描述,利用Gibbs抽样算法近似估算LDA模型参数,得到图像的隐含主题分布特征,并采用k近邻算法对图像进行分类。实验结果表明,与基于概率隐含语义分析模型的分类算法相比,该算法的分类性能较优。 展开更多
关键词 BOF模型 中层语义特征 隐含狄利克雷分配模型 隐含主题分布特征 K近邻算法 图像分类
在线阅读 下载PDF
一种基于狄利克雷过程混合模型的文本聚类算法 被引量:10
12
作者 高悦 王文贤 杨淑贤 《信息网络安全》 2015年第11期60-65,共6页
随着互联网的普及,论坛、微博、微信等新媒体已经成为人们获取和发布信息的重要渠道,而网络中的这些文本数据,由于文本数目和内容的不确定性,给网络舆情聚类分析工作带来了很大的挑战。在文本聚类分析中,选择合适的聚类数目一直是一个... 随着互联网的普及,论坛、微博、微信等新媒体已经成为人们获取和发布信息的重要渠道,而网络中的这些文本数据,由于文本数目和内容的不确定性,给网络舆情聚类分析工作带来了很大的挑战。在文本聚类分析中,选择合适的聚类数目一直是一个难点。文章提出了一种基于狄利克雷过程混合模型的文本聚类算法,该算法基于非参数贝叶斯框架,可以将有限混合模型扩展成无限混合分量的混合模型,使用狄利克雷过程中的中国餐馆过程构造方式,实现了基于中国餐馆过程的狄利克雷混合模型,然后采用吉布斯采样算法近似求解模型,能够在不断的迭代过程中确定文本的聚类数目。实验结果表明,文章提出的聚类算法,和经典的K-means聚类算法相比,不仅能更好的动态确定文本主题聚类数目,而且该算法的聚类质量(纯度、F-score和轮廓系数)明显好于K-means聚类算法。 展开更多
关键词 文本聚类 狄利克雷过程混合模型 非参数贝叶斯 吉布斯采样
在线阅读 下载PDF
基于潜在狄利克雷分配模型和互信息的无监督特征选取法 被引量:3
13
作者 董元元 陈基漓 唐小侠 《计算机应用》 CSCD 北大核心 2012年第8期2250-2252,2257,共4页
为解决互信息(MI)在特征选取中的类别缺失和倾向低频词问题,提出LDA-σ方法。该方法使用潜在狄利克雷分配模型(LDA)提取潜在主题,以"词—主题"间互信息的标准差作为特征评估函数。在Reuters-21578语料集上提取特征词并进行分... 为解决互信息(MI)在特征选取中的类别缺失和倾向低频词问题,提出LDA-σ方法。该方法使用潜在狄利克雷分配模型(LDA)提取潜在主题,以"词—主题"间互信息的标准差作为特征评估函数。在Reuters-21578语料集上提取特征词并进行分类,LDA-σ方法的微平均F1最高达0.9096;宏平均F1优于其他算法,最高达0.7823。实验表明,LDA-σ方法可用于文本特征选取。 展开更多
关键词 潜在狄利克雷分配模型 互信息 评价函数
在线阅读 下载PDF
基于狄利克雷过程混合模型的城市活动聚类方法研究 被引量:1
14
作者 陈仲 《交通运输系统工程与信息》 EI CSCD 北大核心 2020年第6期247-252,共6页
手机信令数据不仅记录个体出行轨迹,也为分析城市活动空间分布特征提供了基础.本文提出一种基于狄利克雷混合模型的城市活动特征聚类方法,以手机信令提取居民出行OD为基础,将每个基站的到发出行量作为表征该基站所处空间位置的活动特征... 手机信令数据不仅记录个体出行轨迹,也为分析城市活动空间分布特征提供了基础.本文提出一种基于狄利克雷混合模型的城市活动特征聚类方法,以手机信令提取居民出行OD为基础,将每个基站的到发出行量作为表征该基站所处空间位置的活动特征,研究特征的聚类方法.引入狄利克雷分布作为先验分布,由中餐馆模型推定特征聚类数量.与其他聚类方法相比,该方法最大的优点在于无需事先指定聚类数量,避免了传统聚类方法的缺陷.将本文方法应用到三亚市城市活动特征聚类当中,结果能够有效地反应不同城市功能组团的活动特征. 展开更多
关键词 城市交通 出行特征 狄利克雷过程混合模型 手机信令
在线阅读 下载PDF
基于潜在狄利克雷分配模型的医疗数据研究 被引量:2
15
作者 许珠香 江弋 《厦门大学学报(自然科学版)》 CAS CSCD 北大核心 2013年第3期356-359,共4页
以潜在狄利克雷分配(Lejeune Dirichlet allocation,LDA)模型为基础,研究中医诊疗中的多关系主题模型,提出一个症状-中药-治疗-诊断方法(symptom-herb-therapies-diagnosis topic,SHTDT)模型,用于提取中医临床数据中的症状、中药、治疗... 以潜在狄利克雷分配(Lejeune Dirichlet allocation,LDA)模型为基础,研究中医诊疗中的多关系主题模型,提出一个症状-中药-治疗-诊断方法(symptom-herb-therapies-diagnosis topic,SHTDT)模型,用于提取中医临床数据中的症状、中药、治疗方法和诊断的主题结构.参数推理采用Gibbs抽样,根据主题间平均相似度,确定最佳主题数.实验中采用SHTDT模型可以预测给定症状的患者的主题分布、中药、治疗方法及诊断结果,为临床医生和研究人员提供参考.结果表明该模型能够为中医临床诊疗规律的研究提供一个新的统计工具. 展开更多
关键词 中医诊断 中医治疗 潜在狄利克雷分配(LDA)模型 GIBBS抽样 多关系主题
在线阅读 下载PDF
基于狄利克雷多项分配模型的多源文本主题挖掘模型 被引量:1
16
作者 徐立洋 黄瑞章 +2 位作者 陈艳平 钱志森 黎万英 《计算机应用》 CSCD 北大核心 2018年第11期3094-3099,3104,共7页
随着文本数据来源渠道越来越丰富,面向多源文本数据进行主题挖掘已成为文本挖掘领域的研究重点。由于传统主题模型主要面向单源文本数据建模,直接应用于多源文本数据有较多的限制。针对该问题提出了基于狄利克雷多项分配(DMA)模型的多... 随着文本数据来源渠道越来越丰富,面向多源文本数据进行主题挖掘已成为文本挖掘领域的研究重点。由于传统主题模型主要面向单源文本数据建模,直接应用于多源文本数据有较多的限制。针对该问题提出了基于狄利克雷多项分配(DMA)模型的多源文本主题挖掘模型——多源狄利克雷多项分配模型(MSDMA)。通过考虑主题在不同数据源的词分布的差异性,结合DMA模型的非参聚类性质,模型主要解决了如下三个问题:1)能够学习出同一个主题在不同数据源中特有的词分布形式;2)通过数据源之间共享主题空间和词项空间,使得数据源间可进行主题知识互补,提升对高噪声、低信息量的数据源的主题发现效果;3)能自主学习出每个数据源内的主题数量,不需要事先给定主题个数。最后通过在模拟数据集和真实数据集的实验结果表明,所提模型比传统主题模型能更有效地对多源数据进行主题信息挖掘。 展开更多
关键词 多源文本数据 主题模型 吉布斯采样 狄利克雷多项分配模型 文本挖掘
在线阅读 下载PDF
基于狄利克雷过程混合模型的内外先验融合
17
作者 张墨华 彭建华 《计算机科学》 CSCD 北大核心 2020年第5期172-180,共9页
近年来,使用高斯混合模型作为块先验的贝叶斯方法取得了优秀的图像复原性能,针对这类模型分量固定及主要依赖外部学习的缺点,提出了一种新的基于狄利克雷过程混合模型的图像先验模型。该模型从干净图像数据库中学习外部通用先验,从退化... 近年来,使用高斯混合模型作为块先验的贝叶斯方法取得了优秀的图像复原性能,针对这类模型分量固定及主要依赖外部学习的缺点,提出了一种新的基于狄利克雷过程混合模型的图像先验模型。该模型从干净图像数据库中学习外部通用先验,从退化图像中学习内部先验,借助模型中统计量的可累加性自然实现内外部先验融合。通过聚类的新增及归并机制,模型的复杂度随着数据的增大或缩小而自适应地变化,可以学习到可解释及紧凑的模型。为了求解所有隐变量的变分后验分布,提出了一种结合新增及归并机制的批次更新可扩展变分算法,解决了传统坐标上升算法在大数据集下效率较低、容易陷入局部最优解的问题。在图像去噪及填充实验中,相比传统方法,所提模型无论在客观质量评价还是视觉观感上都更有优势,验证了该模型的有效性。 展开更多
关键词 狄利克雷混合模型 图像复原 变分推理 批次更新 先验学习
在线阅读 下载PDF
潜在狄利克雷分配模型在网络日志的应用
18
作者 许两有 许珠香 《厦门大学学报(自然科学版)》 CAS CSCD 北大核心 2013年第4期455-458,共4页
近年来,基于Web日志的数据挖掘技术逐渐成为理论研究和商业应用中的热点问题,而其中Web用户分类又是挖掘领域中最重要的研究主题之一.对Web用户分类能够发现用户之间相似的用户行为,从而针对具体用户群设置对应的服务项目.根据用户的历... 近年来,基于Web日志的数据挖掘技术逐渐成为理论研究和商业应用中的热点问题,而其中Web用户分类又是挖掘领域中最重要的研究主题之一.对Web用户分类能够发现用户之间相似的用户行为,从而针对具体用户群设置对应的服务项目.根据用户的历史访问网页地址(URL)信息,提出了基于加权潜在狄利克雷分配(LDA)模型的用户分类方法,将用户划分到不同的主题群体,实验表明,这种方法能达到很好的分类效果. 展开更多
关键词 WEB日志 潜在狄利克雷分配(LDA)模型 URL 分类
在线阅读 下载PDF
基于LDA主题模型的在途驾驶风格识别方法
19
作者 汪娇 刘锴 +2 位作者 栗慧哲 曹鹏 王秋玲 《中国安全科学学报》 CAS CSCD 北大核心 2024年第10期197-204,共8页
为增强人机共驾条件下智能系统对个体驾驶行为的理解,提出一种基于潜在狄利克雷分配(LDA)主题模型的在途驾驶风格识别方法,从多维度挖掘车辆轨迹信息,快速提取和识别驾驶员潜在驾驶风格特征。首先,建立驾驶行为语义理解规则,从驾驶作业... 为增强人机共驾条件下智能系统对个体驾驶行为的理解,提出一种基于潜在狄利克雷分配(LDA)主题模型的在途驾驶风格识别方法,从多维度挖掘车辆轨迹信息,快速提取和识别驾驶员潜在驾驶风格特征。首先,建立驾驶行为语义理解规则,从驾驶作业的场景感知层、模式层、操作层以及车辆状态层出发,将连续的轨迹时序数据阐述为驾驶行为语义理解词汇;其次,根据主题困惑度和主题一致性指标定义4类习惯性驾驶风格:稳定型、保守型、适中型以及激进型;最后,将每位驾驶员的在途驾驶风格识别为上述驾驶风格的概率组合。结果表明:所提出的在途驾驶风格识别方法考虑驾驶员在驾驶过程中的异质性和不一致性,能够解释同一驾驶员在不同驾驶环境下表现出差异化驾驶风格的现象,同时,有助于提高驾驶风格在途识别的全面性以及可理解性。 展开更多
关键词 潜在狄利克雷分配(LDA)主题模型 在途驾驶风格 轨迹数据 语义理解 驾驶行为
在线阅读 下载PDF
基于主题模型的改进随机森林算法在文本分类中的应用 被引量:7
20
作者 姚立 张曦煌 《计算机应用与软件》 2017年第8期173-178,212,共7页
针对传统随机森林算法在维度高、噪声大的文本分类上出现计算复杂度高和分类效果较差的问题,提出一种基于隐狄利克雷分配(LDA)主题模型的改进随机森林算法。该算法利用LDA主题模型对原始文本建立模型,将原始文本映射到主题空间上,保证... 针对传统随机森林算法在维度高、噪声大的文本分类上出现计算复杂度高和分类效果较差的问题,提出一种基于隐狄利克雷分配(LDA)主题模型的改进随机森林算法。该算法利用LDA主题模型对原始文本建立模型,将原始文本映射到主题空间上,保证了文本主旨与原始文本的一致性,同时也大大降低了文本噪声对分类的影响;并且针对随机森林中决策树特征的随机选择方法,提出在决策树生成过程中,利用对称不确定计算各个特征之间的相关性,从而可以降低不同决策树之间的关联度。最终在主题空间上利用改进的随机森林算法对文本进行分类。经过实验证明,该算法在文本分类上具有良好的优越性。 展开更多
关键词 狄利克雷模型 主题模型 随机森林 特征评估 文本分类
在线阅读 下载PDF
上一页 1 2 5 下一页 到第
使用帮助 返回顶部