随着经济活动数据的不断丰富,互联网平台上产生了大量的财经文本,其中蕴含了经济领域发展状况的影响因素.如何从这些财经文本中有效地挖掘与经济有关的经济要素,是实现非结构化数据在经济研究中应用的关键.根据人工构建非结构化经济指...随着经济活动数据的不断丰富,互联网平台上产生了大量的财经文本,其中蕴含了经济领域发展状况的影响因素.如何从这些财经文本中有效地挖掘与经济有关的经济要素,是实现非结构化数据在经济研究中应用的关键.根据人工构建非结构化经济指标的局限性,以及主题模型在非结构化经济指标挖掘中存在的问题,结合已有经济领域分类标准、词语之间的语义关系和词语对主题的代表性,定义了文档的领域隶属度、词语与主题的语义相关度和词语对主题的贡献度,用于分别描述CRF(Chinese restaurant franchise)中餐厅的菜肴风格、顾客之间对菜肴要求的一致程度和顾客对菜肴的专一程度;结合文档领域属性、词语语义和词语在主题中的出现情况,提出了PSP_HDP(combining documents’domain properties,word semantics and words’presences in topics with HDP)主题模型.由于PSP_HDP主题模型改进了文档-主题与主题-词语的分配过程,从而提高了经济主题的区分度和辨识度,可以更有效地挖掘与经济有关的经济主题和经济要素词.实验结果表明:提出的PSP_HDP主题模型不仅在主题多样性、内容困惑度和模型复杂度等评价指标方面的整体性能优于HDP主题模型,而且在非结构化经济指标挖掘和经济要素词抽取方面能够得到区分度更好、辨识度更高的结果.展开更多
[目的/意义]科研资助是科学研究工作中有效的激励政策,分析与揭示科研资助影响作用,对促进国家科技发展具有重要的积极作用。[方法/过程]基于Web of Science收录的我国计算机与人工智能领域的科研论文,按照有/无科研资助对其进行划分,...[目的/意义]科研资助是科学研究工作中有效的激励政策,分析与揭示科研资助影响作用,对促进国家科技发展具有重要的积极作用。[方法/过程]基于Web of Science收录的我国计算机与人工智能领域的科研论文,按照有/无科研资助对其进行划分,使用结构主题模型(STM)重点将科研资助对主题内容与主题契合度的影响进行分析。[结果/结论]研究发现,科研资助能够有效促进科技成果数量的增加,科研资助能够影响主题偏好和具体主题内容,科研资助与时间的交互作用会对主题的契合度产生积极的影响。展开更多
文摘随着经济活动数据的不断丰富,互联网平台上产生了大量的财经文本,其中蕴含了经济领域发展状况的影响因素.如何从这些财经文本中有效地挖掘与经济有关的经济要素,是实现非结构化数据在经济研究中应用的关键.根据人工构建非结构化经济指标的局限性,以及主题模型在非结构化经济指标挖掘中存在的问题,结合已有经济领域分类标准、词语之间的语义关系和词语对主题的代表性,定义了文档的领域隶属度、词语与主题的语义相关度和词语对主题的贡献度,用于分别描述CRF(Chinese restaurant franchise)中餐厅的菜肴风格、顾客之间对菜肴要求的一致程度和顾客对菜肴的专一程度;结合文档领域属性、词语语义和词语在主题中的出现情况,提出了PSP_HDP(combining documents’domain properties,word semantics and words’presences in topics with HDP)主题模型.由于PSP_HDP主题模型改进了文档-主题与主题-词语的分配过程,从而提高了经济主题的区分度和辨识度,可以更有效地挖掘与经济有关的经济主题和经济要素词.实验结果表明:提出的PSP_HDP主题模型不仅在主题多样性、内容困惑度和模型复杂度等评价指标方面的整体性能优于HDP主题模型,而且在非结构化经济指标挖掘和经济要素词抽取方面能够得到区分度更好、辨识度更高的结果.
文摘[目的/意义]科研资助是科学研究工作中有效的激励政策,分析与揭示科研资助影响作用,对促进国家科技发展具有重要的积极作用。[方法/过程]基于Web of Science收录的我国计算机与人工智能领域的科研论文,按照有/无科研资助对其进行划分,使用结构主题模型(STM)重点将科研资助对主题内容与主题契合度的影响进行分析。[结果/结论]研究发现,科研资助能够有效促进科技成果数量的增加,科研资助能够影响主题偏好和具体主题内容,科研资助与时间的交互作用会对主题的契合度产生积极的影响。