HI,欢迎来到学术之家,发表咨询:400-888-7501  订阅咨询:400-888-7502  股权代码  102064
0

基于主题与语义的对话语料关键词抽取方法

作者:胡迁; 黄青松; 刘利军; 李帅彬; 冯旭鹏对话语料关键词抽取语义信息主题信息

摘要:对话信息反映对话者的兴趣,为快速了解对话主题或内容,抽取对话中关键词非常有意义。传统的对话语料关键词抽取方法多基于词频或者共现关系,却忽略语义和主题,因此提出一种基于语义和主题自动关键词抽取方法。结合中文语料训练得到词向量和主题模型;计算词的语义权重,包括词与全文语义相似度权重,词语义聚类权重,词性权重。根据词的语义权重得到Top-N词作为关键词;将TFIDF方法和语义权重方法抽取的关键词作为节点,基于节点间语义相似度建图,通过图迭代得到最终的关键词。该方法有效地解决传统算法忽略语义和主题的问题,同时兼顾词语频率。实验结果表明,该方法优于传统的TFIDF和TextRank方法。

注:因版权方要求,不能公开全文,如需全文,请咨询杂志社

计算机应用与软件

《计算机应用与软件》(CN:31-1260/TP)是一本有较高学术价值的大型月刊,自创刊以来,选题新奇而不失报道广度,服务大众而不失理论高度。颇受业界和广大读者的关注和好评。 《计算机应用与软件》主要面向从事计算机应用和软件技术开发的科研人员、工程技术人员、各大专院校师生等。致力于创办以创新、准确、实用为特色,突出综述性、科学性、实用性,及时报道国内外计算机技术在科研、教学、应用方面的研究成果和发展动态的综合性技术期刊,为国内计算机同行提供学术交流的平台。

杂志详情