HI,欢迎来到学术之家,发表咨询:400-888-7501  订阅咨询:400-888-7502  股权代码  102064
0

基于改进C—value方法的中文术语抽取

作者:胡阿沛; 张静; 刘俊丽术语抽取串频统计语言规则术语度

摘要:提出一种改进C—value的术语抽取方法,即IC—value方法。利用停用词对文本进行预处理后,采用一种基于串频统计的抽取算法提取候选术语;对候选术语进行语言规则过滤;从逆文档频率、破碎子串和术语长度三个方面改进C—value方法得到IC—value方法,并用来计算候选术语的术语度。以1000篇乙型肝炎相关论文摘要进行实证研究,结果证明IC—value方法在准确率和召回率方面都要优于C—value、TF—IDF和V—value,有较强的长术语发现能力,且识别破碎子串的效果十分明显。

注:因版权方要求,不能公开全文,如需全文,请咨询杂志社

数据分析与知识发现

《数据分析与知识发现》(CN:10-1478/G2)是一本有较高学术价值的大型月刊,自创刊以来,选题新奇而不失报道广度,服务大众而不失理论高度。颇受业界和广大读者的关注和好评。 《数据分析与知识发现》内容定位于广泛吸纳计算机科学、数据科学、情报科学以及数字科研、数字教育和数字文化等领域的技术与方法,研究数据驱动的语义计算、内容分析、数据挖掘、知识发现、智能管理和决策支持等方面的技术、方法、系统以及支撑设施、政策与机制等,尤其是聚焦从海量、异构、分布、动态、甚至富媒体数据中挖掘和发现知识以支持研究、管理和决...

杂志详情