作者:孙霞; 郑庆华; 王朝静; 张素娟领域词典通用词典词频统计最大匹配
摘要:为了实现准确分词,实用的汉语信息处理系统都需有其专用的领域词典.针对现有词典构造方法存在的不足,本文提出了一种领域词典的构造方法:利用通用词典对领域生语料进行分词处理,并提出了基于切分单元的最大匹配算法,从而得到候选词串集,然后利用规则对其进行优化,最终生成领域词典.词典的生成过程基本上是自动完成的,人工干预少,易于更新;目前,本方法生成的领域词典已经应用于我们自主开发的'基于Web的智能答疑系统'中,并取得了较好的效果.
注:因版权方要求,不能公开全文,如需全文,请咨询杂志社