作者:张宇萌 刘传汉频繁字串中文抽词逐层扫描互信息
摘要:串频统计是一种简便有效的抽取未登录词方法。本文提出了一种快速的频繁字串提取和计频方法,通过逐层扫描快速发现频繁字串,修正字串有效出现频次,最后抽取平均互信息量达到阈值的字串。实验结果显示该方法有效可行。
注:因版权方要求,不能公开全文,如需全文,请咨询杂志社
《计算机科学》(CN:50-1075/TP)是一本有较高学术价值的大型月刊,自创刊以来,选题新奇而不失报道广度,服务大众而不失理论高度。颇受业界和广大读者的关注和好评。 《计算机科学》报导国内外计算机科学与技术的发展动态,以其新颖、准确、及时为特色,突出动态性、综述性、学术性,“前沿学科”与“基础研究”相结合;“优秀技术”与“支撑技术”相结合;“倡导”与“争鸣”相结合。
省级期刊
人气 753864 评论 72
人气 484603 评论 71
人气 464618 评论 66
部级期刊
人气 442093 评论 69