期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
中文分词中的正向增字最大匹配算法研究 被引量:7
1
作者 戴上静 石春 吴刚 《微型机与应用》 2014年第17期15-18,共4页
针对正向最大匹配算法的长词丢失、匹配次数较多、歧义字段处理的准确率较低等问题,基于Trie树词典提出了3种正向增字最大匹配算法,分别使用逐词扫描、尾部折半扫描和尾部减一扫描这3种扫描方式采集歧义字段,并建立了一套歧义处理方法... 针对正向最大匹配算法的长词丢失、匹配次数较多、歧义字段处理的准确率较低等问题,基于Trie树词典提出了3种正向增字最大匹配算法,分别使用逐词扫描、尾部折半扫描和尾部减一扫描这3种扫描方式采集歧义字段,并建立了一套歧义处理方法。实验结果表明,该3种算法在分词速度和准确率上均有显著提高,错误率降低到了原算法的三分之一以下。当文本规模大于200 MB时,3种正向增字最大匹配算法的分词速度均比原最大匹配算法提高30%以上。 展开更多
关键词 中文分词 TRIE树 逐词扫描 正向增字匹配
下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部