期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
一种基于生语料的领域词典生成方法 被引量:11
1
作者 孙霞 郑庆华 +1 位作者 王朝静 张素娟 《小型微型计算机系统》 CSCD 北大核心 2005年第6期1088-1092,共5页
为了实现准确分词,实用的汉语信息处理系统都需有其专用的领域词典.针对现有词典构造方法存在的不足,本文提出了一种领域词典的构造方法:利用通用词典对领域生语料进行分词处理,并提出了基于切分单元的最大匹配算法,从而得到候选词串集... 为了实现准确分词,实用的汉语信息处理系统都需有其专用的领域词典.针对现有词典构造方法存在的不足,本文提出了一种领域词典的构造方法:利用通用词典对领域生语料进行分词处理,并提出了基于切分单元的最大匹配算法,从而得到候选词串集,然后利用规则对其进行优化,最终生成领域词典.词典的生成过程基本上是自动完成的,人工干预少,易于更新;目前,本方法生成的领域词典已经应用于我们自主开发的"基于Web的智能答疑系统"中,并取得了较好的效果. 展开更多
关键词 领域词典 通用词典 词频统计 最大匹配
下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部