期刊文献+

汉语分词对中文搜索引擎检索性能的影响 被引量:6

Influence of Chinese Word Segmentation on Web Information Retrieval
下载PDF
导出
摘要 针对中文网页的特点。研究了汉语分词对中文搜索引擎检索性能的影响。首先介绍中文分词在搜索引擎中的作用,然后介绍常用的分词算法。作者利用啊页特征,提出一个简单的“带启发性规则的双向匹配分词策略”。最后,在10G的语料库中,就各种分词算法对查全率和查准率的影响进行了实验比较,结果表明分词性能和检索性能没有正比关系。 In this paper, we focus on the influence of Chinese word segmentation on Web information retrieval. We conduct some experiments by indexing the Chinese Web pages to search the relevant pages. Both Chinese words and character are index unit. The results of experiments present that there is a non-monotonic relationship between Chinese word segmentation and retrieval performance.
出处 《情报学报》 CSSCI 北大核心 2006年第1期21-24,共4页 Journal of the China Society for Scientific and Technical Information
基金 四川省教育厅青年基金资助项目(项目编号:2003B035).
关键词 汉语分词 信息检索 中文搜索引擎 Chinese word segmentation, information retrieval, Chinese search engine.
  • 相关文献

参考文献5

  • 1Foo,S.,Li H.Chinese word segmentation and its effect on information retrieval.Information Processing and Management,2004,40(1):161 ~ 191
  • 2Fuchun Peng,Xiangji Huang,Dale Schuurmans,Nick Cercone.Investigating the Relationship between Word Segmentation Performance and Retrieval Performance in Chinese IR.COLLING 2002.72 ~ 78
  • 3Palmer D.,Burger J.Chinese Word Segmentation and Information Retrieval.In:AAAI Symp.Cross-Language Text and Speech Retrieval,1997.53 ~ 57
  • 4Liu,Y.The rules of modern Chinese segmentation for the purpose of information processing and approaches of automatic Chinese segmentation (in Chinese).Beijing:Tsinghua University Press,1994.1
  • 5Ricardo Baeza-Yates and Berthier Ribeiro-Neto.Modern Information Retrieval.ACM Press,1999

同被引文献87

引证文献6

二级引证文献66

相关作者

内容加载中请稍等...

相关机构

内容加载中请稍等...

相关主题

内容加载中请稍等...

浏览历史

内容加载中请稍等...
;
使用帮助 返回顶部