首页 | 本学科首页   官方微博 | 高级检索  
     检索      

汉语分词对中文搜索引擎检索性能的影响
引用本文:金澎,刘毅,王树梅.汉语分词对中文搜索引擎检索性能的影响[J].情报学报,2006,25(1):21-24.
作者姓名:金澎  刘毅  王树梅
作者单位:1. 乐山师范学院计算机科学系,四川,乐山,614004
2. 南京理工大学计算机科学与技术系,南京,210014
摘    要:针对中文网页的特点,研究了汉语分词对中文搜索引擎检索性能的影响。首先介绍中文分词在搜索引擎中的作用,然后介绍常用的分词算法。作者利用网页特征,提出一个简单的“带启发性规则的双向匹配分词策略”。最后,在10G的语料库中,就各种分词算法对查全率和查准率的影响进行了实验比较,结果表明分词性能和检索性能没有正比关系。

关 键 词:汉语分词  信息检索  中文搜索引擎
修稿时间:2005年4月12日

Influence of Chinese Word Segmentation on Web Information Retrieval
Jin Peng,Liu Yi,Wang Shumei.Influence of Chinese Word Segmentation on Web Information Retrieval[J].Journal of the China Society for Scientific andTechnical Information,2006,25(1):21-24.
Authors:Jin Peng  Liu Yi  Wang Shumei
Abstract:In this paper,we focus on the influence of Chinese word segmentation on Web information retrieval.We conduct some experiments by indexing the Chinese Web pages to search the relevant pages.Both Chinese words and character are index unit.The results of experiments present that there is a non-monotonic relationship between Chinese word segmentation and retrieval performance.
Keywords:Chinese word segmentation  information retrieval  Chinese search engine    
本文献已被 CNKI 万方数据 等数据库收录!
设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号