期刊文献+
共找到5篇文章
< 1 >
每页显示 20 50 100
中文搜索引擎现状与展望 被引量:25
1
作者 都云程 卢献华 《中文信息学报》 CSCD 北大核心 1999年第3期61-64,F003,共5页
本文介绍了中文搜索引擎的发展现状,分析了中文搜索引擎中存在的问题,以及与国外先进的搜索引擎的差距,提出了中文搜索引擎的发展方向。
关键词 中文搜索引擎 全文检索 中文自动分词 搜索引擎
下载PDF
基于专利搜索日志的同义词挖掘 被引量:1
2
作者 王颖 都云程 +1 位作者 卢献华 吕学强 《计算机工程与设计》 CSCD 北大核心 2013年第3期1029-1033,共5页
针对专利搜索日志中同义词出现的特点,改进了词共现相似度算法,提出了一种基于专利搜索日志的同义词挖掘方法。利用专利搜索日志中同义词出现的规律挖掘同义词集的结构模板,根据这些模板抽取出候选同义词集,利用改进的词共现方法计算词... 针对专利搜索日志中同义词出现的特点,改进了词共现相似度算法,提出了一种基于专利搜索日志的同义词挖掘方法。利用专利搜索日志中同义词出现的规律挖掘同义词集的结构模板,根据这些模板抽取出候选同义词集,利用改进的词共现方法计算词汇相似度。对称共现的词对正确率达到85.66%,召回率达到78.98%,F值0.82。该方法可用于专利搜索引擎中提高专利检索的效率。 展开更多
关键词 专利搜索日志 同义词挖掘 结构模板 候选同义词集 词共现相似度
下载PDF
产教融合双引擎驱动软件专业人才培养 被引量:4
3
作者 卢献华 侯霞 《计算机教育》 2019年第6期25-29,共5页
针对目前软件专业学生实践能力不足的问题,分析产教融合发展的意义和必要性,介绍产教融合在软件专业人才培养中的探索和实践,最后说明取得的实际效果。
关键词 产教融合 创新思维 软件人才培养
下载PDF
基于大数据计算框架的分布式新闻聚类系统设计 被引量:9
4
作者 卢献华 王洪俊 《计算机科学》 CSCD 北大核心 2019年第S11期220-223,共4页
对海量的互联网新闻进行快速热点聚类是一个重要的研究方向。针对大规模文本聚类的几个关键问题(相似度计算、分布式聚类、聚类结果概要生成),文中设计并实现了一个基于Spark计算框架的分布式新闻聚类系统。该系统采用GPU加速的深度相... 对海量的互联网新闻进行快速热点聚类是一个重要的研究方向。针对大规模文本聚类的几个关键问题(相似度计算、分布式聚类、聚类结果概要生成),文中设计并实现了一个基于Spark计算框架的分布式新闻聚类系统。该系统采用GPU加速的深度相似度算法进行新闻文本的相似度计算,得到新闻之间的相似关系,并采用图聚类算法进行新闻聚类,最后采用标题压缩技术形成热点描述,生成最终的聚类结果。实验结果证明,文中提出的系统具有较高的执行效率和良好的可扩展性,可以有效地处理大规模新闻的热点聚类任务。 展开更多
关键词 分布式图聚类 深度相似度计算 GPU加速 标题压缩 大数据
下载PDF
全文检索为WWW增添生机 被引量:3
5
作者 卢献华 《中文信息学报》 CSCD 北大核心 1998年第3期64-64,F003,63,共3页
Internet正以200%的用户增长率迅速发展,成为人们在工作和生活中不可缺少的工具。人们可以通过Internet收发邮件,查找信息,订购产品。WWW(WorldWideWed全球信息网)是Internet的一个重... Internet正以200%的用户增长率迅速发展,成为人们在工作和生活中不可缺少的工具。人们可以通过Internet收发邮件,查找信息,订购产品。WWW(WorldWideWed全球信息网)是Internet的一个重要组织部分,是近年来在Intern... 展开更多
关键词 全文检索 WWW网 检索工具 信息检索
全文增补中
上一页 1 下一页 到第
使用帮助 返回顶部