-
题名中文搜索引擎现状与展望
被引量:25
- 1
-
-
作者
都云程
卢献华
-
机构
北京信息工程学院中文信息研究处理中心
-
出处
《中文信息学报》
CSCD
北大核心
1999年第3期61-64,F003,共5页
-
文摘
本文介绍了中文搜索引擎的发展现状,分析了中文搜索引擎中存在的问题,以及与国外先进的搜索引擎的差距,提出了中文搜索引擎的发展方向。
-
关键词
中文搜索引擎
全文检索
中文自动分词
搜索引擎
-
Keywords
Chinese search engineFull-text retrievalAutomatic words segmentationrelevance Ranking
-
分类号
TP391
[自动化与计算机技术—计算机应用技术]
G354.4
[文化科学—情报学]
-
-
题名基于专利搜索日志的同义词挖掘
被引量:1
- 2
-
-
作者
王颖
都云程
卢献华
吕学强
-
机构
北京信息科技大学中文信息处理研究中心
-
出处
《计算机工程与设计》
CSCD
北大核心
2013年第3期1029-1033,共5页
-
基金
国家自然科学基金项目(61171159)
北京市科学技术研究院科技创新工程基金项目(PXM2012_178215_000004)
+2 种基金
北京市教委科技发展计划基金项目(KM201211232023)
国家科技支撑计划课题基金项目(2011BAH11B03)
核高基基金项目(2010ZX01042-002-002)
-
文摘
针对专利搜索日志中同义词出现的特点,改进了词共现相似度算法,提出了一种基于专利搜索日志的同义词挖掘方法。利用专利搜索日志中同义词出现的规律挖掘同义词集的结构模板,根据这些模板抽取出候选同义词集,利用改进的词共现方法计算词汇相似度。对称共现的词对正确率达到85.66%,召回率达到78.98%,F值0.82。该方法可用于专利搜索引擎中提高专利检索的效率。
-
关键词
专利搜索日志
同义词挖掘
结构模板
候选同义词集
词共现相似度
-
Keywords
patent search log synonyms mining
structure templates
candidate synonyms sets
word co-occurrence similarity
-
分类号
TP391.1
[自动化与计算机技术—计算机应用技术]
-
-
题名产教融合双引擎驱动软件专业人才培养
被引量:4
- 3
-
-
作者
卢献华
侯霞
-
机构
北京信息科技大学计算机学院
-
出处
《计算机教育》
2019年第6期25-29,共5页
-
基金
北京信息科技大学2018年教育教学改革项目(2018JGYB15)
教育部高教司协同育人项目(201702104068)
北京信息科技大学教育教学改革研究专项招标课题(2017JGZB01)
-
文摘
针对目前软件专业学生实践能力不足的问题,分析产教融合发展的意义和必要性,介绍产教融合在软件专业人才培养中的探索和实践,最后说明取得的实际效果。
-
关键词
产教融合
创新思维
软件人才培养
-
分类号
G642
[文化科学—高等教育学]
-
-
题名基于大数据计算框架的分布式新闻聚类系统设计
被引量:9
- 4
-
-
作者
卢献华
王洪俊
-
机构
北京信息科技大学
北京拓尔思信息技术股份有限公司
-
出处
《计算机科学》
CSCD
北大核心
2019年第S11期220-223,共4页
-
文摘
对海量的互联网新闻进行快速热点聚类是一个重要的研究方向。针对大规模文本聚类的几个关键问题(相似度计算、分布式聚类、聚类结果概要生成),文中设计并实现了一个基于Spark计算框架的分布式新闻聚类系统。该系统采用GPU加速的深度相似度算法进行新闻文本的相似度计算,得到新闻之间的相似关系,并采用图聚类算法进行新闻聚类,最后采用标题压缩技术形成热点描述,生成最终的聚类结果。实验结果证明,文中提出的系统具有较高的执行效率和良好的可扩展性,可以有效地处理大规模新闻的热点聚类任务。
-
关键词
分布式图聚类
深度相似度计算
GPU加速
标题压缩
大数据
-
Keywords
Distributed graph clustering
Depth similarity calculation
GPU acceleration
Title compression
Big data
-
分类号
TP3
[自动化与计算机技术—计算机科学与技术]
-
-
题名全文检索为WWW增添生机
被引量:3
- 5
-
-
作者
卢献华
-
机构
易宝北信信息技术有限公司
-
出处
《中文信息学报》
CSCD
北大核心
1998年第3期64-64,F003,63,共3页
-
文摘
Internet正以200%的用户增长率迅速发展,成为人们在工作和生活中不可缺少的工具。人们可以通过Internet收发邮件,查找信息,订购产品。WWW(WorldWideWed全球信息网)是Internet的一个重要组织部分,是近年来在Intern...
-
关键词
全文检索
WWW网
检索工具
信息检索
-
分类号
TP393.4
[自动化与计算机技术—计算机应用技术]
G354.4
[文化科学—情报学]
-