期刊导航
期刊开放获取
河南省图书馆
退出
期刊文献
+
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
检索
高级检索
期刊导航
共找到
3
篇文章
<
1
>
每页显示
20
50
100
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
显示方式:
文摘
详细
列表
相关度排序
被引量排序
时效性排序
基于词向量的藏文语义相似词知识库构建
被引量:
4
1
作者
龙从军
周毛克
刘汇丹
《中文信息学报》
CSCD
北大核心
2020年第10期33-38,50,共7页
词向量在自然语言处理研究的各个领域发挥着重要作用。该文从语言学角度出发,讨论了词向量技术与语言学理论的关系;根据词向量的特征,提出利用藏文词向量构建语义相似词知识库。该文以哈尔滨工业大学的《词林》为基础,通过汉藏双语词典...
词向量在自然语言处理研究的各个领域发挥着重要作用。该文从语言学角度出发,讨论了词向量技术与语言学理论的关系;根据词向量的特征,提出利用藏文词向量构建语义相似词知识库。该文以哈尔滨工业大学的《词林》为基础,通过汉藏双语词典对译,在获取对译词的词向量的基础上,计算对译词的词向量与原子词群平均词向量的差值,利用不同的差值,自动筛选出与原子词群语义相似度较小的词。该文分别以藏文的词和音节为单位计算词向量,自动筛出不属于原子词群的词,通过对自动筛选结果与人工筛选结果对比,发现两者具有较高的一致性,这说明词向量计算结果与人的语言直觉具有较高的一致性。总体来说,该文所采用的方法有助于提高藏文语义相似词知识库构建效率。
展开更多
关键词
词
向量
藏文
语义相似词
下载PDF
职称材料
一种结合词项语义信息和TF-IDF方法的文本相似度量方法
被引量:
222
2
作者
黄承慧
印鉴
侯昉
《计算机学报》
EI
CSCD
北大核心
2011年第5期856-864,共9页
传统的文本相似度量方法大多采用TF-IDF方法把文本建模为词频向量,利用余弦相似度量等方法计算文本之间的相似度.这些方法忽略了文本中词项的语义信息.改进的基于语义的文本相似度量方法在传统词频向量中扩充了语义相似的词项,进一步增...
传统的文本相似度量方法大多采用TF-IDF方法把文本建模为词频向量,利用余弦相似度量等方法计算文本之间的相似度.这些方法忽略了文本中词项的语义信息.改进的基于语义的文本相似度量方法在传统词频向量中扩充了语义相似的词项,进一步增加了文本表示向量的维度,但不能很好地反映两篇文本之间的相似程度.文中在TF-IDF模型基础上分析文本中重要词汇的语义信息,提出了一种新的文本相似度量方法.该方法首先应用自然语言处理技术对文本进行预处理,然后利用TF-IDF方法寻找文本中具有较高TF-IDF值的重要词项.借助外部词典分析词项之间的语义相似度,结合该文提出的词项相似度加权树以及文本语义相似度定义计算两篇文本之间的相似度.最后利用文本相似度在基准文本数据集合上进行聚类实验.实验结果表明文中提出的方法在基于F-度量值标准上优于TF-IDF以及另一种基于词项语义相似性的方法.
展开更多
关键词
文本聚类
词
项
语义
相似
度
文本
相似
度
自然语言处理
下载PDF
职称材料
供需匹配视角下基于语义相似聚类的技术需求识别模型
被引量:
16
3
作者
何喜军
张婷婷
+1 位作者
武玉英
蒋国瑞
《系统工程理论与实践》
EI
CSSCI
CSCD
北大核心
2019年第2期476-485,共10页
在技术供需文本匹配视角下,提出了一种基于语义相似聚类的技术需求识别模型.首先,采集网络中技术需求文本提取关键短语;然后,建立领域专利技术转让索引库,基于需求关键短语检索出高相关专利,构建专利技术供给背景库,并对背景库中专利标...
在技术供需文本匹配视角下,提出了一种基于语义相似聚类的技术需求识别模型.首先,采集网络中技术需求文本提取关键短语;然后,建立领域专利技术转让索引库,基于需求关键短语检索出高相关专利,构建专利技术供给背景库,并对背景库中专利标题与摘要进行分词;第三,提出基于词向量的供需文本语义匹配度算法,筛选有效技术需求并进行语义相似聚类;最后,考虑技术需求对应的需求量和专利技术转让量,对聚类结果进行二维分类.以新能源领域为例进行实证,识别出有效技术需求195个,基于语义相似聚成12类,结合需求量与专利转让量,将12类技术需求分为"高需求、高转让"、"高需求、低转让"、"低需求、高转让"、"低需求、低转让"四大类.该研究为网络技术需求挖掘及供需匹配提供一种新思路.
展开更多
关键词
技术供需匹配度
技术需求识别
词
向量
语义
相似
度
原文传递
题名
基于词向量的藏文语义相似词知识库构建
被引量:
4
1
作者
龙从军
周毛克
刘汇丹
机构
中国社会科学院民族学与人类学研究所
中国社会科学院大学(研究生院)
中国科学院软件研究所
出处
《中文信息学报》
CSCD
北大核心
2020年第10期33-38,50,共7页
基金
中国社会科学院创新工程项目(2019MZSCX005)
喜马拉雅区域协同创新中心项目(ZFYJY201901009)。
文摘
词向量在自然语言处理研究的各个领域发挥着重要作用。该文从语言学角度出发,讨论了词向量技术与语言学理论的关系;根据词向量的特征,提出利用藏文词向量构建语义相似词知识库。该文以哈尔滨工业大学的《词林》为基础,通过汉藏双语词典对译,在获取对译词的词向量的基础上,计算对译词的词向量与原子词群平均词向量的差值,利用不同的差值,自动筛选出与原子词群语义相似度较小的词。该文分别以藏文的词和音节为单位计算词向量,自动筛出不属于原子词群的词,通过对自动筛选结果与人工筛选结果对比,发现两者具有较高的一致性,这说明词向量计算结果与人的语言直觉具有较高的一致性。总体来说,该文所采用的方法有助于提高藏文语义相似词知识库构建效率。
关键词
词
向量
藏文
语义相似词
Keywords
word vector
Tibetan
semantic similar word
分类号
TP391 [自动化与计算机技术—计算机应用技术]
下载PDF
职称材料
题名
一种结合词项语义信息和TF-IDF方法的文本相似度量方法
被引量:
222
2
作者
黄承慧
印鉴
侯昉
机构
中山大学信息科学与技术学院
广东金融学院计算机科学与技术系
出处
《计算机学报》
EI
CSCD
北大核心
2011年第5期856-864,共9页
基金
国家自然科学基金(61033010)
国家科技重大专项基金(2008ZX10005-013)
+2 种基金
广东省科技计划项目(2009A080207005
2009B090300450
2010A040303004)资助~~
文摘
传统的文本相似度量方法大多采用TF-IDF方法把文本建模为词频向量,利用余弦相似度量等方法计算文本之间的相似度.这些方法忽略了文本中词项的语义信息.改进的基于语义的文本相似度量方法在传统词频向量中扩充了语义相似的词项,进一步增加了文本表示向量的维度,但不能很好地反映两篇文本之间的相似程度.文中在TF-IDF模型基础上分析文本中重要词汇的语义信息,提出了一种新的文本相似度量方法.该方法首先应用自然语言处理技术对文本进行预处理,然后利用TF-IDF方法寻找文本中具有较高TF-IDF值的重要词项.借助外部词典分析词项之间的语义相似度,结合该文提出的词项相似度加权树以及文本语义相似度定义计算两篇文本之间的相似度.最后利用文本相似度在基准文本数据集合上进行聚类实验.实验结果表明文中提出的方法在基于F-度量值标准上优于TF-IDF以及另一种基于词项语义相似性的方法.
关键词
文本聚类
词
项
语义
相似
度
文本
相似
度
自然语言处理
Keywords
text clustering
term semantic similarity
text similarity
natural language process
分类号
TP311 [自动化与计算机技术—计算机软件与理论]
下载PDF
职称材料
题名
供需匹配视角下基于语义相似聚类的技术需求识别模型
被引量:
16
3
作者
何喜军
张婷婷
武玉英
蒋国瑞
机构
北京工业大学经济与管理学院
出处
《系统工程理论与实践》
EI
CSSCI
CSCD
北大核心
2019年第2期476-485,共10页
基金
北京市自然科学基金(9172002)~~
文摘
在技术供需文本匹配视角下,提出了一种基于语义相似聚类的技术需求识别模型.首先,采集网络中技术需求文本提取关键短语;然后,建立领域专利技术转让索引库,基于需求关键短语检索出高相关专利,构建专利技术供给背景库,并对背景库中专利标题与摘要进行分词;第三,提出基于词向量的供需文本语义匹配度算法,筛选有效技术需求并进行语义相似聚类;最后,考虑技术需求对应的需求量和专利技术转让量,对聚类结果进行二维分类.以新能源领域为例进行实证,识别出有效技术需求195个,基于语义相似聚成12类,结合需求量与专利转让量,将12类技术需求分为"高需求、高转让"、"高需求、低转让"、"低需求、高转让"、"低需求、低转让"四大类.该研究为网络技术需求挖掘及供需匹配提供一种新思路.
关键词
技术供需匹配度
技术需求识别
词
向量
语义
相似
度
Keywords
technology supply and demand matching degree
technical demand recognition
word vector semantics similarity
分类号
TP391.1 [自动化与计算机技术—计算机应用技术]
原文传递
题名
作者
出处
发文年
被引量
操作
1
基于词向量的藏文语义相似词知识库构建
龙从军
周毛克
刘汇丹
《中文信息学报》
CSCD
北大核心
2020
4
下载PDF
职称材料
2
一种结合词项语义信息和TF-IDF方法的文本相似度量方法
黄承慧
印鉴
侯昉
《计算机学报》
EI
CSCD
北大核心
2011
222
下载PDF
职称材料
3
供需匹配视角下基于语义相似聚类的技术需求识别模型
何喜军
张婷婷
武玉英
蒋国瑞
《系统工程理论与实践》
EI
CSSCI
CSCD
北大核心
2019
16
原文传递
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
上一页
1
下一页
到第
页
确定
用户登录
登录
IP登录
使用帮助
返回顶部