期刊文献+

基于领域本体的网络财务报告文本信息抽取研究 被引量:1

A Research on Text Information Extraction from Annual Report Based on Domain Ontology
下载PDF
导出
摘要 企业财务报告中存在大量蕴含着许多重要财务信息的非结构化文本信息.这类信息难以被计算机识别、分析和处理,也难以通过数据库技术进行管理.本文结合本体相关理论和自然语言处理(Natural Language Processing,NLP)技术,从词语属性描述、词语关系组织和相关知识链接3个维度构建财务报告领域本体,利用NLP工具对中文财务报告中的文本信息进行处理,将非结构化文本信息转化为结构化信息并使用XBRL表示,在一定程度上实现了文本信息的数据库存储与计算机分析处理. Significant financial information can be retrieved from the vast amount of textual data provided in Chinese business accounting reports(annual reports).Nevertheless,due to the unstructured nature,this textual information usually is difficult to be obtained and analyzed via traditional computer and database techniques.To address this issue,a set of unified domain-specific ontology is presented,combined with Chinese Natural language processing(NLP),which transforms accounting reports in unstructured text into a structured XBRL-based form via three different dimensions,namely word attribute description,word relation organization,and related knowledge links respectively.
作者 梁倬骞 王东 朱慧 潘定 Liang Zhuo-qian;Wang Dong;Zhu Hui;Pan Ding(School of Management, Jinan University, Guangzhou 510632, China;School of Business Administration, Guangzhou 510006, China;School of Information, Jinan University, Guangzhou 510632, China)
出处 《广东工业大学学报》 CAS 2017年第3期89-95,共7页 Journal of Guangdong University of Technology
基金 国家自然科学基金资助项目(71171097 71671048) 中央高校基本科研业务费专项资金资助项目(15JNLH005) 广东省自然科学基金资助项目(2015A030310506)
关键词 可扩展商业报告语言 领域本体 财务报告 extensible business reporting language(XBRL) domain ontology financial report
  • 相关文献

参考文献5

二级参考文献34

共引文献34

同被引文献4

引证文献1

相关作者

内容加载中请稍等...

相关机构

内容加载中请稍等...

相关主题

内容加载中请稍等...

浏览历史

内容加载中请稍等...
;
使用帮助 返回顶部