Current position: Home >> Scientific Research >> Paper Publications

基于TF/IDF多因素改进算法的知识单元抽取研究

Release Time:2019-03-10  Hits:

Indexed by: Journal Article

Date of Publication: 2011-01-01

Journal: 情报学报

Included Journals: CSSCI、ISTIC、PKU

Volume: 10

Issue: 10

Page Number: 1037-1043

ISSN: 1000-0135

Key Words: 知识计量;知识单元;知识单元抽取;TF/IDF

Abstract: 深入分析知识研究的基本知识单元,对知识单元的概念、特性、载体及抽取过程做详细阐述,提出知识计量研究中的知识单元的定义与特性,对知识单元的独立性、组合性、链接性、多维性、外显性、可测性进行详细说明.根据知识单元特性以及中文文献特点,提出一种基于词长和位置考虑的TF/IDF多因素改进算法,以<半导体光电>期刊1999~2006年数据为实例,对比分析了传统TF/IDF特征词抽取方法与改进后特征词抽取算法,分析结果表明,基于词长和位置的TF/IDF多因素改进算法显著提高了知识单元抽取效率和准确性.

Prev One:基于共被引理论的在线音乐网站歌手分类研究

Next One:期刊作者群的新陈代谢规律研究