位置:成果数据库 > 期刊 > 期刊详情页
基于凸组合核函数的中文领域实体关系抽取
  • ISSN号:1003-0077
  • 期刊名称:中文信息学报
  • 时间:2013.9.15
  • 页码:144-148+155
  • 分类:TP391[自动化与计算机技术—计算机应用技术;自动化与计算机技术—计算机科学与技术]
  • 作者机构:[1]昆明理工大学信息工程与自动化学院,昆明650051
  • 相关基金:国家自然科学基金(60863011;61175068)
  • 相关项目:专家检索资源获取与学习排序方法研究
中文摘要:

提出了一种结合加权特征向量空间模型和径向基概率神经网络(RBPNN)的文本分类方法.该方法针对传统的文本特征提取方法的不足,根据文本中特征项的位置信息和所属类别信息定义特征权重,然后,依据特征项的权值计算文档特征项的频数,通过TFIDF函数计算特征值并得到文本的特征向量,最后,采用RBPNN网络分类,通过最小二乘算法求解神经网络的第二隐层和输出层之间的权值,最终训练获得文本分类模型.文本分类实验结果表明,该方法在文本分类中表现出较好的效果,具有较好查全率和查准率.

英文摘要:

In this paper, a text classification method combined weighted feature vector space model and the RBPNN are presented. According to the insufficient of traditional text feature extraction method. In the method, the weigthing about text feature is given by the text feature location information and category information, and then the feature frequency is obtained. The characteristic value is calculated using the TFIDF function after that, and the characteristic vector of text is formed. Then the weights between the second network hidden layer and output layer are decided by the least squcre algorithm, so the classification model is built. The experimental results showed that, the good recall and precision are obtained. The performance of text classification method proposed is well.

同期刊论文项目
同项目期刊论文
期刊信息
  • 《中文信息学报》
  • 北大核心期刊(2011版)
  • 主管单位:中国科学技术协会
  • 主办单位:中国中文信息学会 中国科学院软件研究所
  • 主编:孙茂松
  • 地址:北京海淀中关村南四街4号中科院软件所
  • 邮编:100190
  • 邮箱:jcip@iscas.ac.cn
  • 电话:010-62562916
  • 国际标准刊号:ISSN:1003-0077
  • 国内统一刊号:ISSN:11-2325/N
  • 邮发代号:
  • 获奖情况:
  • 国内外数据库收录:
  • 日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2008版),中国北大核心期刊(2011版),中国北大核心期刊(2014版),中国北大核心期刊(2000版)
  • 被引量:9136