位置:成果数据库 > 期刊 > 期刊详情页
应用特征项分布信息的信息增益改进方法研究
  • 期刊名称:山东大学学报(理学版),
  • 时间:0
  • 页码:48-51
  • 语言:中文
  • 分类:TP301[自动化与计算机技术—计算机系统结构;自动化与计算机技术—计算机科学与技术]
  • 作者机构:[1]山东师范大学信息科学与工程学院,山东济南250014
  • 相关基金:基金项目:国家自然科学基金资助项目(60873247)
  • 相关项目:基于模糊遗传算法的网络信息特征分析与过滤算法研究
中文摘要:

在特征项分布不平衡的情况下,传统信息增益算法的分类性能会急剧下降,针对此缺陷提出了一种利用特征项分布信息来改进信息增益公式的计算方法。通过计算特征项分布信息来判定特征项是否存在不平衡性,并利用此信息来平衡特征项不出现时对分类精度的影响。通过实验验证,改进后的计算方法整体上比传统的信息增益算法具有更好的性能。

英文摘要:

Classification performance of a traditional information gain algorithm will rapidly decline when feature items are in an unbalanced distribution. An improved calculation method of an information gain formula using feature items' distribution information is proposed. Distribution information of feature items is computed to judge whether the imbalance of feature items exists and balance the influence of classification accuracy when the feature items do not appear. The improved calculation method has better performance through the experiment.

同期刊论文项目
同项目期刊论文