位置:成果数据库 > 期刊 > 期刊详情页
基于优化初始种子新策略的K-Means聚类算法
  • ISSN号:1001-6600
  • 期刊名称:《广西师范大学学报:自然科学版》
  • 分类:TP301.6[自动化与计算机技术—计算机系统结构;自动化与计算机技术—计算机科学与技术]
  • 作者机构:[1]广西师范学院计算机与信息工程学院,广西南宁530023
  • 相关基金:国家自然科学基金资助项目(61363037,61363074);广西自然科学基金资助项目(2011GXNSFD018025);广西自然科学青年基金资助项目(2012GXNSFBA053161)
中文摘要:

作为典型的启发式聚类算法,K-Means受到初始模型的影响而存在两个缺陷:算法对初始模型非常敏感和聚类效果差强人意.若给K-Means一个能够反映数据分布特征的初始种子集,这些种子既处于数据密集区域,又尽可能相互之间远离,这样一个初始模型对于提高启发式算法性能具有重要意义.本文据此给出距离密度混合选择(HYDD)种子优化方案的基本思路:对数据集进行密度排序,在此基础上选取密度大且满足距离大于密度直径的数据作为候选初始种子集,在候选初始种子集上,利用点点之间距离从大到小选取K个所需的种子,最后利用该初始种子集引导K-Means算法来搜索聚类结果.在5组仿真数据集和3组真实数据集上的实验结果表明,HYDD K-Means算法能够稳定的获取具备高内聚、高分离这一优良特征的聚类簇.

英文摘要:

K-Means is one of classical and heuristic clustering algorithm ,which is sensitive to the model's initial state. This makes the initialization of the model deterministic to the clustering solution, and the process usually can obtain the local optima result. The study on supplying a initial seeds set that can re- flect the characteristics about the distribution of the data is of great value for clustering research. They would be selected in a denser region as far as possible and would be dispersive as much as possible. And then Hybrid Distance Density Based Seeking (HYDD) stategy is offered, first of all,this method rear- ranges the original data on the principle of decreasing density, then the date higher density and longer distance than the diameter wer interred into a candidate set. Secondly,k seeds is selected from the candi- date set based on the theory that the sum of distance is decreasing. Finally,K-Means is run with the ini- tial seed set. Experiments results on 5 synthesis and 3 real datasets show that HYDD K-Means could obtain clusters which have maximal intra-cluster homogeneity and maximal inter-cluster separation.

同期刊论文项目
同项目期刊论文
期刊信息
  • 《广西师范大学学报:自然科学版》
  • 北大核心期刊(2011版)
  • 主管单位:广西师范大学
  • 主办单位:广西师范大学
  • 主编:苏桂发
  • 地址:桂林市三里店育才路15号
  • 邮编:541004
  • 邮箱:gxsdzkb@mailbox.gxnu.edu.cn
  • 电话:0773-5848958
  • 国际标准刊号:ISSN:1001-6600
  • 国内统一刊号:ISSN:45-1067/N
  • 邮发代号:48-54
  • 获奖情况:
  • 1994年,获广西优秀期刊三等奖,1995年,获广西高校理科学报B类一等奖,1996年,获广西第三届优秀报刊二等奖,1999年,获广西首届高校优秀学报二等奖,2001年,被评为第四届广西优秀科技期刊,2002年,获第二届广西高校优秀学报二等奖,2002年,入选中国期刊方阵“双效”期刊,2004年,获全国高校优秀科技期刊一等奖,2005年,获第五届“广西十佳自然科学期刊”称号,2007年,获第六届“广西十佳自然科学期刊”称号,2008年,被评为全国高校科技期刊先进集体
  • 国内外数据库收录:
  • 俄罗斯文摘杂志,美国化学文摘(网络版),英国农业与生物科学研究中心文摘,波兰哥白尼索引,德国数学文摘,美国剑桥科学文摘,英国动物学记录,中国中国科技核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2008版),中国北大核心期刊(2011版),中国北大核心期刊(2014版)
  • 被引量:5888