位置:成果数据库 > 期刊 > 期刊详情页
基于排序索引矩阵的频繁项集挖掘算法
  • ISSN号:1000-3428
  • 期刊名称:《计算机工程》
  • 时间:0
  • 分类:TP311[自动化与计算机技术—计算机软件与理论;自动化与计算机技术—计算机科学与技术]
  • 作者机构:[1]山东师范大学信息科学与工程学院,济南250014, [2]山东省分布式计算机软件新技术重点实验室,济南250014, [3]山东省信息中心,济南250013
  • 相关基金:国家自然科学基金资助项目(60873247); 山东省自然科学基金资助项目(ZR2011FM030,ZR2012FM038); 山东省社会科学规划研究基金资助项目(10BSHJ03); 山东省教育厅科技计划基金资助项目(J09LG52)
中文摘要:

针对Apriori算法产生候选项集的问题,提出一种基于排序索引矩阵(SIM)的频繁项集挖掘算法。将频繁1-项集形成的1-项集向量依次与对应矩阵相乘,生成频繁2-项集。从频繁3-项集开始,对每次生成的频繁k-项集建立SIM,借助SIM结构实现项集的跨越式搜索和连接。整个过程只需扫描一次数据库,不会产生候选项集。实验结果表明,该算法能提高频繁项集的挖掘效率。

英文摘要:

Aiming at the problem that Apriori algorithm generates candidate itemsets,this paper presents a frequent itemsets mining algorithm based on Sorting Index Matrix(SIM).The algorithm directly generates frequent 2-itemset through 1-itemset vector and the corresponding matrix multiplication sequentially.From the frequent 3-itemset,it establishes simple SIM for the frequent k-item sets to realize itemsets' spanning search and connection with the SIM.The whole process just scans the database once,and does not produce candidate itemsets.Experimental result shows that the algorithm improves the efficiency of mining frequent itemsets.

同期刊论文项目
同项目期刊论文
期刊信息
  • 《计算机工程》
  • 北大核心期刊(2014版)
  • 主管单位:中国电子科技集团公司
  • 主办单位:华东计算技术研究所 上海市计算机学会
  • 主编:游小明
  • 地址:上海市桂林路418号
  • 邮编:200233
  • 邮箱:ecice06@ecict.com.cn
  • 电话:021-64846769
  • 国际标准刊号:ISSN:1000-3428
  • 国内统一刊号:ISSN:31-1289/TP
  • 邮发代号:4-310
  • 获奖情况:
  • 1999~2000、2001~2002年度信息产业部优秀期刊奖,2003-2004、2005-2006年度信息产业部电子精品科技...,2007-2008、2009-2010年度工业和信息产业部电子精...,012年度中国科技论文在线优秀期刊一等奖,2013年度中国科技论文在线优秀期刊二等奖
  • 国内外数据库收录:
  • 俄罗斯文摘杂志,美国化学文摘(网络版),波兰哥白尼索引,荷兰文摘与引文数据库,美国剑桥科学文摘,英国科学文摘数据库,日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2008版),中国北大核心期刊(2014版),中国北大核心期刊(2000版)
  • 被引量:84139