位置:成果数据库 > 期刊 > 期刊详情页
基于隐私保护的序列模式挖掘
  • ISSN号:1000-1220
  • 期刊名称:《小型微型计算机系统》
  • 时间:0
  • 分类:TP311[自动化与计算机技术—计算机软件与理论;自动化与计算机技术—计算机科学与技术]
  • 作者机构:[1]东华大学计算机学院,上海201620
  • 相关基金:国家自然科学基金项目(90612006)资助.
中文摘要:

基于隐私保护的数据挖掘是信息安全和知识发现相结合的产物.提出一种基于隐私保护的序列模式挖掘算法PP-SPM.算法以修改原始数据库中的敏感数据来降低受限序列模式的支持度为原则,首先构建SPAM序列树,根据一定的启发式规则,从中获得敏感序列,再进一步在原始数据库中找到敏感数据,对其做布尔操作,实现数据库的清洗.实验表明,该算法在完全保护隐私的情况下,对于D6C10T2.5S414数据集,当修改3.5%的原始数据后,其序列模式丢失率为2%.

英文摘要:

Data mining based on privacy preserving is the combination of information security technology and knowledge discovery technology. An algorithm of mining sequential pattern based on privacy preserving (PP-SPM) is proposed in this paper. It focuses on minimizing the support of restrictive sequential patterns by modifying the sensitive data of the original database. The tree called SPAM is built and the sensitive sequences are found from the tree firstly. Then the sensitive data is chosen from the original database and removed from the transactions by heuristic rules. The algorithm of PP-SPM not only completely protects the privacy but also hardly affects the sequential pattern mining. The experimental results show that the loss ratio of sequential patterns is 2% for the dataset of D6C10T2.5S4I4 after 3.5% data being modified.

同期刊论文项目
同项目期刊论文
期刊信息
  • 《小型微型计算机系统》
  • 中国科技核心期刊
  • 主管单位:中国科学院
  • 主办单位:中国科学院沈阳计算技术研究所
  • 主编:林浒
  • 地址:沈阳市浑南新区南屏东路16号
  • 邮编:110168
  • 邮箱:xwjxt@sict.ac.cn
  • 电话:024-24696120 024-24696190-8870
  • 国际标准刊号:ISSN:1000-1220
  • 国内统一刊号:ISSN:21-1106/TP
  • 邮发代号:8-108
  • 获奖情况:
  • 中国自然科学核心期刊,中国科学引文数据库来源期刊
  • 国内外数据库收录:
  • 俄罗斯文摘杂志,波兰哥白尼索引,荷兰文摘与引文数据库,美国剑桥科学文摘,英国科学文摘数据库,日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2008版),中国北大核心期刊(2011版),中国北大核心期刊(2014版),中国北大核心期刊(2000版)
  • 被引量:23212