位置:成果数据库 > 期刊 > 期刊详情页
网络检索结果聚类研究综述
  • ISSN号:1000-7490
  • 期刊名称:《情报理论与实践》
  • 时间:0
  • 分类:TP391.41[自动化与计算机技术—计算机应用技术;自动化与计算机技术—计算机科学与技术]
  • 作者机构:[1]南京大学信息管理学院,江苏南京210023
  • 相关基金:国家社会科学基金重大招标项目“面向学科领域的网络信息资源深度聚合与服务研究”(项目编号:12&ZD221); 中国科学技术信息研究所“大数据环境下的人机交互研究”课题的资助
中文摘要:

网络检索结果聚类是将搜索引擎的检索结果聚类为有意义的类别,并赋予标签描述,以便用户快速获得所需信息的技术。文章根据网络检索结果聚类算法的改进方向将其分为面向经典和面向标签的聚类算法两类。前者的改进主要有优化特征选择、优化聚类数K以及生成重叠聚类等;后者的改进主要有优化类计分运算、优化类合并运算、数据结构优化、候选标签选择以及基于语义的优化等。在对相关研究进行综述的基础上探讨了检索结果聚类面临的问题和未来的发展方向。

英文摘要:

By clustering search results into meaningful clusters and giving the appropriate description labels,network search results clustering is used to help to get the information quickly. Based on the improving direction of network search results clustering algorithm,this paper divides the algorithm into classical clustering oriented algorithm and label-oriented algorithm. The improvement of classical clustering oriented algorithm mainly includes optimization of feature selection,optimization of cluster number K and generation of overlapping clustering. The improvement of label-oriented algorithm mainly includes optimization of class scoring operation,optimization of class merging operation,optimization of data structure,selection of candidate label and optimization based on semantics. On the basis of the review of relevant studies,the paper discusses the existing problems and future developing directions of search results clustering.

同期刊论文项目
同项目期刊论文
期刊信息
  • 《情报理论与实践》
  • 北大核心期刊(2011版)
  • 主管单位:中国兵器工业集团公司
  • 主办单位:中国国防科学技术信息学会 中国兵器工业集团第二一零研究所中国兵器工业第二一0研究所
  • 主编:王忠军
  • 地址:北京2413信箱10分箱
  • 邮编:100089
  • 邮箱:ita@onet.com.cn
  • 电话:010-68961793 68963306
  • 国际标准刊号:ISSN:1000-7490
  • 国内统一刊号:ISSN:11-1762/G3
  • 邮发代号:82-436
  • 获奖情况:
  • 国内外数据库收录:
  • 中国中国人文社科核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2008版),中国北大核心期刊(2011版),中国北大核心期刊(2014版),中国北大核心期刊(2000版)
  • 被引量:26785