位置:成果数据库 > 期刊 > 期刊详情页
一种基于网络的竞争企业名录自动更新方法
  • ISSN号:1003-0077
  • 期刊名称:《中文信息学报》
  • 时间:0
  • 分类:TP391.1[自动化与计算机技术—计算机应用技术;自动化与计算机技术—计算机科学与技术]
  • 作者机构:[1]沈阳航空航天大学知识工程研究中心,沈阳110136
  • 相关基金:国家自然科学基金(项目编号:61073123);辽宁省教育厅项目(项目编号:L2011031)
中文摘要:

为解决情报采集过程中竞争企业名录的更新问题,提出了一种基于网络的竞争企业名录自动更新方法.该方法首先利用产品名称从企业索引中检索出相关的企业名列表,采用LCS(Lon-gest Common Substring)算法抽取企业名模式,以“产品名+企业名模式”的形式重构查询.然后, 使用搜索引擎进行网页搜索,再利用贝叶斯分类算法对搜索的网页过滤,将过滤后的企业信息更新到企业名录中.实验结果显示,系统P@10、P@20、P@30分别为73.4%,68.4%,65.2%,MAP@10、MAP@20、MAP@30分别达到66.2%,58.9%,52.5%,结果说明该方法可以有效的实现竞争企业名录的自动更新.

英文摘要:

We propose a Web-based approach to solving the update problem of competitive business directo- ry in the process of intelligence collection in this paper. Firstly, the approach retrieves related business list from business index by using product names, and adopts business name pattern extraction approach based on LCS algorithm. , and we construct a new query in the form of product and business name pattern. Then, we obtain the pages by search engine, and use bayes classifier algorithm to filter the pages. We update the busi- ness information filtered into the business directory. Experiment results show that P@ 10, P@ 20, P@ 30 are 73.4% ,68.4% ,65.2%, and MAP@ 10, MAP@ 20, MAP@ 30 are 66.2%, 58.9%, 52.5 %, respectively. The result shows that the approach can effectively realize automatic update of competitive business directory.

同期刊论文项目
同项目期刊论文
期刊信息
  • 《中文信息学报》
  • 北大核心期刊(2011版)
  • 主管单位:中国科学技术协会
  • 主办单位:中国中文信息学会 中国科学院软件研究所
  • 主编:孙茂松
  • 地址:北京海淀中关村南四街4号中科院软件所
  • 邮编:100190
  • 邮箱:jcip@iscas.ac.cn
  • 电话:010-62562916
  • 国际标准刊号:ISSN:1003-0077
  • 国内统一刊号:ISSN:11-2325/N
  • 邮发代号:
  • 获奖情况:
  • 国内外数据库收录:
  • 日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2008版),中国北大核心期刊(2011版),中国北大核心期刊(2014版),中国北大核心期刊(2000版)
  • 被引量:9136