位置:成果数据库 > 期刊 > 期刊详情页
疾病-病症和病症-治疗物质的关系抽取研究
  • ISSN号:1002-8331
  • 期刊名称:《计算机工程与应用》
  • 时间:0
  • 分类:TP18[自动化与计算机技术—控制科学与工程;自动化与计算机技术—控制理论与控制工程]
  • 作者机构:[1]大连理工大学计算机科学与技术学院,辽宁大连116024
  • 相关基金:国家自然科学基金(No.61070098,No.61272373,No.61340020);新世纪优秀人才支撑计划(No.NCET-13-0084);中央高校基本科研业务费专项资金(No.DUT13JB09,No.DUT14YQ213).
中文摘要:

随着生物医学文献的快速增长,在海量的生物医学文献中存在大量有关疾病、病症和治疗物质的信息,这些信息对疾病的治疗和药物的研制有着重要的意义。针对疾病与治疗物质之间的信息抽取,重点训练两个模型,即疾病与病症模型和病症与治疗物质模型。疾病与病症模型判断一种疾病是否会存在或者导致一种生理现象的产生;病症与治疗物质模型判断一种物质是否改变人的生理现象或者生理过程。使用半监督学习的Tri-training的方法,利用大量未标注数据辅助少量有标注数据进行训练提高分类性能。实验结果表明,Tri-training方法中利用未标注数据有助于提高实验结果;且在训练过程中使用集成学习的思想将三个分类器器集成在一起,提高了学习性能。

英文摘要:

With the rapid growth of biomedical literature,the knowledge about diseases,symptoms and therapeutic substances in biomedical literature has contributed positively to drug discovery and disease therapy.This paper presents the method of constructing two models for extracting the relations between diseases and therapeutic substances,i.e.the disease and symptom model and symptom and therapeutic substance model.The disease and symptom model judges whether a disease can exist or cause a physiological phenomenon.The symptom and therapeutic substance model determines whether a substance changes a person’s physiological processes.In this method,a semi-supervised learning algorithm,Tri-training is applied to utilize the unlabeled data along with a few labeled examples to improve the classification performance.Experimental results show that exploiting unlabeled data with the Tri-training algorithms can enhance the experimental result.In the Tri-training process,this method uses ensemble learning to integrate three classifies,which can improve the learning performance.

同期刊论文项目
同项目期刊论文
期刊信息
  • 《计算机工程与应用》
  • 北大核心期刊(2014版)
  • 主管单位:中国电子科技集团公司
  • 主办单位:华北计算技术研究所
  • 主编:怀进鹏
  • 地址:北京市海淀区北四环中路211号北京619信箱26分箱
  • 邮编:100083
  • 邮箱:ceaj@vip.163.com
  • 电话:
  • 国际标准刊号:ISSN:1002-8331
  • 国内统一刊号:ISSN:11-2127/TP
  • 邮发代号:82-605
  • 获奖情况:
  • 1. 2012年首批获得中国学术文献评价中心发布的 “...,2. 2001年获得新闻出版署“中国期刊方阵双效期刊”,3. 2008年首批入选国家科技部“中国精品科技期刊...,4.2003年-2011年连续获得工业和信息化部期刊最高...
  • 国内外数据库收录:
  • 俄罗斯文摘杂志,波兰哥白尼索引,美国剑桥科学文摘,英国科学文摘数据库,日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2008版),中国北大核心期刊(2014版),中国北大核心期刊(2000版)
  • 被引量:97887