位置:成果数据库 > 期刊 > 期刊详情页
基于超图的汉越双语新闻话题要素提取
  • ISSN号:1001-3695
  • 期刊名称:《计算机应用研究》
  • 时间:0
  • 分类:TP391.1[自动化与计算机技术—计算机应用技术;自动化与计算机技术—计算机科学与技术]
  • 作者机构:昆明理工大学信息工程与自动化学院,昆明650500
  • 相关基金:国家自然科学基金资助项目(61562049)
中文摘要:

针对汉越双语新闻话题文本集合中新闻话题要素提取的问题进行了研究,在超图模型的基础上,运用了PageRank随机游走排序方法。首先根据触发词激励的方法提取新闻中的事件要素,然后在此基础上构建话题超图模型,将汉越事件要素作为节点,将文本集合中的句子作为超边,根据概率评估函数计算节点和超边的初始权重,最后采用PageRank随机游走方法,对汉越事件要素进行评分,最终得到汉越话题要素。实验结果表明,该方法相比只考虑单文本事件要素提取方法的效果有显著提高。说明了基于超图的PageRank方法提取新闻话题要素的准确性。

英文摘要:

This paper studied the problems of news topic elements in the Chinese and Vietnamese bilingual news topic text collections. Based on hypergraph model extracted, it used the PageRank random walk ordering method. First according to the trigger word incentive method,it extracted the news event elements, and then on the basis of this,it constructed topic hyperg- raph model. It took the Chinese and Vietnamese elements as nodes and the sentences of text collection as a hyper-edge, it cal- culated the initial weights of nodes and hyperedges according to probability evaluation function. Finally, it used the PageRank random walk method to score the elements of the Chinese-Vietnamese event, and finally obtained the elements of the Chinese- Vietnamese topic. Results show that the proposed method can significantly improve the extraction performance compared to the method only considered single text event feature extraction. It shows the accuracy of extraction of news topicby PageRank me- thod based on hypergraph elements.

同期刊论文项目
同项目期刊论文
期刊信息
  • 《计算机应用研究》
  • 北大核心期刊(2011版)
  • 主管单位:四川省科学技术厅
  • 主办单位:四川省计算机研究院
  • 主编:刘营
  • 地址:成都市成科西路3号
  • 邮编:610041
  • 邮箱:arocmag@163.com
  • 电话:028-85210177 85249567
  • 国际标准刊号:ISSN:1001-3695
  • 国内统一刊号:ISSN:51-1196/TP
  • 邮发代号:62-68
  • 获奖情况:
  • 第二届国家期刊奖百种重点科技期刊,国内计算技术类重点核心期刊,国内外著名数据库收录期刊
  • 国内外数据库收录:
  • 俄罗斯文摘杂志,波兰哥白尼索引,英国科学文摘数据库,日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2008版),中国北大核心期刊(2011版),中国北大核心期刊(2014版),中国北大核心期刊(2000版)
  • 被引量:60049