位置:成果数据库 > 期刊 > 期刊详情页
融合边界信息的语音样例快速检索
  • ISSN号:1003-0530
  • 期刊名称:信号处理
  • 时间:2013.6.25
  • 页码:743-752
  • 分类:TP391.4[自动化与计算机技术—计算机应用技术;自动化与计算机技术—计算机科学与技术]
  • 作者机构:[1]解放军信息工程大学信息系统工程学院,河南郑州450002
  • 相关基金:国家自然科学基金(61175017)资助项目
  • 相关项目:基于分段条件随机场的连续语音识别技术
中文摘要:

提出了一种融合音素边界信息的语音样例快速检索方法。该方法首先提取查询样例和测试集的音素后验概率;然后,运用层次凝聚聚类算法将音素后验概率序列分段(即音素边界检测),计算每个分段的平均向量并将其分别组成新查询和新索引,再运用动态时间规整进行语音样例的检索;最后,使用虚拟相关反馈技术对检索结果进行修正。实验结果表明:尽管此方法的检索精度略低于直接运用动态时间规整进行检索的检索精度,但其检索速度大大优于后者,且与其他相关文献提出的方法相比,此方法在检索速度方面也具有明显优势。

英文摘要:

This paper presents a method of fast query-by-example spoken term detection ( QbE STD) integrating the phoneme boundary Information. According to this method, the phoneme posterior probabilities of query examples and test materials should be extracted firstly, and then phoneme posterior probabilities are segmented into segment sequences using hierarchical agglomerative clustering(HAC) algorithm( phoneme boundary detection), new queries and new indexes can be composed of the expectation vectors of the segment sequences. The dynamic time warping(DTW) procedure is formulated to implement QbE STD. Finally, the detection results can be modified by pseudo relevance feedback (PRF). The experimental results indicate that although the method presented by the paper has a slight reduction of the detection performance as compared with DTW, there is a great advantage over the latter in the detection speed, and compared with the method presented by other paper,the method presented by the paper also has far more superiorities in the detection speed.

同期刊论文项目
期刊论文 85 会议论文 9 获奖 2 著作 1
同项目期刊论文
期刊信息
  • 《信号处理》
  • 中国科技核心期刊
  • 主管单位:中国科学技术协会
  • 主办单位:中国电子学会
  • 主编:谢维信
  • 地址:北京鼓楼西大街41号
  • 邮编:100009
  • 邮箱:xhclfh@sohu.com
  • 电话:010-64010656
  • 国际标准刊号:ISSN:1003-0530
  • 国内统一刊号:ISSN:11-2406/TN
  • 邮发代号:80-531
  • 获奖情况:
  • 国家一级科技期刊
  • 国内外数据库收录:
  • 美国剑桥科学文摘,日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2008版),中国北大核心期刊(2011版),中国北大核心期刊(2014版)
  • 被引量:10219