东篱科研大数据发现系统（DRDS）

位置：成果数据库 > 期刊 > 期刊详情页

基于非负矩阵分解的中文文本主题分类

ISSN号：1000-3428
期刊名称：《计算机工程》
时间：0
分类：TP391[自动化与计算机技术—计算机应用技术;自动化与计算机技术—计算机科学与技术]
作者机构：[1]哈尔滨工程大学信息与通信工程学院,哈尔滨150001
相关基金：国家自然科学基金资助项目“基于Lattice的汉语语音主题分类方法研究”（60702053）;国家自然科学基金资助项目“基于子词网格的汉语语音检索关键技术研究”（60575030）

关键词：主题分类, 非负矩阵分解, 潜在语义索引, topic classification, Non-negative Matrix Factorization（NMF）, Latent Semantic Indexing（LSI）

中文摘要：

提出基于非负矩阵分解（NMF）的中文文本主题分类方法，应用NMF算法分解词．文本矩阵获取词之间的相关性，有效地解决同义词、多义词的影响。实验结果表明，与基于奇异值分解的潜在语义索引方法相比，该方法计算速度快、占用存储空间较少。在潜在语义数据降低较大的情况下，NMF方法具有更好的分类精度。

英文摘要：

This paper presents a method based on Non-negative Matrix Factorization（NMF） for Chinese document topic classification. According to NME the term-document matrix is decomposed to reveal the relationship between terms. This method solves the problem of synonym and polysemy effectively. Compared with Latent Semantic Indexing（LSl） based on Singular Value Decomposition（SVD）, experimental results show that this method has faster computing speed and less memory occupancy. It can improve classification precision when the number of latent semantic index is reduced pronouncedly.

同期刊论文项目

基于子词网格的汉语语音检索关键技术研究

期刊论文 21 会议论文 3 著作 1

基于Lattice的汉语语音主题分类方法研究

期刊论文 13 会议论文 6

同项目期刊论文

基于音素模型的语音关键词检出系统中确认技术研究

基于统计和潜在语义分析的混合语言模型的研究

基于声调建模的带噪中文数字串语音识别

基于K-L散度的最大后验弧主导的混淆网络生成算法.

基于后验概率的汉语语音检索方法研究

基于词片和Lattice的汉语语音检索技术研究

基于似然度加权和维数缩减的Robust语音端点检测

汉语语音文档检索中基于后验概率的索引方法研究

基于音节Lattice的汉语语音检索技术及其索引去冗余方法

基于HMM/SVM两级结构的汉语易混淆语音识别

基于限制模型规模和声学置信度的关键词检出方法

基于词片的语言模型及在汉语语音检索中的应用

基于谐波结构信息的自动音乐标注方法

SVM with Discriminant Dynamical Time Alignment.

基于分段的实时声频检索方法

基于内容的音频信息检索技术研究

基于混淆网络和辅助信息的语音识别技术研究，

基于音节网格的汉语语音文档检索方法研究，

新闻广播语音自动摘要技术研究

面向实时应用的汉语关键词检出技术研究

结合关键词混淆网络的关键词检出系统研究

基于计算听觉场景分析的混合语音分离

Different evaluation approaches of confusion network in Chinese spoken classification

基于互信息置信度的网格连续汉语语音检索

改进的katz算法及其在基于Lattice识别系统中的应用

一种面向对象模糊Petri网建模方法的研究

一种自适应模糊Petri网及其应用

基于着色赋时面向对象Petri网的AUV系统建模研究

一种着色赋时的面向对象Petri网及在自动制造系统中的应用

利用投票选择机制进行语音分割的新方法

皮肤纹理检测技术

期刊信息

《计算机工程》
北大核心期刊（2014版）

主管单位:中国电子科技集团公司
主办单位:华东计算技术研究所上海市计算机学会
主编：游小明
地址：上海市桂林路418号
邮编：200233
邮箱：ecice06@ecict.com.cn
电话：021-64846769

国际标准刊号：ISSN：1000-3428
国内统一刊号：ISSN：31-1289/TP
邮发代号:4-310

获奖情况:
1999～2000、2001～2002年度信息产业部优秀期刊奖,2003-2004、2005-2006年度信息产业部电子精品科技...,2007-2008、2009-2010年度工业和信息产业部电子精...,012年度中国科技论文在线优秀期刊一等奖,2013年度中国科技论文在线优秀期刊二等奖

国内外数据库收录:
俄罗斯文摘杂志,美国化学文摘（网络版）,波兰哥白尼索引,荷兰文摘与引文数据库,美国剑桥科学文摘,英国科学文摘数据库,日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊（2004版）,中国北大核心期刊（2008版）,中国北大核心期刊（2014版）,中国北大核心期刊（2000版）

被引量:84139