东篱科研大数据发现系统（DRDS）

位置：成果数据库 > 期刊 > 期刊详情页

一种基于密度的自适应最优LDA模型选择方法

ISSN号：0254-4164
期刊名称：《计算机学报》
时间：0
分类：TP18[自动化与计算机技术—控制科学与工程;自动化与计算机技术—控制理论与控制工程]
作者机构：[1]中国科学院计算技术研究所虚拟现实技术实验室,北京100190, [2]中国科学院计算技术研究所智能信息处理重点实验室,北京100190, [3]中国科学院研究生院,北京100049
相关基金：本课题得到国家“九七三”重点基础研究发展规划项目基金（2007CB311100）、国家“八六三”高技术研究发展计划项目基金（2007AA01Z416）、国家自然科学基金（60773056,60873165）和北京市科技新星计划（2007B071）资助.

作者：曹娟[1,2,3], 张勇东[1,2], 李锦涛[1,2], 唐胜[1,2]

关键词：主题模型, 主题, LDA, 密度, topic model, topic, LDA, density

中文摘要：

主题模型（topic models）被广泛应用在信息分类和检索领域.这些模型通过参数估计从文本集合中提取一个低维的多项式分布集合,用于捕获词之间的相关信息,称为主题（topic）.针对模型参数学习过程对主题数目的指定和主题分布初始值非常敏感的问题,作者用图的形式阐述了LDA（Latent Dirichlet Allocation）模型中主题产生的过程,提出并证明当主题之间的相似度最小时模型最优的理论;基于该理论,提出了一种基于密度的自适应最优LDA模型选择方法.实验证明该方法可以在不需要人工调试主题数目的情况下,用相对少的迭代,自动找到最优的主题结构.

英文摘要：

Topic models have been successfully used to information classification and retrieval. These models can capture word correlations in a collection of textual documents with a low-dimensional set of multinomial distribution, called ＂topics＂. It is important but difficult to select an appropriate number of topics for a specific dataset. This paper proposes a theorem that the model reaches optimum as the average similarity among topics reaches minimum, and based on this theorem, proposes a method of adaptively selecting the best LDA model based on density. Experiments show that the proposed method can achieve performance matching the best of LDA without manually tuning the number of topics.

同期刊论文项目

基于内容的多媒体数字签名技术研究

期刊论文 6 专利 1

融合显式和隐含语义概念的视频检索技术研究

期刊论文 19 会议论文 33 专利 3 著作 1

同项目期刊论文

互联网推荐系统比较研究

基于目标区域内仿射不变性特征的图像检索

基于视觉感知的时空联合视频拷贝检测方法

基于空间上下文的目标图像检索

基于动态规划融合多模态的足球视频事件分析

Sparse ensemble learning for concept detection

基于GPU的快速图像拷贝检测

利用仿射变换的快速空间关系验证

GPU加速的基于增量式聚类的视频拷贝检测方法

基于多特征匹配的视频拷贝检测算法

基于时空轨迹行为特征的视频拷贝检测方法

Multiview spectral embedding

Exploring probabilistic localized video representation for human action recognition

Exploring Multi-Modality Structure for Cross Domain Adaptation in Video Concept Annotation

Localized Multiple Kernel Learning for Realistic Human Action Recognition in Videos

互联网推荐系统比较研究

A density-based method for adaptive LDA model selection

On defining affinity graph for spectral clustering through ranking on manifolds

Graph-based multi-space semantic correlation propagation for video retrieval

基于视觉注意模型VAMAI的敏感图像检测方法

期刊信息

《计算机学报》
北大核心期刊（2011版）

主管单位:中国科学院
主办单位:中国计算机学会中国科学院计算技术研究所
主编：孙凝晖
地址：北京中关村科学院南路6号
邮编：100190
邮箱：cjc@ict.ac.cn
电话：010-62620695

国际标准刊号：ISSN：0254-4164
国内统一刊号：ISSN：11-1826/TP
邮发代号:2-833

获奖情况:
中国期刊方阵“双效”期刊

国内外数据库收录:
美国数学评论（网络版）,荷兰文摘与引文数据库,美国工程索引,美国剑桥科学文摘,日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊（2004版）,中国北大核心期刊（2008版）,中国北大核心期刊（2011版）,中国北大核心期刊（2014版）,中国北大核心期刊（2000版）

被引量:48433