东篱科研大数据发现系统（DRDS）

欢迎您！东篱公司退出

申报数据库
1. 申报指南
立项数据库
成果数据库
1. 期刊论文
2. 会议论文
3. 著作
4. 专利
项目获奖数据库

位置：成果数据库 > 期刊 > 期刊详情页

基于单字提示特征的中文命名实体识别快速算法

ISSN号：1003-0077
期刊名称：中文信息学报
时间：0
页码：104-110
语言：中文
分类：TP391[自动化与计算机技术—计算机应用技术;自动化与计算机技术—计算机科学与技术]
作者机构：[1]中国科学院软件研究所,北京100190, [2]中国科学院研究生院,北京100049
相关基金：国家自然科学基金资助项目（60773027;60736044）;国家863计划重点资助项目（2006AA010108）
相关项目：下一代信息检索研究

作者：孙乐|张大鲲|冯元勇|李文波|

关键词：计算机应用, 中文信息处理, 中文实体关系抽取, 核方法, 卷积树核, 复合核, 最短路径依赖核, computer application, Chinese information processing, Chinese relation extraction, Kernel-based methods , convolution tree kernel, composite kernels , shortest path dependency kernel

中文摘要：

命名实体关系抽取是信息抽取领域中的重要研究课题之一。该文探讨了核方法在中文关系抽取上的有效性问题，主要分为三部分：研究了在卷积树核中使用不同的语法树对关系抽取性能的影响；通过构造复合核检查了树核与平面核之间的互补效果；改进了最短路径依赖核，将核计算建立在原最短依赖路径的最长公共子序列上，以消除原始最短路径依赖核对依赖路径长度相同的过严要求。因为核方法开始被用于英文关系抽取时，F1值也只有40％左右，而我们在ACE2007标准语料集上的实验结果表明，只使用作用在语法树上的卷积核时，中文关系抽取的F1值达到了35％，可见卷积核方法对中文关系抽取也是有效的，同时实验也表明最短路径依赖核对中文关系抽取效果不明显。

英文摘要：

Entity Relation Extraction is one of the important research fields in Information Extraction. This paper explores the effectiveness of two kernel-based methods, the convolution tree kernel and the shortest path dependency kernel, for Chinese relation extraction based on ACE 2007 corpus. For the convolution kernel, the influence by the different parse tree spans on the performance of relation extraction is studied. Then, experiments with composite kernels, which are a combination of the convolution kernel and feature-based kernels, are conducted to investigate the complementary effects between tree kernel and flat kernels. Finally, we improve the shortest path dependency kernel by replacing the strict same length requirement with finding the longest common subsequences between two shortest dependency paths. Experiments prove that kernel-based methods are effective for Chinese relation extraction as well.

同期刊论文项目

　黑龙江省循环经济统计指标体系的建立及方法研究

期刊论文 6

基于NLP的高精度文本检索模型研究

期刊论文 12 会议论文 20

下一代信息检索研究

期刊论文 117 会议论文 76 专利 12 著作 3

同项目期刊论文

用户查询意图切分的研究

面向blog的爬行算法

面向用户行为的页面质量评估

基于HITS算法的查询结果多样化方法

基于网络资源与用户行为信息的领域术语提取

Research on Automatic Pattern Acquisition Based on Construction Extension

Web Based Translation of Chinese Organization Name

网页作弊与反作弊技术综述

基于群体智慧的Web访问日志会话主题识别研究

Identifying Web Spam with the Wisdom of the Crowds

How do users describe their information need: Query recommendation based on snippet click model

Extraction and Polarity Determination for Opinion Expression

基于话题和修辞识别的阅读理解why型问题回答

基于用户行为的竞价广告效果分析

网页质量评价体系的研究

基于日志分析的中文输入法用户行为研究

问答社区中回答质量的评价方法研究

面向信息检索的近邻语言模型

中文搜索引擎用户行为的演化分析

面向排序学习的特征分析的研究

基于回归支持向量机的信息检索

网络检索用户行为可靠性分析

Query Clustering for Learning to Rank Models on Web Search

Chinese Query Reformulation and Variation: A Case Study in Sogou Log

An Unsupervised Approach for Noun Resolution

A statistical approach to instance-level schema matching

A Temporal Topic Model for New Event Detection

Conceptual Graph Matching Method for Reading Comprehension Tests

基于目的分析的作弊页面分类

Relevance Feedback Based Query Optimization

A new query expansion approach using collocation relationships in language models for information re

Query Spelling Correction For Multi-Language Search Engines

微博用户的相似性度量及其应用

基于小规模尾字特征的中文命名实体识别研究

音字转换中分层解码模型的研究与改进

基于检索历史上下文的个性化查询重构技术研究

Web数据反馈的搭配抽取方法

高性能中文垃圾邮件过滤器

Study on the Optimal Parameters of Image Fusion Based on Wavelet Transform

面向TDT的动态多文档文摘研究

基于上下文的查询扩展

中文交互式问答用户问题相关检测研究

基于日志挖掘的搜索引擎用户行为分析

面向用户互联网访问日志的异常点击分析

一种基于文档相似度的检索结果重排序方法

低频查询的用户行为分析和类别研究

A Re-ranking Approach for Categorization Information Retrieval Based on Multiple Feature Selection

基于改进的TextTiling方法的用户新兴趣发现的研究

开放域问答技术进展

An Efficient Approach to Comment Spam Identification

基于VASE特征词的网络查询分类研究

基于人工标注的个性化检索系统评测的研究

Research on Query Translation for CLIR Based on a Combination of Statistical Method and Web Informat

The Chinese Pinyin Input Method based on Internet Data

Mining Synonymous Entities using Search Engine Query Logs

Log-Mining Based Query Spelling Correction for Chinese Search Engines

Chinese Organization Name Translation via Web Mining

Collocation Extraction Using Web Feedback Data

面向协作式问答的问题理解技术研究

锚文本检索有效性分析

基于群体智慧的Web浏览日志会话划分研究

基于labeled-LDA模型的文本分类新算法

基于用户行为分析的搜索引擎自动性能评价

基于用户日志挖掘的搜索引擎广告效果分析

Automatic Hot Event Detection Using Both Media and User Attention

基于查询聚类的排序学习算法

基于浏览器收藏夹的用户行为研究

查询会话中的用户行为分析

基于语义域语言模型的中文话题关联检测

信息过滤中基于二元近似关系分布的噪声屏蔽算法

企业内部邮件中话题讨论检索研究

面向排序的基于查询需求的查询聚类模型

基于用户行为的长查询用户满意度分析

基于用户兴趣分析的网页生命周期建模

针对搜索引擎的媒体倾向性研究

使用基于多例学习的启发式SVM算法的图像自动标注

基于多例学习的Web图像聚类

量子程序设计语言NDQJava-2

Feature selection algorithm for text classification based on improved mutual information

基于多重特征选择和多分类器融合的文本层次分类研究

一种新的面向主题的爬行算法

融合多类特征的Web查询意图识别

基于改进TextTiling方法的用户新兴趣发现的研究

基于TSVM与主动学习融合的蛋白质交互作用关系抽取

网页结构树相似度计算

面向互联网新闻的话题检测与追踪

基于文摘的信息检索模型

开放域问答技术研究进展

信息检索结果多样化探索

基于“VASE”特征词的网络查询分类研究

以机器翻译技术为核心的多语信息处理研究

基于URL主题的查询分类方法

基于核方法的敏感信息过滤的研究

Study of Kernel-based Methods for Chinese Relation Extraction(poster.

Two-Step Chinese NER Based on CRF

ISCAS at Multilingual Opinion Analysis Task NTCIR 7

基于小规模尾字特征的中文命名实体识别研究

基于VASE特征词的网络查询分类研究.

音字转换中分层解码模型的研究与改进

基于labeled-LDA模型的文本分类新算法

基于“VASE”特征词的网络查询分类研究

基于小规模尾字特征的中文命名实体识别研究

推进黑龙江省循环经济发展的建议

黑龙江省循环经济统计指标体系构建的研究

黑龙江省循环经济综合统计评价

马齿苋合剂水提取液对感染单纯疱疹病毒Ⅱ型小鼠免疫功能的影响

期刊信息

《中文信息学报》
北大核心期刊（2011版）

主管单位:中国科学技术协会
主办单位:中国中文信息学会中国科学院软件研究所
主编：孙茂松
地址：北京海淀中关村南四街4号中科院软件所
邮编：100190
邮箱：jcip@iscas.ac.cn
电话：010-62562916

国际标准刊号：ISSN：1003-0077
国内统一刊号：ISSN：11-2325/N
邮发代号:

获奖情况:

国内外数据库收录:
日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊（2004版）,中国北大核心期刊（2008版）,中国北大核心期刊（2011版）,中国北大核心期刊（2014版）,中国北大核心期刊（2000版）

被引量:9136