位置:成果数据库 > 期刊 > 期刊详情页
一种复杂版面扭曲文档图像快速校正方法
  • ISSN号:1000-386X
  • 期刊名称:《计算机应用与软件》
  • 时间:0
  • 分类:TP391[自动化与计算机技术—计算机应用技术;自动化与计算机技术—计算机科学与技术]
  • 作者机构:[1]北方工业大学计算机学院,北京100144
  • 相关基金:国家自然科学基金项目(61371142);北京市自然科学基金项目(4132026).
中文摘要:

在对复杂版面扭曲文档图像进行OCR识别时,识别率较低。针对这类文档图像提出一种基于形态学文本行定位的扭曲校正方法。首先根据形态学特征在复杂版面中定位文本行,区分处理文字区域和非文字区域,利用文本行信息提取文本线;再以文本线为基准利用窗口扫描法进行文字行校正,最终重构图像。实验结果表明,该方法校正效果明显,对于复杂版面的扭曲文档图像有较好的校正效果,校正后识别率大幅度提高。

英文摘要:

The recognition rate of OCR (optical character recognition)on warped document images in complex layout is relatively low.To solve this problem,we proposed a morphology-based warp correction method with rows of text positioning.First,according the morphological characteristics it locates the rows of text in complex layout to distinguish the text areas from other areas.After that it uses the rows of text information to extract the text lines,and then uses the text lines as the benchmark,employs the window scanning method to correct the rows of text,and finally reconstructs the image.Experimental results demonstrated that this method achieved manifest correction effect.For warped document images in complex layout it gained acceptable correction results,the recognition rate improved significantly after the correction.

同期刊论文项目
同项目期刊论文
期刊信息
  • 《计算机应用与软件》
  • 北大核心期刊(2011版)
  • 主管单位:上海科学院
  • 主办单位:上海市计算技术研究所 上海计算机软件技术开发中心
  • 主编:朱三元
  • 地址:上海市愚园路546号
  • 邮编:200040
  • 邮箱:cas@sict.stc.sh.cn
  • 电话:021-62254715 62520070-505
  • 国际标准刊号:ISSN:1000-386X
  • 国内统一刊号:ISSN:31-1260/TP
  • 邮发代号:4-379
  • 获奖情况:
  • 全国计算机类中文核心期刊
  • 国内外数据库收录:
  • 波兰哥白尼索引,美国剑桥科学文摘,中国中国科技核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2011版),中国北大核心期刊(2000版)
  • 被引量:27463