使用ABBYY FineReader 手动校正文档复杂结构
ABBYY FineReader 15(Windows系统)拥有强大的OCR识别功能,能对扫描仪或者数码相机等光学工具获取的图像进行识别,解析其中的文本、图像、表格、条形码等,方便用户进一步获取图像中的信息。
但由于设备或者拍摄时的客观因素影响,获取的图像可能并不是很理想的状态,比如图像可能会倾斜,识别的区域类型错误等,ABBYY FineReader 15 OCR文字识别软件配备了手动校正文档复杂结构的功能,更好地提高OCR的识别质量。接下来,小编以一个实例来演示一下手动校正文档的过程。
首先,要先把图像文件导入到软件的OCR编辑中,更为简便的方式是直接在“新任务窗口”的转换文档处使用“在OCR编辑器中打开”。
.png)
图1:打开OCR编辑器
第一步、 对图像进行自动识别
导入图像后,ABBYY FineReader 15 OCR文字识别软件的OCR编辑器会对图像进行预处理的识别。导入了一张包含两个页面的、方向倒置的图书照片,软件会自动将其页面分割,并将页面翻转至正确方向,然后对其中的文本、图像、表格等进行区域分类。
.jpeg)
图2:图像识别
.png)
图3:图像识别后
第二步、 手动校正
在ABBYY FineReader 15 中,选中其中需要处理的图像,在“图像面板”处,可以看到图像中的右上角区域被定义为“图片”,但其中是包含有文本的,此时,就可以使用手动调整区域的功能。
.jpeg)
图4:图片区域
·调整区域的边框,使用鼠标拖动图片区域的边框,将图片的文字部分减去。
.jpeg)
图5:减去文本区域
·然后使用“图像面板”顶部工具栏的“新建区域”工具,新建文本区域。选择上一步中减去的文本区域,将其定义为文本,提高OCR识别的质量。
.png)
图6:新建的文本区域
·调整页面的属性,右击需要调整的区域,在其右击快捷菜单里选择“属性”,即可在图像面板的底部找到该区域的具体属性。选择其中的页脚文本,在其“功能属性”中,可将其定义为“页眉和页脚”。
.png)
图7:调整页面的属性
通过使用ABBYY FineReader 15 OCR文字识别软件的OCR识别功能,能帮助用户尽可能准确地获取到图像文件中的信息。通过预先识别+后期手动调整的方式,可帮助用户更有效地进行图像识别,既能减少不必要的简单重复劳动,也能发挥自我能动性。点击ABBYY FineReader教程即刻获取更多OCR识别技巧。
使用ABBYY FineReader 手动校正文档复杂结构的更多相关文章
- 如何使用ABBYY FineReader 手动管理文档区域
在运用OCR编辑器时,ABBYY FineReader 15(Windows系统)OCR文字识别软件会对扫描仪或数码相机导入的图像进行识别和检测.在识别和检测之前,软件会自动对PDF文档中的文本.图片 ...
- ABBYY FineReader 15 PDF文档查看功能
PDF文档查看功能是ABBYY FineReader 15(Windows系统)OCR文字识别软件中PDF编辑器的一项基础功能,可供用户查看,搜索PDF文档,无需进入编辑模式,也可复制其中的文本,图片 ...
- ABBYY FineReader 15 对比文档功能
想必大家在办公的时候都有着要处理各种各样文档的烦恼,一个文档经过一个人或不同人的多次修订都是常有的事,拥有文档对比功能的软件也就应势而生.ABBYY FineReader 15 有许多能够帮助我们办公 ...
- ABBYY FineReader 15 PDF文档编辑功能详解
ABBYY FineReader 15(Windows系统)OCR文字识别软件作为一款通用 PDF 工具,能轻松有效地对各种 PDF文档和纸质文档,进行数字化.检索.编辑.转换.包含.分享和合作,而其 ...
- HTML介绍、文档基本结构、meta标签、HTML标记的语法
一.HTML的介绍 Hyper Text Mark-up Language 超文本标记语言,是一种描述性标记语言(不是编程语言),主要用于描述网页(可以有图像,文字,声音,等..)但没有交互性 HTM ...
- MFC单文档程序结构
MFC单文档程序结构三方面: Doc MainFrame View
- 深入分析MFC文档视图结构(项目实践)
k_eckel:http://www.mscenter.edu.cn/blog/k_eckel 文档视图结构(Document/View Architecture)是MFC的精髓,也是Observer ...
- MFC文档视图结构学习笔记
文档/视图概述 为了统一和简化数据处理方法,Microsoft公司在MFC中提出了文档/视图结构的概念,其产品Word就是典型的文档/视图结构应用程序 MFC通过其文档类和视图类提供了大量有关数据处理 ...
- ABBYY 识别结果的文档怎么导出
使用ABBYY FineReader Pro for Mac OCR文字识别软件识别文档时,识别结果可以保存至一个文件.复制到剪贴板或通过电子邮件发送.可以执行下列操作:导出整个文档.仅导出所选页面. ...
随机推荐
- net core 微服务框架 Viper 调用链路追踪
1.Viper是什么? Viper 是.NET平台下的Anno微服务框架的一个示例项目.入门简单.安全.稳定.高可用.全平台可监控.底层通讯可以随意切换thrift grpc. 自带服务发现.调用链追 ...
- LeetCode 45跳跃游戏&46全排列
原创公众号:bigsai,回复进群加入力扣打卡群. 昨日打卡:LeetCode 42字符串相乘&43通配符匹配 跳跃游戏 题目描述: 给定一个非负整数数组,你最初位于数组的第一个位置. 数组中 ...
- K8S使用群晖DS218+的NFS
欢迎访问我的GitHub https://github.com/zq2599/blog_demos 内容:所有原创文章分类汇总及配套源码,涉及Java.Docker.Kubernetes.DevOPS ...
- Visual Studio 2017 创建Winfrom工程
1.打开Visual Studio 2017,出现界面点击-创建新项目 2.选择-Window桌面,选择windows 窗体应用(.NET Framework) 3.完成窗体程序创建,可在左边工具栏里 ...
- Flask 中的MTV架构之Models
Flask 中的MTV架构之Models 1.Models(数据模型) 1.1 flask-sqlalchemy(数据库) 说明:提供了大多数关系型数据库的支持,而且提供了ORM # 安装: pi ...
- Socket创建简单服务器和客户端程序
使用Socket编程创建简单服务器和客户端 要知道的 Socket-AddressFamily, SocketType, ProtocolType https://blog.csdn.net/weix ...
- Docker(7)- docker images 命令详解
如果你还想从头学起 Docker,可以看看这个系列的文章哦! https://www.cnblogs.com/poloyy/category/1870863.html 作用 列出所有的本地镜像 语法格 ...
- unicode与编码的关系
参考链接先贴上来:https://blog.csdn.net/humadivinity/article/details/79403625https://www.cnblogs.com/kevin2ch ...
- 跟我一起学.NetCore之EF Core 实战入门,一看就会
前言 还记得当初学习数据库操作时,用ADO.NET一步一步地进行数据操作及查询,对于查询到的数据还得对其进行解析,然后封装返回给应用层:遇到这种重复而繁琐的工作,总有一些大神或团队对其进行封装,从而出 ...
- slam-g2o安装失败的解决问题
1.安装依赖项libqglviewer-dev出问题 原因: ubuntu16.04或者14.04不能直接sudo apt-get install libqglviewer-dev. 使用三个包来安装 ...