
发布时间:2021-02-23 13: 56: 08
PDF文档包含了图像型PDF(比如由扫描生成的文件,包含图像层)与文本型PDF(比如由word生成的文件)的文档类型,其区别在于是否可作文本的搜索。随着技术的发展以及人们需求的提升,很多人都需要从图像型PDF中获取文本信息,在这种情况下,双层PDF就应运而生了。
双层PDF实际上是在图像型PDF基础上,建立一个文本识别层,该文本层包含了可搜索的文本信息,我们可复制、搜索其中的文本。ABBYY FineReader PDF 15提供了制作双层PDF的功能,那么,该怎么使用呢?
一、使用OCR编辑器功能
双层PDF的制作,实际上就是进行图像智能文本识别的过程。因此,我们需要使用到ABBYY FineReader PDF 15的OCR智能文本识别技术。
如图2所示,在ABBYY FineReader PDF 15的创建任务页面使用“在OCR编辑器中打开”的功能,即可使用其“PDF文档和图像的高级转换功能”。
二、识别图像中的文本
使用OCR编辑器打开目标图像型PDF文件后,ABBYY FineReader PDF 15会自动开启OCR文本识别,该过程会花费一些时间。
待软件完成图像的文本识别后,如图4所示,就可以在软件右侧的文本识别区域获取到识别后的文本。
我们需要检查一下文本是否有识别错误。一般情况下,ABBYY FineReader PDF 15能达到很高的文本识别准确度,只有个别特殊符号可能会无法识别,但为了确保文档的严谨性,我们最好还是检查一下。
三、另存为可搜索PDF文档
确认文本识别无误后,如图5所示,打开文件菜单中的另存为选项,并选择其中的另存为“可搜索PDF文档”,即可创建双层PDF文档。
完成双层PDF文档的制作,如图6所示,打开PDF文档,可以看到,文本已经变为可选的状态,我们可对这些文本进行复制、搜索等。
四、小结
ABBYY FineReader PDF 15的智能OCR文本识别功能,可快速地将图像型的PDF文档转换为带有文本层的可搜索PDF文档,实现文档的更有效利用,避免了人工抄写的繁琐,是一个很实用的功能。
作者:泽洋
展开阅读全文
︾
读者也喜欢这些内容:
Word转PDF怎么不分页 Word转PDF怎么保留导航
有许多平台上传文件时都不能直接上传文档格式,而是要求上传PDF格式,然而PDF格式的文件又不能直接进行编辑,因此我们需要将Word文档格式转换成PDF格式之后才能提交。但这也引发了一系列的问题,例如转换成Word文档后存在空白页、转换后格式发生变化等情况,今天我们就来说一说Word转PDF怎么不分页,Word转PDF怎么保留导航。...
阅读全文 >
ABBYY FineReader PDF 安装、激活、换机教程
ABBYY FineReader PDF 是一款专业的OCR文字识别软件,ABBYY基于AI的OCR技术,在现代工作环境中使各种文档的数字化、检索、编辑、保护、共享和协作变得更容易。减少了由多种原因导致的效率低下,不可访问、不可查找的文档和信息;涉及纸面文档和数字文档混合的工作流;以及需要使用多个软件应用程序的任务。那么当你购买了ABBYY FineReader PDF之后,当想需要换电脑的时候,怎么才能完成ABBYY安装、激活、换机操作呢,下面本篇文章就来为大家解答一下相关步骤。...
阅读全文 >
几款常用的OCR文字识别软件
图片文字提取软件是什么呢?随着大家的办公需求的加大,现在已经有很多的办公软件出现了,那么,图片文字提取软件便是其中的一种,因为现在制作图片的要求也比较高,所以,在图片上加入文字也是很正常的事情,那么,怎么样才能够直接将图片中的文字提取出来呢?...
阅读全文 >
pdf单层和双层的区别 pdf单层怎么转双层
很多文档会保存为pdf格式,以保证准确性。但是由于文档版本的更新,内容可能也会做出相应的调整,那么此时就需要编辑文档了。有没有办法既保存源文档又可以编辑呢?那就是双层pdf了。pdf单层和双层的区别是什么?pdf单层又怎么转双层呢?...
阅读全文 >