软件使用手册合辑

扫描件转可编辑文字的方法

拍照、扫描得到的 PDF 整页都是图片:搜不了、复制不了、更改不了字。PDFelement 的文字识别(OCR)就是给这种文件补上一层文字——识别完之后全文可搜、文字可复制、点开就能改。

功能与获取入口的整理见 PDFelement 使用参考站。

什么样的文件需要识别

先确认手里的是不是扫描件,别白跑一遍:

识别步骤

  1. 打开这份扫描件;
  2. 在工具区找到「OCR / 文字识别」入口;
  3. 选识别语言——语言要与文件正文一致,选错语言是识别出乱码最常见的原因;
  4. 等识别完成,应用会生成一层可搜索的文字层;
  5. 之后这份文件就能全文搜索、复制文字、直接改字。

识别质量的把控

识别效果七分在原件、三分在操作:

环节做法
拍摄光线均匀、对焦清晰、页面拍正、整页入镜
原件打印体识别好于手写体;字太小的先放大再扫
语言与正文一致;混排文件选主语言
识别后通读一遍再交付,重点核对数字、人名、金额

识别不出来怎么排查

改字的前置判断与编辑步骤见 手机上怎么编辑 PDF 文字。

同站更多文档

  1. 手机上怎么编辑 PDF 文字