扫描件转可编辑文字的方法
拍照、扫描得到的 PDF 整页都是图片:搜不了、复制不了、更改不了字。PDFelement 的文字识别(OCR)就是给这种文件补上一层文字——识别完之后全文可搜、文字可复制、点开就能改。
功能与获取入口的整理见 PDFelement 使用参考站。
什么样的文件需要识别
先确认手里的是不是扫描件,别白跑一遍:
- 相机拍的、扫描仪扫的、聊天工具里收到的「图片转 PDF」,基本都是整页图片;
- 编辑模式下点一下文字选不中,放大后文字边缘发虚、带扫描噪点,就是图片型页面;
- 从 Word、网页导出的 PDF 自带文字层,不需要识别,直接改就行,见 手机上怎么编辑 PDF 文字。
识别步骤
- 打开这份扫描件;
- 在工具区找到「OCR / 文字识别」入口;
- 选识别语言——语言要与文件正文一致,选错语言是识别出乱码最常见的原因;
- 等识别完成,应用会生成一层可搜索的文字层;
- 之后这份文件就能全文搜索、复制文字、直接改字。
识别质量的把控
识别效果七分在原件、三分在操作:
| 环节 | 做法 |
|---|---|
| 拍摄 | 光线均匀、对焦清晰、页面拍正、整页入镜 |
| 原件 | 打印体识别好于手写体;字太小的先放大再扫 |
| 语言 | 与正文一致;混排文件选主语言 |
| 识别后 | 通读一遍再交付,重点核对数字、人名、金额 |
识别不出来怎么排查
- 手写内容识别效果普遍不好,重要手写件建议人工誊录;
- 模糊、歪斜的页面,重拍比反复识别有用;
- 识别后仍是图片:确认选的是「识别」而不是「扫描成 PDF」——后者只是把照片变成 PDF,不做文字识别;
- OCR 属于付费能力,没开通时点进去会提示升级,免费与付费的边界在站点里有更细的整理,见 PDFelement 使用参考站。
改字的前置判断与编辑步骤见 手机上怎么编辑 PDF 文字。