如何从图片和扫描文档中提取文字(OCR)

从照片或扫描图片中提取可编辑文字,比以前方便多了。以下是利用手边现有工具就能完成的方法。

  1. 使用手机相机自带的文字识别功能

    现在大多数手机相机或相册应用,都能直接在取景画面或已保存的照片中识别文字,不需要额外安装应用就能直接选中、复制、粘贴。

  2. 临时提取用Google Lens最方便

    用Google Lens对准镜头前或已有图片中的文字,可以立即识别并复制、翻译或搜索这段文字,适合不想安装或设置任何工具、只想快速提取一次的场景。

  3. 处理文档或PDF用浏览器端的免费OCR网站

    如果要处理的是整份扫描文档或PDF,而不是单张照片,专门的OCR网站可以一次性处理整份文件,并导出为可编辑文字或可搜索的PDF。

  4. 使用办公软件自带的OCR功能

    Microsoft OneNote、Google文档(通过"用Google文档打开"处理图片或扫描版PDF)等软件都内置了OCR功能,可以直接融入日常使用的工作流程中提取文字。

  5. 识别效果不佳时先提升图片质量

    模糊、倾斜、低分辨率或低对比度的图片会明显拉低OCR识别准确率。在光线充足的地方重新拍摄、保持相机端正、避免反光,通常就能明显改善识别效果。

  6. 务必校对提取出的文字

    OCR偶尔会把形状相近的字符识别错(比如"0"和"O"、"l"和"1"),因此提取结果一定要检查一遍,尤其是数字、专有名词以及打算直接照搬使用的内容。

OCR实际上是怎么工作的

OCR软件并不是像人一样在"阅读"文字,而是分析图片中的形状和图案,并与已知的字符形状进行比对,预测最有可能对应的字母或数字。这也是为什么OCR在识别常见字体、印刷清晰的文字时表现很好,而遇到手写字、装饰性字体或质量较差的扫描件时,由于形状规律变得不明显,识别准确率会明显下降。

如何根据用途选择合适的OCR工具

如果只是想快速抓取一小段文字——路牌上的字、一句引用、一个电话号码——像Google Lens这样的即拍即用型工具最合适。如果需要批量处理很多页,或整份扫描文档,专门为批量文档设计的OCR工具或办公软件功能,通常会比逐张重复使用单图工具更快、更准确。

常见问题

照片明明很清晰,OCR为什么还是会识别错某些字符?

在很多字体中,一些字符的形状几乎一模一样,比如大写字母"I"、小写字母"l"和数字"1",因此即使图片很清晰,OCR偶尔也会把它们弄混。检查并修正识别结果是常规操作,并不代表工具出了问题。

OCR能识别手写文字吗?

基础版OCR主要针对印刷体文字设计,处理手写文字时效果明显较差。一些较新的工具加入了专门的手写识别功能,但准确率仍然明显低于印刷文字,字迹不够工整时尤其容易出错。