使用 Python 识别并提取图像中的文字

时间 2019-12-13

标签使用 python 识别提取图像文字栏目 Python 繁體版

原文原文链接

1. 介绍

介绍使用 python 进行图像的文字识别，将图像中的文字提取出来，能够帮助咱们完成不少有趣的事情。python

tesseract-ocr 是一个开源的图片OCR识别库，功能及其强大，支持多国语言。github

更高级的用法，它还支持机器学习算法，经过训练的方式，使OCR识别更加智能化及准确。算法

使用安装 pytesseract 和 pillow 库：机器学习

pip install pytesseract
pip install pillow

使用 python 配合 tesseract 识别文字中的图像能够很是简单，几行代码就能够搞定。工具

例如，识别下面这张图片：
学习

首先导入 pytesseract 和 pillow 库code

import pytesseract
from PIL import Image

而后指定 tesseract 目录：blog

pytesseract.pytesseract.tesseract_cmd = 'f:/tessert/tesseract.exe'

而后使用 pillow 库加载图片：图片

img = Image.open('test.png')

最后使用 tesseract 识别图像的文字:

text = pytesseract.image_to_string(img, lang='chi_sim')
print(text)

最后的结果是：

能够看到，有误差，可是基本上都识别出来了。

这里只是入门级的介绍，固然还有问题，好比彩色图像识别通常效果很差，对比度低的图像识别也不必定好，这就须要咱们对图片进行处理后再来识别。好比提取灰度图片，锐化图片等操做，具体涉及到的是数字图像处理的领域了，这个后面有机会再讨论。