介绍使用 python 进行图像的文字识别,将图像中的文字提取出来,能够帮助咱们完成不少有趣的事情。python
下载地址: https://github.com/UB-Mannheim/tesseract/wikigit
tesseract-ocr 是一个开源的图片OCR识别库, 功能及其强大,支持多国语言。github
更高级的用法,它还支持机器学习算法,经过训练的方式,使OCR识别更加智能化及准确。算法
使用安装 pytesseract 和 pillow 库:机器学习
pip install pytesseract pip install pillow
使用 python 配合 tesseract 识别文字中的图像能够很是简单,几行代码就能够搞定。工具
例如,识别下面这张图片:
学习
首先导入 pytesseract 和 pillow 库code
import pytesseract from PIL import Image
而后指定 tesseract 目录:blog
pytesseract.pytesseract.tesseract_cmd = 'f:/tessert/tesseract.exe'
而后使用 pillow 库加载图片:图片
img = Image.open('test.png')
最后使用 tesseract 识别图像的文字:
text = pytesseract.image_to_string(img, lang='chi_sim') print(text)
最后的结果是:
能够看到,有误差,可是基本上都识别出来了。
这里只是入门级的介绍,固然还有问题,好比彩色图像识别通常效果很差,对比度低的图像识别也不必定好,这就须要咱们对图片进行处理后再来识别。好比提取灰度图片,锐化图片等操做,具体涉及到的是数字图像处理的领域了,这个后面有机会再讨论。