python+Tesseract-OCR实现OCR识别

python+Tesseract-OCR实现OCR识别

  • 1、下载地址如下:
  • 2、安装完毕后,配置环境变量(本次安装在了C盘)
  • 3、测试安装是否成功:
  • 4、在python环境中安装依赖包:
  • 5、修改相关文件路径
  • 6、python调用代码如下:
  • 7、在ubuntu环境中安装:
    • 1、apt-get安装方式
    • 2、源码编译安装方式

1、下载地址如下:

https://digi.bib.uni-mannheim.de/tesseract/

2、安装完毕后,配置环境变量(本次安装在了C盘)

C:\Program Files (x86)\Tesseract-OCR

3、测试安装是否成功:

tesseract -v进行测试
tesseract XXX.png 得到结果 

4、在python环境中安装依赖包:

pip install pytesseract

5、修改相关文件路径

找到
anaconda——>lib——>site-packges——>pytesseract 下的pytesseract.py
修改:

tesseract_cmd 修改为绝对路径即可,否则会报错
python+Tesseract-OCR实现OCR识别_第1张图片

6、python调用代码如下:

# https://digi.bib.uni-mannheim.de/tesseract/
# 配置环境变量如E:\Program Files (x86)\Tesseract-OCR
# tesseract -v进行测试
# tesseract XXX.png 得到结果 
# pip install pytesseract
# anaconda lib site-packges pytesseract pytesseract.py
# tesseract_cmd 修改为绝对路径即可
from PIL import Image
import pytesseract
import cv2
import os

preprocess = 'blur' #thresh

image = cv2.imread('test11.jpg')
gray = cv2.cvtColor(image, cv2.COLOR_BGR2GRAY)

if preprocess == "thresh":
    gray = cv2.threshold(gray, 0, 255,cv2.THRESH_BINARY | cv2.THRESH_OTSU)[1]

if preprocess == "blur":
    gray = cv2.medianBlur(gray, 3)
    
filename = "{}.png".format(os.getpid())
cv2.imwrite(filename, gray)
    
text = pytesseract.image_to_string(Image.open(filename))
print(text)
os.remove(filename)

cv2.imshow("Image", image)
cv2.imshow("Output", gray)
cv2.waitKey()
cv2.destroyAllWindows()

原图如下所示:
python+Tesseract-OCR实现OCR识别_第2张图片

7、在ubuntu环境中安装:

1、apt-get安装方式

如果你使用的是Ubuntu系统:可以自动安装,一键完成(但是版本就不一定是最新的,你可以在后面指定版本==4.0试试。)

sudo apt-get install tesseract-ocr

在这里插入图片描述

2、源码编译安装方式

参考:
参考博文连接

你可能感兴趣的:(openCV,OCR,opencv,计算机视觉,人工智能)