python识别文字(基于tesseract)代码实例

时间：2021-05-22

这篇文章主要介绍了python识别文字(基于tesseract)代码实例,文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下

Ubuntu版本：

1.tesseract-ocr安装

sudo apt-get install tesseract-ocr

2.pytesseract安装

sudo pip install pytesseract

3.Pillow 安装

sudo pip install pillow

开始写代码：

from PIL import Imagefrom pytesseract import pytesseractimage = Image.open('test.png')code = pytesseract.image_to_string(image,lang='chi_sim')print(code)

报错了：

找到路径，发现没有chi_sim.traineddata这个训练包

# 安装训练数据(equ为数学公式包)sudo apt-get install tesseract-ocr-eng tesseract-ocr-chi-sim tesseract-ocr-equ

安装之后就会有训练包了，可以正常运行。

英文识别正确率较高，中文就比较鸡肋了。

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持。

声明：本页内容来源网络，仅供用户参考；我单位不保证亦不表示资料全面及准确无误，也不保证亦不表示这些资料为最新信息，如因任何原因，本网内容或者用户因倚赖本网内容造成任何损失或损害，我单位将不会负任何法律责任。如涉及版权问题，请提交至online#300.cn邮箱联系删除。

python识别文字(基于tesseract)代码实例

相关文章

python实现简单的文字识别

Python基于百度云文字识别API

Python3一行代码实现图片文字识别的示例

Windows下Java调用OCR进行图片识别

Python基于OpenCV库Adaboost实现人脸识别功能详解