python实现图像识别的示例代码

更新时间：2021年03月22日 09:54:37 作者：先知丨先觉

这篇文章主要介绍了python实现图像识别的示例代码，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧

一、安装库

首先我们需要安装PIL和pytesseract库。
PIL：（Python Imaging Library）是Python平台上的图像处理标准库，功能非常强大。
pytesseract：图像识别库。

我这里使用的是python3.6，PIL不支持python3所以使用如下命令

pip install pytesseract
pip install pillow

如果是python2，则在命令行执行如下命令：

pip install pytesseract
pip install PIL

这时候我们去运行上面的代码会发现如下错误：

错误提示的很明显：
No such file or directory ："tesseract"

这是因为我们没有安装tesseract-ocr引擎

二、tesseract-ocr引擎

光学字符识别(OCR,Optical Character Recognition)是指对文本资料进行扫描，然后对图像文件进行分析处理，获取文字及版面信息的过程。OCR技术非常专业，一般多是印刷、打印行业的从业人员使用，可以快速的将纸质资料转换为电子资料。关于中文OCR，目前国内水平较高的有清华文通、汉王、尚书，其产品各有千秋，价格不菲。国外OCR发展较早，像一些大公司，如IBM、微软、HP等，即使没有推出单独的OCR产品，但是他们的研发团队早已掌握核心技术，将OCR功能植入了自身的软件系统。对于我们程序员来说，一般用不到那么高级的，主要在开发中能够集成基本的OCR功能就可以了。这两天我查找了很多免费OCR软件、类库，特地整理一下，今天首先来谈谈Tesseract，下一次将讨论下Onenote 2010中的OCR API实现。可以在这里查看OCR技术的发展简史。
Tesseract的OCR引擎最先由HP实验室于1985年开始研发，至1995年时已经成为OCR业内最准确的三款识别引擎之一。然而，HP不久便决定放弃OCR业务，Tesseract也从此尘封。
数年以后，HP意识到，与其将Tesseract束之高阁，不如贡献给开源软件业，让其重焕新生－－2005年，Tesseract由美国内华达州信息技术研究所获得，并求诸于Google对Tesseract进行改进、消除Bug、优化工作。

###安装tesseract-ocr引擎

brew install tesseract

然后我们通过tesseract -v看一下是否安装成成功

tesseract 3.05.01
leptonica-1.75.0
libjpeg 9b : libpng 1.6.34 : libtiff 4.0.9 : zlib 1.2.11

这时候我们运行上面代码会出现乱码

这是因为tesseract默认只有语言包中没有中文包，如下图：

###安装tesseract-ocr语言包
我们去GitHub下载我们需要的语言包，这里我只下载了chi_tra.traineddata和chi_sim.traineddata
github：tesseract-ocr/tessdata
然后放到/usr/local/Cellar/tesseract/3.05.01/share/tessdata路径下面。

可以通过tesseract --list-langs查看本地语言包：

可以通过tesseract --help-psm 查看psm

0：定向脚本监测（OSD）
1：使用OSD自动分页
2 ：自动分页，但是不使用OSD或OCR（Optical Character Recognition，光学字符识别）
3 ：全自动分页，但是没有使用OSD（默认）
4 ：假设可变大小的一个文本列。
5 ：假设垂直对齐文本的单个统一块。
6 ：假设一个统一的文本块。
7 ：将图像视为单个文本行。
8 ：将图像视为单个词。
9 ：将图像视为圆中的单个词。
10 ：将图像视为单个字符。

为什么这里要强调语言包和psm，因为我们在使用中会用到，
比如多个语言包组合并且视为统一的文本块将使用如下参数：

pytesseract.image_to_string(image,lang="chi_sim+eng",config="-psm 6")

这里我们通过+来合并使用多个语言包。

接下来我们看一下配置好一切的正确结果。

import pytesseract
from PIL import Image

image = Image.open("../pic/c.png")
code = pytesseract.image_to_string(image,lang="chi_sim",config="-psm 6")
print(code)

此时大公告成。

到此这篇关于python实现图像识别的示例代码的文章就介绍到这了,更多相关python 图像识别内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家！

您可能感兴趣的文章:

Django中FilePathField字段的用法
这篇文章主要介绍了Django中FilePathField字段的用法，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2020-05-05
教你使用Psycopg2连接openGauss的方法
Psycopg是一种用于执行SQL语句的PythonAPI，可以为PostgreSQL、openGauss数据库提供统一访问接口，应用程序可基于它进行数据操作，这篇文章主要介绍了教你使用Psycopg2连接openGauss的方法,需要的朋友可以参考下
2022-11-11
python3.6.8 + pycharm + PyQt5 环境搭建的图文教程
这篇文章主要介绍了python3.6.8 + pycharm + PyQt5 环境搭建,本文通过图文并茂的形式给大家介绍的非常详细，对大家的学习或工作具有一定的参考借鉴价值，需要的朋友可以参考下
2020-06-06
python 基于selenium实现鼠标拖拽功能
这篇文章主要介绍了python 基于selenium实现鼠标拖拽功能的方法，帮助大家更好的理解和使用python，感兴趣的朋友可以了解下
2020-12-12
django框架创建应用操作示例
这篇文章主要介绍了django框架创建应用操作,结合实例形式分析了Django框架的安装、创建项目、创建数据库及创建应用相关操作技巧,需要的朋友可以参考下
2019-09-09
使用python scrapy爬取天气并导出csv文件
由于工作需要,将爬虫的文件要保存为csv,以前只是保存为json,下面这篇文章主要给大家介绍了关于如何使用python scrapy爬取天气并导出csv文件的相关资料,需要的朋友可以参考下
2022-08-08
Python实现的旋转数组功能算法示例
这篇文章主要介绍了Python实现的旋转数组功能算法,结合实例形式总结分析了数组旋转算法的原理与实现技巧,需要的朋友可以参考下
2019-02-02
Pytorch之parameters的使用
今天小编就为大家分享一篇Pytorch之parameters的使用，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2019-12-12
jupyter notebook 增加kernel教程
这篇文章主要介绍了jupyter notebook 增加kernel教程，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2020-04-04
Python实现获取视频时长功能
这篇文章主要介绍了Python如何实现获取视频时长功能，可以精确到毫秒。文中的示例代码简洁易懂，对我们的学习有一定的帮助，感兴趣的可以了解一下
2021-12-12

python实现图像识别的示例代码

一、安装库

二、tesseract-ocr引擎

相关文章

最新评论

大家感兴趣的内容

最近更新的内容

常用在线小工具