python批量识别图片指定区域文字内容

更新时间：2021年06月22日 11:50:18 作者：林圈圈的

这篇文章主要为大家详细介绍了python识别图片指定区域文字内容，文中示例代码介绍的非常详细，具有一定的参考价值，感兴趣的小伙伴们可以参考一下

Python批量识别图片指定区域文字内容，供大家参考，具体内容如下

简介

对于一张图片，需求识别指定区域的内容

1.截取原始图上的指定图片当做模板
2.根据模板相似度去再原始图片上识别准确坐标
3.根据坐标剪切出指定位置图片，也就是所需的内容区域
4.对指定位置图片进行ocr识别

环境

Ubuntu18.04
Python2.7

所需Python模块

1.aircv

用于识别模板再原始图的位置坐标

pip install aircv

2.Pillow

用于剪裁图片

pip install Pillow

3.Tesseract

文字识别
在此也可以用平台端的API进行更精准的识别
ubuntu下Tesseract环境安装

sudo apt-get install libpng12-dev 
sudo apt-get install libjpeg62-dev 
sudo apt-get install libtiff4-dev 
sudo apt-get install gcc 
sudo apt-get install g++ 
sudo apt-get install automake

1.tesseract-ocr安装

sudo apt-get install tesseract-ocr

2.pytesseract安装

pip install pytesseract

Python代码

识别对应位置

#!/usr/bin/python2.7 
# -*- coding: utf-8 -*- 
import aircv


def matchImg(imgsrc, imgobj, confidence=0.2):
 """
  图片对比识别imgobj在imgsrc上的相对位置（批量识别统一图片中需要的部分）
 :param imgsrc: 原始图片路径(str)
 :param imgobj: 待查找图片路径（模板）(str)
 :param confidence: 识别度（0<confidence<1.0）
 :return: None or dict({'confidence': 相似度(float), 'rectangle': 原始图片上的矩形坐标(tuple), 'result': 中心坐标(tuple)})
 """
 imsrc = aircv.imread(imgsrc)
 imobj = aircv.imread(imgobj)

 match_result = aircv.find_template(imsrc, imobj,
         confidence) # {'confidence': 0.5435812473297119, 'rectangle': ((394, 384), (394, 416), (450, 384), (450, 416)), 'result': (422.0, 400.0)}
 if match_result is not None:
  match_result['shape'] = (imsrc.shape[1], imsrc.shape[0]) # 0为高，1为宽

 return match_result

图片剪裁

#!/usr/bin/python2.7 
# -*- coding: utf-8 -*- 
from PIL import Image, ImageEnhance

def cutImg(imgsrc, out_img_name, coordinate):
 """
  根据坐标位置剪切图片
 :param imgsrc: 原始图片路径(str)
 :param out_img_name: 剪切输出图片路径(str)
 :param coordinate: 原始图片上的坐标(tuple) egg:(x, y, w, h) ---> x,y为矩形左上角坐标, w,h为右下角坐标
 :return:
 """
 image = Image.open(imgsrc)
 region = image.crop(coordinate)
 region = ImageEnhance.Contrast(region).enhance(1.5)
 region.save(out_img_name)

图片识别

#!/usr/bin/python2.7 
# -*- coding: utf-8 -*- 
import pytesseract
from PIL import Image

image = Image.open('bb.png')
code = pytesseract.image_to_string(image)
print（code）

对于三方API识别自行研究

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持脚本之家。

您可能感兴趣的文章:

Python Scrapy框架：通用爬虫之CrawlSpider用法简单示例
这篇文章主要介绍了Python Scrapy框架：通用爬虫之CrawlSpider用法,结合实例形式分析了Scrapy框架中CrawlSpider的基本使用方法,需要的朋友可以参考下
2020-04-04
Python 实现一个计时器
这篇文章主要介绍了Python 实现一个计时器的方法，文中讲解非常细致，代码帮助大家更好的理解和学习，感兴趣的朋友可以了解下
2020-07-07
Python Pandas读写txt和csv文件的方法详解
这篇文章主要为大家详细介绍了Python Pandas实现读写txt和csv文件查找的方法，文中的示例代码积极性，感兴趣的小伙伴可以跟随小编一起了解一下
2022-09-09
Python之 requests的使用（一）
requests是一个很实用的Python HTTP客户端库，爬虫和测试服务器响应数据时经常会用到，requests是Python语言的第三方的库，专门用于发送HTTP请求，使用起来比urllib简洁很多，这篇文章主要介绍requests的基础用法
2023-04-04
keras之权重初始化方式
这篇文章主要介绍了keras之权重初始化方式，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2020-05-05
用Python PIL实现几个简单的图片特效
这篇文章主要介绍了用Python PIL实现几个简单的图片特效，小编觉得挺不错的，现在分享给大家，也给大家做个参考。一起跟随小编过来看看吧
2019-01-01
Pycharm挂代理后依旧插件下载慢的完美解决方法
狠多朋友在使用Pycharm插件时，反应下载速度很慢，挂载了代理还是不够，怎么解决这一问题呢，下面小编给大家代理了Pycharm插件下载慢的完美解决方法，需要的朋友参考下吧
2021-08-08
Python递归实现汉诺塔算法示例
这篇文章主要介绍了Python递归实现汉诺塔算法,结合实例形式分析了汉诺塔算法的原理、实现步骤与相关操作技巧,需要的朋友可以参考下
2018-03-03
Python爬虫之正则表达式的使用教程详解
本文实例代码相结合给大家详细介绍了Python爬虫之正则表达式的使用，包括参数介绍，最常规的匹配，匹配目标，非常不错，具有一定的参考借鉴价值，需要的朋友参考下吧
2018-10-10
python将pandas datarame保存为txt文件的实例
今天小编就为大家分享一篇python将pandas datarame保存为txt文件的实例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2019-02-02