Opencv 图片的OCR识别的实战示例


Posted in Python onMarch 02, 2021

一、图片变换

0、导入模块

导入相关函数,遇到报错的话,直接pip install 函数名。

import numpy as np
import argparse
import cv2

参数初始化

ap = argparse.ArgumentParser()
ap.add_argument("-i", "--image", required = True,
  help = "Path to the image to be scanned") 
args = vars(ap.parse_args())

Parameters:

--image images\page.jpg

1、重写resize函数

def resize(image, width=None, height=None, inter=cv2.INTER_AREA):
  dim = None
  (h, w) = image.shape[:2]
  if width is None and height is None:
   return image
  if width is None:
   r = height / float(h)
   dim = (int(w * r), height)
  else:
   r = width / float(w)
   dim = (width, int(h * r))
  resized = cv2.resize(image, dim, interpolation=inter)
  return resized

2、预处理

读取图片后进行重置大小,并计算缩放倍数;进行灰度化、高斯滤波以及Canny轮廓提取

image = cv2.imread(args["image"])
ratio = image.shape[0] / 500.0
orig = image.copy()
image = resize(orig, height = 500)
gray = cv2.cvtColor(image, cv2.COLOR_BGR2GRAY)
gray = cv2.GaussianBlur(gray, (5, 5), 0)
edged = cv2.Canny(gray, 75, 200)

3、边缘检测

检测轮廓并排序,遍历轮廓。

cnts = cv2.findContours(edged.copy(), cv2.RETR_LIST, cv2.CHAIN_APPROX_SIMPLE)[0]# 轮廓检测
cnts = sorted(cnts, key = cv2.contourArea, reverse = True)[:5]#保留前5个轮廓

# 遍历轮廓
for c in cnts:
  # 计算轮廓近似
  peri = cv2.arcLength(c, True)# 计算轮廓长度,C表示输入的点集,True表示轮廓是封闭的
  #(C表示输入的点集,epslion判断点到相对应的line segment 的距离的阈值,曲线是否闭合的标志位)
  approx = cv2.approxPolyDP(c, 0.02 * peri, True)

  # 4个点的时候就拿出来
  if len(approx) == 4:
   screenCnt = approx
   break

4、透视变换

画出近似轮廓,透视变换,二值处理

cv2.drawContours(image, [screenCnt], -1, (0, 255, 0), 2)
warped = four_point_transform(orig, screenCnt.reshape(4, 2) * ratio)#透视变换

# 二值处理
warped = cv2.cvtColor(warped, cv2.COLOR_BGR2GRAY)
ref = cv2.threshold(warped, 100, 255, cv2.THRESH_BINARY)[1]
cv2.imwrite('scan.jpg', ref)

二、OCR识别

0、安装tesseract-ocr

链接: 下载

在环境变量、系统变量的Path里面添加安装路径,例如:E:\Program Files (x86)\Tesseract-OCR

tesseract -v#打开命令行,进行测试
tesseract XXX.png result#得到结果 
pip install pytesseract#安装依赖包

打开python安装路径里面的python文件,例如C:\ProgramData\Anaconda3\Lib\site-packages\pytesseract\pytesseract.py
将tesseract_cmd 修改为绝对路径即可,例如:tesseract_cmd = ‘C:/Program Files (x86)/Tesseract-OCR/tesseract.exe'

1、导入模块

from PIL import Image
import pytesseract
import cv2
import os

2、预处理

读取图片、灰度化、滤波

image = cv2.imread('scan.jpg')
gray = cv2.cvtColor(image, cv2.COLOR_BGR2GRAY)
gray = cv2.medianBlur(gray, 3)

3、输出结果

filename = "{}.png".format(os.getpid())
cv2.imwrite(filename, gray)  
text = pytesseract.image_to_string(Image.open(filename))
print(text)
os.remove(filename)

到此这篇关于Opencv 图片的OCR识别的实战示例的文章就介绍到这了,更多相关Opencv 图片的OCR识别内容请搜索三水点靠木以前的文章或继续浏览下面的相关文章希望大家以后多多支持三水点靠木!

Python 相关文章推荐
python批量提交沙箱问题实例
Oct 08 Python
Python中的闭包详细介绍和实例
Nov 21 Python
python爬虫爬取淘宝商品信息(selenum+phontomjs)
Feb 24 Python
详解Python 装饰器执行顺序迷思
Aug 08 Python
Python tkinter的grid布局及Text动态显示方法
Oct 11 Python
pandas对dataFrame中某一个列的数据进行处理的方法
Jul 08 Python
Python tkinter实现图片标注功能(完整代码)
Dec 08 Python
pytorch 数据处理:定义自己的数据集合实例
Dec 31 Python
Matplotlib绘制雷达图和三维图的示例代码
Jan 07 Python
Ubuntu中配置TensorFlow使用环境的方法
Apr 21 Python
pyCharm 设置调试输出窗口中文显示方式(字符码转换)
Jun 09 Python
Python 实现RSA加解密文本文件
Dec 30 Python
python实现控制台输出颜色
Mar 02 #Python
python 如何在测试中使用 Mock
Mar 01 #Python
python装饰器代码深入讲解
Mar 01 #Python
Pytorch如何切换 cpu和gpu的使用详解
Mar 01 #Python
python爬取股票最新数据并用excel绘制树状图的示例
Mar 01 #Python
python中openpyxl和xlsxwriter对Excel的操作方法
Mar 01 #Python
python中random模块详解
Mar 01 #Python
You might like
PHP SPL标准库之数据结构栈(SplStack)介绍
2015/05/12 PHP
PHP封装mysqli基于面向对象的mysql数据库操作类与用法示例
2019/02/25 PHP
Yii2框架自定义类统一处理url操作示例
2019/05/25 PHP
捕获关闭窗口的脚本
2009/01/10 Javascript
Javascript和Ajax中文乱码吐血版解决方案
2009/12/21 Javascript
jQuery中需要注意的细节问题小结
2011/12/06 Javascript
JS继承--原型链继承和类式继承
2013/04/08 Javascript
Node.js和PHP根据ip获取地理位置的方法
2014/03/14 Javascript
用nodejs实现PHP的print_r函数代码
2014/03/14 NodeJs
详谈JavaScript内存泄漏
2014/11/14 Javascript
jquery实现图片随机排列的方法
2015/05/04 Javascript
js闭包引起的事件注册问题介绍
2016/03/29 Javascript
Node.js 应用跑得更快 10 个技巧
2016/04/03 Javascript
浅谈Angular中ngModel的$render
2016/10/24 Javascript
vue 实现 tomato timer(蕃茄钟)实例讲解
2017/07/24 Javascript
vue-cli脚手架build目录下utils.js工具配置文件详解
2018/09/14 Javascript
原生js实现表格循环滚动
2020/11/24 Javascript
[04:50]2019DOTA2高校联赛秋季赛四强集锦
2019/12/27 DOTA
[46:47]完美世界DOTA2联赛PWL S2 FTD vs Magma 第二场 11.20
2020/11/23 DOTA
zbar解码二维码和条形码示例
2014/02/07 Python
python多线程threading.Lock锁用法实例
2014/11/01 Python
python实现给微信公众号发送消息的方法
2017/06/30 Python
python matplotlib 注释文本箭头简单代码示例
2018/01/08 Python
python3.7 sys模块的具体使用
2019/07/22 Python
Python编译为二进制so可执行文件实例
2019/12/23 Python
Keras SGD 随机梯度下降优化器参数设置方式
2020/06/19 Python
css3中新增的样式使用示例附效果图
2014/08/19 HTML / CSS
韩国三星集团旗下时尚品牌官网:SSF SHOP
2016/08/02 全球购物
简历里的自我评价范文
2014/02/24 职场文书
2014年五四青年节活动策划书
2014/04/22 职场文书
政府个人对照检查材料思想汇报
2014/10/08 职场文书
2014年房地产个人工作总结
2014/12/20 职场文书
先进个人事迹材料
2014/12/29 职场文书
稽核岗位职责范本
2015/04/13 职场文书
Go缓冲channel和非缓冲channel的区别说明
2021/04/25 Golang
Python 类,对象,数据分类,函数参数传递详解
2021/09/25 Python