python如何实现图片转文字

 更新时间:2023年03月25日 09:18:50   作者:kaivis_new  
这篇文章主要介绍了python如何实现图片转文字问题,具有很好的参考价值,希望对大家有所帮助。如有错误或未考虑完全的地方,望不吝赐教

python图片转文字

用python+Tesseract-OCR做了一个图片转文字的小工具,GUI设计使用tkinter库的控件

界面及效果见下图:

#进一步优化  1. 底部添加label   2.对识别后的文本处理,去空格


from PIL import Image as PImage
from PIL import ImageTk
import pytesseract
from tkinter import *
from tkinter import filedialog
from tkinter.scrolledtext import ScrolledText
import re

# 将图片内容翻译为文字,显示在文本框内
def trans():
    contents.delete('1.0', END)
    transTxt = pytesseract.image_to_string(PImage.open(filePath.get()),lang='chi_sim')
    #对transTxt进行处理  去空格,换行符去重
    transTxt = transTxt.strip('\n\r')   #无参数可以删除开头结尾的空格\n\t\r
    print(transTxt)
    contents.insert( INSERT, transTxt.replace(' ','').replace('\n\n','\n').replace('\r',''))

#打开图片文件,显示路径,并将图片展现
def openfile():
    filename.delete('1.0', END)
    filePath.set(filedialog.askopenfilename())
    filename.insert(1.0,filePath.get())
    org_img = PImage.open(filePath.get())
    #调整图片显示大小 600*800
    w,h = org_img.size
    if w>600:
        h=int(h*600/w)
        w=600
    if h>800:
        w=int(w*800/h)
        h=800
    img = ImageTk.PhotoImage(org_img.resize((w,h)))
    showPic.config(image=img)
    showPic.image = img       #保持一个引用才能显示图片,tkinter的BUG
    

#设置主窗口
top = Tk()
top.title("OCR图片转文字  引擎:Tesseract-OCR  Made by: kaivis")
#top.iconbitmap("./pic/y1.ico")
top.geometry("1200x800")

filePath=StringVar()

bt_img1 = ImageTk.PhotoImage( file= "./pic/Outbox1.png")
bt_img2 = ImageTk.PhotoImage( file= "./pic/bt_img2.png")

#第一个窗体
frame1 = Frame (top, relief=RAISED, borderwidth=2)
frame1.pack(side=TOP, fill=BOTH,  ipady=5, expand=0)
Label(frame1,height=1,text="图片路径:").pack(side=LEFT)
filename = Text(frame1,height=2)
filename.pack(side=LEFT,padx=1, pady=0,expand=True, fill=X)
Button(frame1,text="打开文件", image=bt_img1, command=openfile).pack(side=LEFT,padx=5, pady=0)
Button(frame1,text="中文识别", image=bt_img2, command=trans).pack(side=LEFT,padx=5, pady=0)

#第二个窗体
frame2 = Frame (top, relief=RAISED, borderwidth=2)
frame2.pack (side=LEFT, fill=BOTH,  expand=1)
Label(frame2,text='图片显示:',borderwidth=5).pack(side=TOP,padx=20,pady=5)
showPic = Label(frame2,text='图片显示区')
showPic.pack(side=BOTTOM,expand=1,fill=BOTH)

#第三个窗体
frame3 = Frame (top)
frame3.pack (side=RIGHT, fill=BOTH,  expand=1)
#contents = ScrolledText(frame3)
Label(frame3,text='识别结果:',borderwidth=5).pack(side=TOP,padx=20,pady=10)
contents = Text(frame3,font=('Arial',15))
contents.pack(side=TOP,expand=1,fill=BOTH)
Label(frame3,text='Copyright 2021 baidu.com ALL Rights Reserved',borderwidth=5).pack(side=BOTTOM,padx=20,pady=10)

top.mainloop()

存在的问题:

  • 识别率不高,对紧密型的汉字更是难以做到较高的准确率,有没有更好的OCR引擎呢
  • 识别后的文字已经做了去空格处理 ,文本可以进一步优化,特别是多余的换行符需要处理

python截图转文字功能

由于在网上找资料时,经常遇到文章无法复制的情况,为了能够快速copy想要的文字,于是就想写一个python程序去实现截图转文字的功能。

1. 思路

首先要有记录键盘的功能(让程序知道你在截图) - keyboard库截图后需要接收图像 - ImageGrab库获取图像后要进行文字识别 - 百度AI文字识别API

2. 实现

2.1 导入相关库

2.2 创建类,并编写实现截图保存的函数

由于我使用的是win10自带的截图软件,所以截图热键为‘win+shift+s’,大家可以根据截图软件的不同自由更改。

2.3 编写图片转文字的函数

先去百度智能云官网申请一个图像识别的API。

将参数写入程序:

编写转文字函数:

2.5 运行

使用时创建类,调用两个函数即可:

2.6 效果

运行程序,随意在百度文库的一篇文章里截一张图:

结果如下:

注意:

由2.6运行结果可知,效果还是不错的。完美解决了我当前的需求。

总结

以上为个人经验,希望能给大家一个参考,也希望大家多多支持脚本之家。

相关文章

  • numpy的squeeze函数使用方法

    numpy的squeeze函数使用方法

    这篇文章主要介绍了numpy的squeeze函数使用方法,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧
    2021-03-03
  • 使用pyshp包进行shapefile文件修改的例子

    使用pyshp包进行shapefile文件修改的例子

    今天小编就为大家分享一篇使用pyshp包进行shapefile文件修改的例子,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
    2019-12-12
  • Python-pip配置国内镜像源快速下载包的方法详解

    Python-pip配置国内镜像源快速下载包的方法详解

    pip如果不配置国内镜像源的话,下载包的速度非常慢,毕竟默认的源在国外呢,这篇文章主要介绍了Python-pip配置国内镜像源快速下载包的方法详解,需要的朋友可以参考下
    2024-01-01
  • 天翼开放平台免费短信验证码接口使用实例

    天翼开放平台免费短信验证码接口使用实例

    天翼开放平台提供了一个免费的短信验证码API,下面看看使用方法吧,我们用python开发接口
    2013-12-12
  • tensorflow基于CNN实战mnist手写识别(小白必看)

    tensorflow基于CNN实战mnist手写识别(小白必看)

    这篇文章主要介绍了tensorflow基于CNN实战mnist手写识别(小白必看),文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧
    2020-07-07
  • 为了顺利买到演唱会的票用Python制作了自动抢票的脚本

    为了顺利买到演唱会的票用Python制作了自动抢票的脚本

    大麦网,是中国综合类现场娱乐票务营销平台,业务覆盖演唱会、 话剧、音乐剧、体育赛事等领域。但是因为票数有限,还有黄牛们不能丢了饭碗,所以导致了,很多人都抢不到票,那么,今天带大家用Python来制作一个自动抢票的脚本小程序
    2021-10-10
  • python中的数据结构比较

    python中的数据结构比较

    这篇文章主要介绍了python中的数据结构比较,本文给大家介绍的非常详细,具有一定的参考借鉴价值,需要的朋友可以参考下
    2019-05-05
  • python 连接sqlite及简单操作

    python 连接sqlite及简单操作

    本文通过实例代码给大家介绍了python 连接sqlite及简单操作,非常不错,具有参考借鉴价值,需要的朋友参考下吧
    2017-06-06
  • 详解Python如何实现惰性导入-lazy import

    详解Python如何实现惰性导入-lazy import

    如果你的 Python 程序程序有大量的 import,而且启动非常慢,那么你应该尝试懒导入,本文分享一种实现惰性导入的一种方法,需要的可以参考一下
    2022-10-10
  • Python使用定时调度任务的方式

    Python使用定时调度任务的方式

    Python 有几种方法可以定时调度一个任务,这就是我们将在本文中学习的内容。接下俩下边将给大家介绍5种Python使用定时调度任务方式,需要的朋友可以参考下面文章内容吧
    2021-09-09

最新评论