python识别图片文字

zoukankan html css js c++ java

python识别图片文字
因为学校要求要刷一门叫《包装世界》的网课，而课程里有200多道选择题，而且只能在手机完成，网页版无法做题，而看视频是不可能看视频的，这辈子都不可能看...所以写了几行代码来进行百度搜答案。

思路如下：
1. 手机屏幕投影到电脑上；
2. 截图并识别图片文字；
3. 调用百度来进行搜索；
4. 提取html关键字。
环境配置：python3.6、第三方库：pyautogui、PIL、pytesseract、识别引擎tesseract-ocr

要识别中文，ocr引擎要下载一个中文包chi_sim放进Tesseract-OCR essdata里面。安装完ocr后还要配置一下调用路径，在Python36Libsite-packagespytesseract找到pytesseract.py（这是我的windows路径），打开在里面添加一下路径：
1 # CHANGE THIS IF TESSERACT IS NOT IN YOUR PATH, OR IS NAMED DIFFERENTLY 2 tesseract_cmd = 'tesseract' 3 tesseract_cmd = 'C:/Program Files (x86)/Tesseract-OCR/tesseract.exe' 4 img_mode = 'RGB'
然后用AirDroid或者Vysor、360手机助手之类的将手机的屏幕投影到电脑上，用鼠标确定截图坐标，代码如下：
1 import pyautogui as pag 2 x,y = pag.position() 3 posStr = "position:"+str(x).rjust(4)+','+str(y).rjust(4) 4 print(posStr)
要获取两个坐标（截图开始坐标和结束坐标），然后利用获取的坐标运用如下代码截图并调用ocr引擎识别（识别出来的字是每个用空格分开的，所以要去除字符串中的空格），代码如下：
1 from PIL import Image 2 from PIL import ImageGrab 3 import pytesseract 4 import webbrowser 5 6 pos = (0,245,425, 327) 7 cut_img = ImageGrab.grab(pos) 8 cut_img.save('C:/imgSave/1.jpg') #保存截图到文件夹中 9 print("screenshots sucess") 10 11 text=pytesseract.image_to_string(Image.open('C:/imgSave/1.jpg'),lang='chi_sim') #调用识别引擎识别 12 text=text.replace(" ","") #去空格 13 print(text) 14 url = 'http://www.baidu.com/s?wd=%s' % text #调用百度搜索 15 webbrowser.open(url)
最终因为搜出来的全是题库，所以就没有提取html关键字了，其实是懒。
查看全文

相关阅读:
Maven打jar包
 windows关闭占用某端口的进程
 windows系统下发布python模块到pypi
【转】vmware 安装 osx 无法登录 appstore 的解决办法 (伪造smbios设备信息)
【转】Java并发编程：volatile关键字解析
 自定义JSP标签
 不一样的ssm
eclipse制作exe文件
 ftp服务器搭建及简单操作
 OC中的socket通信

原文地址：https://www.cnblogs.com/guolao/p/8900661.html

python识别图片文字

环境配置：python3.6、第三方库：pyautogui、PIL、pytesseract、识别引擎tesseract-ocr