zoukankan      html  css  js  c++  java
  • python识别图片文字

    因为学校要求要刷一门叫《包装世界》的网课,而课程里有200多道选择题,而且只能在手机完成,网页版无法做题,而看视频是不可能看视频的,这辈子都不可能看...所以写了几行代码来进行百度搜答案

    思路如下:

    1. 手机屏幕投影到电脑上;
    2. 截图并识别图片文字;
    3. 调用百度来进行搜索;
    4. 提取html关键字。

    环境配置:python3.6、第三方库:pyautogui、PIL、pytesseract、识别引擎tesseract-ocr

    要识别中文,ocr引擎要下载一个中文包chi_sim放进Tesseract-OCR essdata里面。安装完ocr后还要配置一下调用路径,在Python36Libsite-packagespytesseract找到pytesseract.py(这是我的windows路径),打开在里面添加一下路径:

    1 # CHANGE THIS IF TESSERACT IS NOT IN YOUR PATH, OR IS NAMED DIFFERENTLY
    2 tesseract_cmd = 'tesseract'
    3 tesseract_cmd = 'C:/Program Files (x86)/Tesseract-OCR/tesseract.exe'
    4 img_mode = 'RGB'

    然后用AirDroid或者Vysor、360手机助手之类的将手机的屏幕投影到电脑上,用鼠标确定截图坐标,代码如下:

    1 import pyautogui as pag
    2 x,y = pag.position()
    3 posStr = "position:"+str(x).rjust(4)+','+str(y).rjust(4)
    4 print(posStr)

    要获取两个坐标(截图开始坐标和结束坐标),然后利用获取的坐标运用如下代码截图并调用ocr引擎识别(识别出来的字是每个用空格分开的,所以要去除字符串中的空格),代码如下:

     1 from PIL import Image
     2 from PIL import ImageGrab
     3 import pytesseract
     4 import webbrowser
     5 
     6 pos = (0,245,425, 327)
     7 cut_img = ImageGrab.grab(pos)
     8 cut_img.save('C:/imgSave/1.jpg') #保存截图到文件夹中
     9 print("screenshots sucess")
    10 
    11 text=pytesseract.image_to_string(Image.open('C:/imgSave/1.jpg'),lang='chi_sim') #调用识别引擎识别
    12 text=text.replace(" ","") #去空格
    13 print(text)
    14 url = 'http://www.baidu.com/s?wd=%s' % text #调用百度搜索
    15 webbrowser.open(url)

    最终因为搜出来的全是题库,所以就没有提取html关键字了,其实是懒

  • 相关阅读:
    高效 Java Web 开发框架 JessMA v3.2.3 正式发布
    跨平台日志清理工具 Log-Cutter v2.0.1 RC-1 发布
    跨平台日志清理工具 Log-Cutter v1.0.3 正式发布
    高性能 Windows Socket 组件 HP-Socket v2.2.3 正式发布
    7. Oracle数据加载和卸载
    6. Oracle闪回特性
    5. RAMN备份与恢复
    4. Oracle数据库用户管理备份与恢复
    3. Oracle数据库逻辑备份与恢复
    后台系统依据路由生成tabs标签页
  • 原文地址:https://www.cnblogs.com/guolao/p/8900661.html
Copyright © 2011-2022 走看看