python识别图片文字
因为学校要求要刷一门叫《包装世界》的网课,而课程里有200多道选择题,而且只能在手机完成,网页版无法做题,而看视频是不可能看视频的,这辈子都不可能看...所以写了几行代码来进行百度搜答案。
思路如下:
- 手机屏幕投影到电脑上;
- 截图并识别图片文字;
- 调用百度来进行搜索;
- 提取html关键字。
环境配置:python3.6、第三方库:pyautogui、PIL、pytesseract、识别引擎tesseract-ocr
要识别中文,ocr引擎要下载一个中文包chi_sim放进Tesseract-OCR\tessdata里面。安装完ocr后还要配置一下调用路径,在Python36\Lib\site-packages\pytesseract找到pytesseract.py(这是我的windows路径),打开在里面添加一下路径:
1 # CHANGE THIS IF TESSERACT IS NOT IN YOUR PATH, OR IS NAMED DIFFERENTLY 2 tesseract_cmd = 'tesseract' 3 tesseract_cmd = 'C:/Program Files (x86)/Tesseract-OCR/tesseract.exe' 4 img_mode = 'RGB'
然后用AirDroid或者Vysor、360手机助手之类的将手机的屏幕投影到电脑上,用鼠标确定截图坐标,代码如下:
1 import<span> pyautogui as pag 2 x,y =<span> pag.position() 3 posStr = "position:"+str(x).rjust(4)+','+str(y).rjust(4<span>) 4 print(posStr)
要获取两个坐标(截图开始坐标和结束坐标),然后利用获取的坐标运用如下代码截图并调用ocr引擎识别(识别出来的字是每个用空格分开的,所以要去除字符串中的空格),代码如下:
from PIL import Image from PIL import ImageGrab import pytesseract import webbrowser pos = (0,245,425, 327) cut_img = ImageGrab.grab(pos) cut_img.save('C:/imgSave/1.jpg') #保存截图到文件夹中 print("screenshots sucess") text=pytesseract.image_to_string(Image.open('C:/imgSave/1.jpg'),lang='chi_sim') #调用识别引擎识别 text=text.replace(" ","") #去空格 print(text) url = 'http://www.baidu.com/s?wd=%s' % text #调用百度搜索 webbrowser.open(url)
最终因为搜出来的全是题库,所以就没有提取html关键字了,其实是懒。
相关推荐
alanlonglong 2020-06-14
PeterHuang0 2020-05-26
chenzhx 2019-09-06
我心飞翔之家 2019-04-01
LHpython 2018-01-15
人工智能快报 2020-06-09
alanlonglong 2020-06-02
luoyouren 2019-10-29
Charliewolf 2019-10-22
IT互联网技术学习 2019-02-12
visionarywind 2019-02-12
Jasterwisdom 2019-07-01
LinBSoft 2019-07-01
nanqi 2019-06-28
我心飞翔之家 2019-05-04
AndroidAmelia 2019-03-11
一叶不知秋 2018-12-10
timcompp 2017-05-04
heshenhan 2018-04-07