python 使用tesseract-ocr将网站验证码接口返回的base64字符串转存图片文件后识别出来,识别成功率80%以上
第一步:安装引入对应的的包(导入时发现没有的包,走pip install **等命令安装)
import pytesseract
from PIL import Image # 图形处理的库 # 注意:如果是"data:image/jpg:base64,",那你保存的就要以png格式,如果是"data:image/png:base64,"那你保存的时候就以jpg格式。
import json
import base64
import requests # 请求url
第二步:安装tesseract-ocr-setup-4.00.00dev;(此步骤极为关键,直接关乎识别的成败,请仔细按照下方链接进行操作。)
下载及安装使用链接:https://blog.csdn.net/qq_37193537/article/details/81335165;
第三步:编写和运行调试相关代码
import pytesseract
from PIL import Image # 图形处理的库
# 注意:如果是"data:image/jpg:base64,",那你保存的就要以png格式,如果是"data:image/png:base64,"那你保存的时候就以jpg格式。
import json
import base64
# 请求url
import requests
url = "http://192.168.253.185/api/preposition/system/image" #内网地址,请替换为用户需要使用的验证码接口地址
# 请求头根据自己需要的内容来设置
headers = {

本文介绍了如何使用Python结合tesseract-ocr将网站验证码接口返回的Base64字符串转存为图片并进行识别,识别成功率高达80%以上。主要步骤包括安装必要的包,如pytesseract和PIL,安装tesseract-ocr软件,并提供了一个简单的代码示例,展示了从Base64解码到图像识别的过程。

2121

被折叠的 条评论
为什么被折叠?



