在网上看了很多用python进行文字识别的文章,就只有两个字的体会:乱、差。因为很多模块,我都不知道怎么安装,弄得焦头烂额,反而因此浪费了很多时间,而且到最后也是没能成功。
在文章中插入大量BUG,让你主动去找茬,会浪费你很多流量和时间。
因此,本文,我推荐大家使用百度AI的文字识别功能,优点是:快、准、简洁。

工具/原料
电脑
python
方法/步骤
1
准备一张图片a.jpg。
我就就地取材了,直接截图。

2
安装baidu-aip模块。

3
编辑python代码:
先导入两个模块——AipOcr和re。
from aip import AipOcr
import re
运行之后,没有报错,就说明baidu-aip模块安装成功了。

4
输入你的文字识别应用的APPID、APPKEY,还有SECRET KEY。
具体的获得APPID、APPKEY、SECRET KEY的方法,请参阅《python怎么调用百度AI的语音合成功能?》。
每人每天有500次的免费使用文字识别的机会,所以我的APPID、APPKEY、SECRET KEY要保密。

5
往python里面加载图片。
注意,这里用的是绝对路径,并在路径前面加字母r,防止转义。

6
读取图片信息,并输出信息。
此时,得到的信息,是把图片转化为二进制形式的数据。
img = i.read()
print(img)
这一步,建议大家不要print,因为数据量过大,会导致电脑死机。

7
用client.basicGeneral(img)来获取一组信息。
message = client.basicGeneral(img);
print(message)
此时的message是一个字典。

8
message.get('words_result')给出识别的文字的字典的列表。

9
只输出图中的文字:
for i in message.get('words_result'):
print(i.get('words'))

10
整个代码不过才11行。

END
注意事项
用百度AI的文字识别,比国外的各种模块方便多了。最主要的是,可以轻松实现汉语的识别。
经验内容仅供参考,如果您需解决具体问题(尤其法律、医学等领域),建议您详细咨询相关领域专业人士。
举报作者声明:本篇经验系本人依照真实经历原创,未经许可,谢绝转载。
展开阅读全部
本文推荐利用百度AI的文字识别功能进行图片文字识别,操作简单且准确。通过安装baidu-aip模块,导入AipOcr和re,获取APPID、APPKEY、SECRET KEY,然后加载图片并调用client.basicGeneral方法,即可实现文字识别。适合初学者,避免了安装复杂模块的困扰。

9997

被折叠的 条评论
为什么被折叠?



