网创优客建站品牌官网
为成都网站建设公司企业提供高品质网站建设
热线:028-86922220
成都专业网站建设公司

定制建站费用3500元

符合中小企业对网站设计、功能常规化式的企业展示型网站建设

成都品牌网站建设

品牌网站建设费用6000元

本套餐主要针对企业品牌型网站、中高端设计、前端互动体验...

成都商城网站建设

商城网站建设费用8000元

商城网站建设因基本功能的需求不同费用上面也有很大的差别...

成都微信网站建设

手机微信网站建站3000元

手机微信网站开发、微信官网、微信商城网站...

建站知识

当前位置:首页 > 建站知识

python爬虫怎么识别图片验证码

这篇文章主要介绍python爬虫怎么识别图片验证码,文中介绍的非常详细,具有一定的参考价值,感兴趣的小伙伴们一定要看完!

成都创新互联公司是一家专业提供新邱企业网站建设,专注与做网站、网站建设、成都h5网站建设、小程序制作等业务。10年已为新邱众多企业、政府机构等服务。创新互联专业的建站公司优惠进行中。

爬虫真的像别人说的那么强大,可以获取很多信息,帮助或者参考别人的内容,补全自己吗?实际上确实是可以实现的,但是大家不了解的是,除了被动让爬虫去爬取,很多网站都可有主动防御技能,比如,现在跟大家说的图片验证问题,爬虫必须得去解决,不然没有办法可以进行下一步,解决操作如下所示:

1、先安装一个pytesseract

2、接着我们就打开一张图片,使用 pytesseract 识别。

python爬虫怎么识别图片验证码

代码如下:

captcha = Image.open("captcha1.png")result = pytesseract.image_to_string(captcha)print(result)

输出结果:没有问题。

3、我们在试试其他图片,如下所示

python爬虫怎么识别图片验证码

代码所示:

captcha = Image.open("claptcha2.png")result = pytesseract.image_to_string(captcha)print(result)

处理结果是有问题,也许是pytesseract没有办法处理噪点比较大的内容。

4、首先进行图片灰度处理

captcha = Image.open("captcha2.png")result = captcha.convert('L')result.show()

5、在进行二值化

def convert_img(img,threshold):    img = img.convert("L")  # 处理灰度    pixels = img.load()    for x in range(img.width):        for y in range(img.height):            if pixels[x, y] > threshold:                pixels[x, y] = 255            else:                pixels[x, y] = 0    return img

6、调用一下

convert_img(captcha,150)

7、之后再跟第一个图片处理方式一样,就可以解决了哦~

好啦,一般情况下,第一种方式,几行代码就可以处理完成,还有一些情况可以调用第二种方式。

以上是“python爬虫怎么识别图片验证码”这篇文章的所有内容,感谢各位的阅读!希望分享的内容对大家有帮助,更多相关知识,欢迎关注创新互联行业资讯频道!


新闻标题:python爬虫怎么识别图片验证码
本文链接:http://bjjierui.cn/article/psgoge.html

其他资讯