爬取带验证码网站思路的小结
来源:http://www.tudoupe.com时间:2022-02-03
由于现在网站技术的发展及爬虫技术的推进,现在网站很多都有访问时需要填写验证码的问题,经过查询,现对验证码问题进行总结,如下:
1.IP代理 当我们频繁用一个IP登陆某个网站时,会出现需要填写验证码的问题,解决此种问题可以用IP代理的思路具体有三种方法:
(1)借用VPN,更换不同的线路,进而更换IP。
(2)IP代理池,借用一些厂商提供的IP代理池的API,更换IP
(3)ADSL,利用拨号上网每次分配不同IP的机制,实现更换IP
2 cookie登陆,为了避免每次登陆都要输入账号密码,验证码的麻烦,我们可以将登陆后的cookie存储到本地,访问网站时加入即可。
3.传统验证码识别。可以借助tesseract-ocr,pytesseract和Pillow
4.人工打码 当传统验证码识别难度加大时,可以结合自动识别和人工打码平台解决问题。
5.滑动验证码:可以结合selenium实现。
上一篇:c#入门-创建项目
相关新闻
- 2023-04-16 2台电脑怎么共享(2台电脑怎么共享
- 2023-04-16 主板检测卡代码(电脑主板检测卡代
- 2023-04-16 dnf未响应(dnf未响应老是上不去)
- 2023-04-16 ppoe(pppoe拨号上网)
- 2023-04-16 网速不稳定(网速不稳定是路由器的
- 2023-04-16 wds状态(Wds状态成功)
- 2023-04-16 光标键(光标键不动了怎么办)
- 2023-04-16 电脑提速(电脑提速100倍的方法)
- 2023-04-16 切换用户(切换用户怎么切换回来
- 2023-04-16 数据包是什么(产品数据包是什么
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
