爬取带验证码网站思路的小结
来源:http://www.tudoupe.com时间:2022-02-03
由于现在网站技术的发展及爬虫技术的推进,现在网站很多都有访问时需要填写验证码的问题,经过查询,现对验证码问题进行总结,如下:
1.IP代理 当我们频繁用一个IP登陆某个网站时,会出现需要填写验证码的问题,解决此种问题可以用IP代理的思路具体有三种方法:
(1)借用VPN,更换不同的线路,进而更换IP。
(2)IP代理池,借用一些厂商提供的IP代理池的API,更换IP
(3)ADSL,利用拨号上网每次分配不同IP的机制,实现更换IP
2 cookie登陆,为了避免每次登陆都要输入账号密码,验证码的麻烦,我们可以将登陆后的cookie存储到本地,访问网站时加入即可。
3.传统验证码识别。可以借助tesseract-ocr,pytesseract和Pillow
4.人工打码 当传统验证码识别难度加大时,可以结合自动识别和人工打码平台解决问题。
5.滑动验证码:可以结合selenium实现。
上一篇:c#入门-创建项目
下一篇:没有了
相关新闻
- 2022-02-03 c#入门-创建项目
- 2022-02-03 scp776arc
- 2022-02-02 Cocos Creator Android 平台 Google 原生登
- 2022-02-02 Windows搭建flutter环境
- 2022-02-02 Git:常见全局设置命令转载
- 2022-02-02 如何在装有Windows的Mac中开启固件虚
- 2022-02-02 贝叶斯分类器原理
- 2022-02-02 Windows下Nodejs多版本安装(nvm、nvm
- 2022-02-02 Arduino Nano自制开发板常见问题汇总
- 2022-02-02 04-Docker-服务与镜像相关命令
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
