http状态码407
原因:代理认证信息失败,让对方严格按照demo配置代理信息
http状态码429
原因:请求超过代理限制,严格按照所开代理的请求数,按照300毫秒为单位进行管理。如果限制之后,既然大量429,需要优化爬虫策略,应该是目标网站返回的错误提示。
http状态码302
原因:访问的是https网站,会自动跳转一次,正常现象;访问的http网站,网站拒绝服务,大量302需要优化爬虫策略
http状态码403或504
原因:少量不影响,大量403或504需要优化爬虫策略
http请求超时
原因:http请求的超时设置为10秒,尤其是对方访问国外网站的时候。
原文地址:https://blog.51cto.com/14201222/2361945
时间: 2024-11-06 07:12:17