爬虫被403了怎么解决

 我来答
护肤达人IT宅族
2016-04-26 · 知道合伙人互联网行家
护肤达人IT宅族
知道合伙人互联网行家
采纳数:5637 获赞数:17441
毕业于曲阜师范大学,学士学位。互联网行业2年从业经验,读过SEO相关书籍。现任爱家网SEO优化专员。

向TA提问 私信TA
展开全部
被403,应该是访问前后的token不对,造成不对的主要原因是第二次访问的cookies跟第一次不一样,脚本里面的第一次访问没有记cookies,导致第二次是全新的访问。 所以: data = urllib.request.urlopen(url).read().decode('utf-8') token = getXSRF(data) opener = getOpener(header) 改为: opener = getOpener(header) data = opener.open(url).read().decode('utf-8') token = getXSRF(data) 因为会报错,所以我还把#opener.addheaders = header这个注释了。 然后就能登录了
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式