如何设置python爬虫的爬取时间

 我来答
123
2016-12-16 · 知道合伙人数码行家
123
知道合伙人数码行家
采纳数:12960 获赞数:94614
000000000000

向TA提问 私信TA
展开全部
将网页page source 保存到数据库(mongodb)中,每次取得新的page source 和数据库中的page source 的hash 值是不是想等,如果不等表示有更新。

这个判断有了,爬虫爬取时间策略就好办了。

自己动手实现吧。
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式