Python的requests包在抓取页面的时候页面源代码抓取不完全，页面数据不是动态加载的。

只能抓取到页面开头的部分，后面到结尾都抓不到，怎么回事？... 只能抓取到页面开头的部分，后面到结尾都抓不到，怎么回事？展开

 我来答

3个回答

#热议# 什么是淋病？哪些行为会感染淋病？

司马刀剑

高粉答主

2019-10-17 · 每个回答都超有意思的

知道顶级答主

回答量：4.6万

采纳率：93%

帮助的人：7229万

我也去答题访问个人页

关注

展开全部

您好，首先，sys.setdefaultencoding is evil。
其次，不会用 Requests 就去看文档，不要乱来。
如果 Requests 检测不到正确的编码，那么你告诉它正确的是什么：
response.encoding = 'gbk'
print response.text
原始内容在 response.content 里，bytes，自己想怎么处理就怎么处理。

单个请求完全没必要用 Session。直接 requests.get(xxx) 就可以了。
最后，弄不明白怎么处理编码错误的字符串就仔细想想，或者用 Python 3.x，不要散弹枪编程。
以下是 Python 3。Python 2 在那个字符串前加个 u 告诉它是 unicode 也一样。

已赞过 已踩过<

评论收起

数阔八爪鱼采集器丨RPA机器人
2021-07-27 · 前往八爪鱼RPA应用市场，免费获取机器人

数阔八爪鱼采集器丨RPA机器人

向TA提问

关注

展开全部

不用这么麻烦，直接鼠标点在网页上，右键查看网页源代码，里面如果没有你想要的数据，那就是动态加载了。现在很多页面都只是个架子，数据都是动态加载的，可以直接调试抓取数据接口。

本回答被网友采纳

已赞过已踩过<

你对这个回答的评价是？
评论收起

阳光的雷咩咩
2019-10-18 · TA获得超过1.4万个赞

知道大有可为答主

回答量：2.3万

采纳率：66%

帮助的人：7661万

我也去答题访问个人页

关注

展开全部

不知道你的网页有多大，建议把上面的文本保存到文件来检查，控制台说不定有滚动和截断

已赞过 已踩过<

评论收起

1条折叠回答

推荐律师服务：若未解决您的问题，请您详细描述您的问题，通过百度律临进行免费专业咨询

您可能关注的内容

『python』OpenSNN开思通智网:交流学习发文章

www.opensnn.com

宝塔面板一款提升提升服务器配置效率的好帮手

操作简单，只需轻松点击鼠标就能部署一键配置服务器且功能丰富各种功能一应俱全。只需要轻松地点击鼠标，就可以一键配置服务器部署各种运行环境的运维工具。

www.bt.cn广告

Python的requests包在抓取页面的时候页面源代码抓取不完全，页面数据不是动态加载的。

您可能关注的内容

其他类似问题

为你推荐：