怎么抓取js执行后的页面

 我来答
城南明月羿当年
2015-04-07 · 知道合伙人生活技巧行家
城南明月羿当年
知道合伙人生活技巧行家
采纳数:24666 获赞数:123227
计算机爱好者

向TA提问 私信TA
展开全部
try{
WebClient webClient = new WebClient(BrowserVersion.FIREFOX_24);
//设置webClient的相关参数
webClient.getOptions().setJavaScriptEnabled(true);
webClient.getOptions().setCssEnabled(false);
webClient.setAjaxController(new NicelyResynchronizingAjaxController());
//webClient.getOptions().setTimeout(50000);
webClient.getOptions().setThrowExceptionOnScriptError(false);
//模拟浏览器打开一个目标网址
HtmlPage rootPage= webClient.getPage(url);
System.out.println("为指做了获取js执行的数据 线程开始沉睡等待"模袜);
Thread.sleep(3000);//主要是这个线程的等待 因为js加载也是需要时旦逗激间的
System.out.println("线程结束沉睡");
String html = rootPage.asText();
System.out.println(html);
}catch(Exception e){
}
火羽传
2015-04-03 · 超过30用户采纳过TA的回答
知道答主
回答量:92
采纳率:0%
帮助的人:39.8万
展开全部
httpunit。jar ——》java的网络爬虫包
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式