java爬虫怎么动态的获取html

 我来答

2个回答

#热议# 网上掀起『练心眼子』风潮，真的能提高情商吗？

百度网友10c25bb4
2016-09-23 · TA获得超过419个赞

知道小有建树答主

回答量：441

采纳率：25%

帮助的人：316万

我也去答题访问个人页

关注

展开全部

　　很多网站是用js或Jquery 生成数据的，到后台获取到数据以后，用 document.write()或者("#id").html="" 的方式写到页面中，这个时候用浏览器查看源码是看不到数据的。

HttpClient是不行的，看网上说HtmlUnit，说可以获取后台js加载完后的完整页面
　　不过并没什么用

已赞过 已踩过<

评论收起

好程序员
2016-10-03 · HTML5前端培训/大数据培训/Java

好程序员

好程序员是IT高端课程培训基地，从平凡到卓越,为梦想而拼搏。

向TA提问

关注

展开全部

代码：
String url = "http://xinjinqiao.tprtc.com/admin/main/flrpro.do";
try {
WebClient webClient = new WebClient(BrowserVersion.FIREFOX_10);
//设置webClient的相关参数
webClient.getOptions().setJavaScriptEnabled(true);
webClient.getOptions().setCssEnabled(false);
webClient.setAjaxController(new NicelyResynchronizingAjaxController());
//webClient.getOptions().setTimeout(50000);
webClient.getOptions().setThrowExceptionOnScriptError(false);
//模拟浏览器打开一个目标网址
HtmlPage rootPage = webClient.getPage(url);
System.out.println("为了获取js执行的数据线程开始沉睡等待");
Thread.sleep(3000);//主要是这个线程的等待因为js加载也是需要时间的
System.out.println("线程结束沉睡");
String html = rootPage.asText();
System.out.println(html);
} catch (Exception e) {
}

已赞过 已踩过<

评论收起

1条折叠回答

推荐律师服务：若未解决您的问题，请您详细描述您的问题，通过百度律临进行免费专业咨询

java爬虫 怎么动态的获取html

其他类似问题

为你推荐：

java爬虫怎么动态的获取html