用Java写一个能爬行Javascript动态链接的网页的内容?

因项目需要用Java写一个能爬行Javascript动态链接的网页的内容,不知道怎么实现,哪位朋友知道?加分!!!!... 因项目需要用Java写一个能爬行Javascript动态链接的网页的内容,不知道怎么实现,哪位朋友知道?加分!!!! 展开
 我来答
tonylinzhen
2011-01-07 · TA获得超过1368个赞
知道小有建树答主
回答量:997
采纳率:50%
帮助的人:394万
展开全部
Googlebot也就是Google的标准蜘蛛,是不支持Javascript的,目前所有主流搜索引擎厂商的爬虫都是不支持Ajax/Javascript的。这并不是因为技术上有什么无法逾越的障碍。实际上现在有众多优秀的开源Javascript解析引擎,如Google Chrome的内置Javascript解析引擎V8,以及Firefox内置的SpiderMonkey和TraceMonkey等等。爬虫的HTML解析器上加上这些Javascript解析就可以轻易的实现对Ajax/Javascript内容的解析了。但是,这么做会加大解析器负担,而且这么做的实际意义还有待研究。

据说百度的爬虫支持一部分Javascript,但可能主要限于文本内容和链接发掘,从而实现更广泛的发现内容的任务。
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
chengrenbo
2011-01-07 · TA获得超过524个赞
知道小有建树答主
回答量:402
采纳率:0%
帮助的人:639万
展开全部
java??? 太难!
得写IE插件,hook 浏览器api!!! 恐怕目前只有这个办法了
本回答被提问者采纳
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
zymb1983
2011-01-07 · TA获得超过199个赞
知道小有建树答主
回答量:361
采纳率:0%
帮助的人:123万
展开全部
用httpunit 可以获得对方网站页面的全部内容,获得以后 你自己找找规律。应该不是很难。
本回答被网友采纳
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
geto1080
2011-01-07 · TA获得超过320个赞
知道小有建树答主
回答量:1359
采纳率:100%
帮助的人:528万
展开全部
网络蜘蛛?关注中……
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
收起 更多回答(2)
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式