python编一个小程序
简单的说就是连续打开http://www.baidu.com/s?wd=XXXXXX=1-99..记录每一页最下方"百度为您找到相关结果约YYY个"个然后最后能在txt里...
简单的说就是
连续打开
http://www.baidu.com/s?wd=XXX
XXX=1-99..
记录每一页最下方"百度为您找到相关结果约YYY个"个
然后最后能在txt里面出一张
1 YYY
2 YYY
3 YYY
这样类似形式的记录就好了
文科女毕业论文搜索无聊结果,不会编程伤不起啊... 展开
连续打开
http://www.baidu.com/s?wd=XXX
XXX=1-99..
记录每一页最下方"百度为您找到相关结果约YYY个"个
然后最后能在txt里面出一张
1 YYY
2 YYY
3 YYY
这样类似形式的记录就好了
文科女毕业论文搜索无聊结果,不会编程伤不起啊... 展开
2个回答
展开全部
最多只能搜索2000个。似乎是这样子的。你要组合条件搜索。
我有一个建议不用编程(虽然用python编程很容易)。你用firefox, 安装一个插件autopage。然后搜索后它会自动帮你翻页。直到最后。你可以配置。然后你另存一次。找一个支持正则表达式的编程器。比如ultraedit, 之类的。 搜索一下就把结果都提取出来了。
我以前帮一个文科的研究生做过类似的工具。python写的,有图形界面。其实不难,不过我还是写了2天才完成。可以搜索google, baidu。也可以组合搜索,做统计分析等。
我有一个建议不用编程(虽然用python编程很容易)。你用firefox, 安装一个插件autopage。然后搜索后它会自动帮你翻页。直到最后。你可以配置。然后你另存一次。找一个支持正则表达式的编程器。比如ultraedit, 之类的。 搜索一下就把结果都提取出来了。
我以前帮一个文科的研究生做过类似的工具。python写的,有图形界面。其实不难,不过我还是写了2天才完成。可以搜索google, baidu。也可以组合搜索,做统计分析等。
展开全部
# -*- coding: utf-8 -*-
"""
Created on Tue May 14 08:32:47 2013
@author: Administrator
"""
import urllib2
import re
def savetofile(num,count):
file_object = open('thefile.txt', 'a+')
line = str(num) + ' ' + count[0] + '\n'
file_object.write(line)
file_object.close( )
def geturl(url,num):
searchurl = url + str(num)
print searchurl,
data=urllib2.urlopen(searchurl)
html = data.read()
data.close()
#print html
rebaidu = re.compile (r'百度为您找到相关结果约(.*?)个')
allbaidu = re.findall (rebaidu,html)
#print allbaidu
savetofile(num,allbaidu)
if __name__=='__main__':
for x in xrange(100):
geturl('http://www.baidu.com/s?wd=',x)
"""
Created on Tue May 14 08:32:47 2013
@author: Administrator
"""
import urllib2
import re
def savetofile(num,count):
file_object = open('thefile.txt', 'a+')
line = str(num) + ' ' + count[0] + '\n'
file_object.write(line)
file_object.close( )
def geturl(url,num):
searchurl = url + str(num)
print searchurl,
data=urllib2.urlopen(searchurl)
html = data.read()
data.close()
#print html
rebaidu = re.compile (r'百度为您找到相关结果约(.*?)个')
allbaidu = re.findall (rebaidu,html)
#print allbaidu
savetofile(num,allbaidu)
if __name__=='__main__':
for x in xrange(100):
geturl('http://www.baidu.com/s?wd=',x)
本回答被提问者采纳
已赞过
已踩过<
评论
收起
你对这个回答的评价是?
推荐律师服务:
若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询