python怎样使用正则表达式获得html标签数据
3个回答
展开全部
正则的话
import re
html = "<a href='xxx.xxx' title='xxx.xxx.xxx'>sample text1</a>abcdef<a href='xxx.xxx' title='xxx.xxx.xxx'>sample text2</a>"
result = map(lambda name: re.sub("<a href=.*?>","",name.strip().replace("</a>","")), re.findall("<a href=.*?>.*?</a>",html))
print result
上面代码会把所有a tag里的东西存在result这个list里面。另外python有个模块叫Beautiful Soup,专门用来处理html的,你有空可以看下
import re
html = "<a href='xxx.xxx' title='xxx.xxx.xxx'>sample text1</a>abcdef<a href='xxx.xxx' title='xxx.xxx.xxx'>sample text2</a>"
result = map(lambda name: re.sub("<a href=.*?>","",name.strip().replace("</a>","")), re.findall("<a href=.*?>.*?</a>",html))
print result
上面代码会把所有a tag里的东西存在result这个list里面。另外python有个模块叫Beautiful Soup,专门用来处理html的,你有空可以看下
2018-08-03 · 百度知道合伙人官方认证企业
育知同创教育
1【专注:Python+人工智能|Java大数据|HTML5培训】 2【免费提供名师直播课堂、公开课及视频教程】 3【地址:北京市昌平区三旗百汇物美大卖场2层,微信公众号:yuzhitc】
向TA提问
关注
展开全部
正则表达式获取html标签数据,要看html文件的结构以及标签的数据布置,然后才能写,你最好是上一下实例代码看看。
已赞过
已踩过<
评论
收起
你对这个回答的评价是?
推荐于2016-09-12
展开全部
<td>
Microsoft Windows 8 null<br/>
Microsoft Windows Server 2012 null<br/>
</td>
<td>
计算机科学 <br/>
<br/>
写作文档<br/>
</td>
<td><span style="font-weight: bold;color: #014ABB;" >ID:</span>111111</td>
Microsoft Windows 8 null<br/>
Microsoft Windows Server 2012 null<br/>
</td>
<td>
计算机科学 <br/>
<br/>
写作文档<br/>
</td>
<td><span style="font-weight: bold;color: #014ABB;" >ID:</span>111111</td>
本回答被提问者和网友采纳
已赞过
已踩过<
评论
收起
你对这个回答的评价是?
推荐律师服务:
若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询