python中提取网页特定内容4的正则表达式如何写

<td>MicrosoftWindows8null<br/>MicrosoftWindowsServer2012null<br/></td><td>计算机科学<br/><... <td>
Microsoft Windows 8 null<br/>
Microsoft Windows Server 2012 null<br/>
</td>
<td>
计算机科学 <br/>
<br/>
写作文档<br/>
</td>
<td><span style="font-weight: bold;color: #014ABB;" >ID:</span>111111</td>
网页源码中有很多这种结构的代码 我只想提取如 Microsoft Windows 8 null 计算机科学 等
不想要<td></td>中有<span>...</span>中的任何内容
我写的正则是r'<td>\s*(.*|[\u4e00-\u9fa5]*)\s*</td>') 请教各位大神 这个正则该如何修改
展开
 我来答
freebsdqd
2014-01-13
知道答主
回答量:6
采纳率:0%
帮助的人:2.2万
展开全部
python有个进门解析html的包BeautifulSoup,用它要比用正则方便很多
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
自由de王国
2014-01-13 · TA获得超过1066个赞
知道小有建树答主
回答量:661
采纳率:50%
帮助的人:842万
展开全部
<td>(?!<span)\s*(.*?)<\/td>
更多追问追答
追问
span问题解决了,但中只要有的都没有提取出来 这是为什么今天上午改了好久都没有弄出来求大神解答下
追答
你说的是你的正则还是我的正则?刚才忘告诉你,我的正则需要用单行模式,也就是使用修饰符s。
本回答被提问者采纳
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式