相关疑难解决方法(0)

我需要匹配所有这些开始标记:

<p>
<a href="foo">

但不是这些:

<br />
<hr class="foo" />

我想出了这个,并希望确保我做对了.我只抓住了a-z.

<([a-z]+) *[^/]*?>

我相信它说:

我有这个权利吗？更重要的是,你怎么看？

1323
推荐指数

36
解决办法

270万
查看次数

我想要一个正则表达式从HTML页面中提取标题.目前我有这个:

title = re.search('<title>.*</title>', html, re.IGNORECASE).group()
if title:
    title = title.replace('<title>', '').replace('</title>', '')

是否有正则表达式只提取<title>的内容,所以我不必删除标签？

104
推荐指数

6
解决办法

13万
查看次数