我需要匹配所有这些开始标记:
<p>
<a href="foo">
Run Code Online (Sandbox Code Playgroud)
但不是这些:
<br />
<hr class="foo" />
Run Code Online (Sandbox Code Playgroud)
我想出了这个,并希望确保我做对了.我只抓住了a-z.
<([a-z]+) *[^/]*?>
Run Code Online (Sandbox Code Playgroud)
我相信它说:
/,然后我有这个权利吗?更重要的是,你怎么看?
我想从一般HTML页面中提取所有文本(显示与否).
我想删除
是否有正则表达式(一个或多个)将实现这一目标?
我的问题有点像这个问题,但我有更多的限制:
是否有任何工具可以设置这样做,还是我最好只打破RegexBuddy和C#?
我对命令行或批处理工具以及C/C#/ D库开放.