Python正则表达式找到所有数字和点

Question

Python正则表达式找到所有数字和点

我正在使用re.findall()从HTML文件中提取一些版本号:

>>> import re
>>> text = "<table><td><a href=\"url\">Test0.2.1.zip</a></td><td>Test0.2.1</td></table> Test0.2.1"
>>> re.findall("Test([\.0-9]*)", text)
['0.2.1.', '0.2.1', '0.2.1']

Run Code Online (Sandbox Code Playgroud)

但我想只得到那些没有以点结尾的那些.文件名可能并不总是.zip所以我不能只在正则表达式中粘贴.zip.

我想结束:

['0.2.1', '0.2.1']

Run Code Online (Sandbox Code Playgroud)

任何人都可以建议使用更好的正则表达式吗？:)

Answer 1

Tom*_*lak 15

re.findall(r"Test([0-9.]*[0-9]+)", text)

Run Code Online (Sandbox Code Playgroud)

或者,有点短:

re.findall(r"Test([\d.]*\d+)", text)

Run Code Online (Sandbox Code Playgroud)

顺便说一下 - 你不能逃避字符类中的点:

[\.0-9]  // matches: 0 1 2 3 4 5 6 7 8 9 . \
[.0-9]   // matches: 0 1 2 3 4 5 6 7 8 9 .

Run Code Online (Sandbox Code Playgroud)

归档时间：	17 年，4 月前
查看次数：	29147 次
最近记录：	13 年，11 月前