Tre*_*boy 2 python dataframe pandas
假设我在数据框 df 中有一个列 foo,如下所示:
0 abc1
1 def
2 g3sse1
3 f32asd
Run Code Online (Sandbox Code Playgroud)
我不想要最后的数字(如果有的话)。
0 abc
1 def
2 g3sse
3 f32asd
Run Code Online (Sandbox Code Playgroud)
像这样。
我能做的最好的事情就是:
df.foo[df['foo'].str[-1].str.isdigit()] = df['foo'].str[:-1]
Run Code Online (Sandbox Code Playgroud)
这解决了问题,但是......我很好奇是否有更优雅的方法来做到这一点。我想正则表达式不会让它看起来更好,但我很欣赏任何想法!
由于您的输入仅包含尾随数字,并且在这种情况下您不想使用正则表达式,因此您还可以使用rstripand python 的string模块:
import string
df['foo_refined'] = df['foo'].str.rstrip(string.digits)
foo foo_refined
0 abc1 abc
1 def def
2 g3sse1 g3sse
3 f32asd f32asd
Run Code Online (Sandbox Code Playgroud)
a = '12a'
>>> a.rstrip(string.digits)
'12a'
b = '12a2'
>>> b.rstrip(string.digits)
'12a'
c = '12a12x'
>>> c.rstrip(string.digits)
'12a12x'
d = '123'
>>> d.rstrip(string.digits)
''
Run Code Online (Sandbox Code Playgroud)
以及对 的引用lstrip,如果在此上下文中使用,它将按预期从开头而不是结尾处删除任何数字。
| 归档时间: |
|
| 查看次数: |
602 次 |
| 最近记录: |