我只是在学习python/pandas,就像它是多么强大和简洁.
在数据清理期间,我想在数据框中的列上使用regex替换,但我想重新插入部分匹配(组).
简单示例:lastname,firstname - > firstname lastname
我尝试了类似下面的内容(实际情况更复杂,所以请原谅简单的正则表达式):
df['Col1'].replace({'([A-Za-z])+, ([A-Za-z]+)' : '\2 \1'}, inplace=True, regex=True)
Run Code Online (Sandbox Code Playgroud)
但是,这会导致空值.匹配部分按预期工作,但值部分不工作.我想这可以通过一些拆分和合并来实现,但我正在寻找关于正则表达式组是否可以用于替换的一般答案.