如何过滤数据框以仅显示多列中具有重复项的行?
示例数据框:
col1 col2 col3
A1 B1 C1
A1 B1 C1
A1 B1 C2
A2 B2 C2
Run Code Online (Sandbox Code Playgroud)
预期输出:
col1 col2 col3
A1 B1 C1
A1 B1 C1
Run Code Online (Sandbox Code Playgroud)
我的尝试:
df[df.duplicated(['col1', 'col2', 'col3'], keep=False)]
Run Code Online (Sandbox Code Playgroud)
但这并没有给出预期的结果。
你的尝试df[df.duplicated(['col1', 'col2', 'col3'], keep=False)]在我的测试中有效。您可以省略列名称:
df[df.duplicated(keep=False)]
Run Code Online (Sandbox Code Playgroud)