我有一个更大的数据框,其中包含 5 年的数据。我想删除给定年份重复的行,而不删除以后年份的这些行。这是一个例子。
Year Color X Y
2014 red 1 3
2014 red 1 3
2014 blue 1 3
2015 red 1 3
2015 blue 1 3
2015 yellow 1 3
Run Code Online (Sandbox Code Playgroud)
在此示例中,我想删除 2014 年红色的重复行,而不删除 2015 年红色的行。我厌倦了以下代码:
df <- df[!duplicated(Color), by = (Year)]
Run Code Online (Sandbox Code Playgroud)
此代码删除了重复的 2014 年红色,还删除了 2015 年蓝色和 2015 年红色。