我有一个包含三列的 DataFrame:单位、影响因素和价值。有几种不同类型的影响者,这些值代表单位的数量。我想创建一个新表,显示每个影响者的最频繁和最不频繁的 n 个单位及其各自的值。
我的 df 看起来像这样:
Unit Influencer Value
A foo 321
B foo 200
C foo 20
D foo 12
E foo 3
A bar 999
B bar 209
C bar 89
D bar 34
E bar 15
F bar 2
Run Code Online (Sandbox Code Playgroud)
我的输出应该看起来像(假设我们想要顶部和底部 2 个单位):
Unit Influencer Value
A foo 321
B foo 200
D foo 12
E foo 3
A bar 999
B bar 209
E bar 15
F bar 2
Run Code Online (Sandbox Code Playgroud)
我尝试了类似于此处找到的解决方案的方法,但出现错误“索引包含重复条目,无法重塑”,我认为这是因为“影响者”是我的 df 的索引。如果我的 df …