我正在尝试过滤包含 n 个类别的 n 行的数据框。我希望每个类别dimension值按另一列排序revenues,然后dimension选择每个类别的前 10 个值并删除其余的值。
我尝试了以下代码片段,但它似乎没有达到我想要的效果:
data <- tbl_df(data) %>%
arrange(revenues) %>%
group_by(dimension) %>%
top_n(10)
Run Code Online (Sandbox Code Playgroud) 我需要从R中的以下数据框中为每个组[yearmonth]值选择前两个值.我已经按照count和yearmonth对数据进行了排序.如何在以下数据中实现这一点?
yearmonth name count
1 201310 Dovas 5
2 201310 Indulgd 2
3 201310 Justina 1
4 201310 Jolita 1
5 201311 Shahrukh Sheikh 1
6 201311 Dovas 29
7 201311 Justina 13
8 201311 Lina 8
9 201312 sUPERED 7
10 201312 John Hansen 7
11 201312 Lina D. 6
12 201312 joanna1st 5
Run Code Online (Sandbox Code Playgroud) 我有两个data.table:
k要从中提取顶部的值,每个group.group到要k为其选择的值的映射group。如何在 R 数据框中按组或在类别内(按组)查找前 N 个值解决了这个问题,当k不因组而异时。我怎样才能做到这一点?这是示例数据和所需的结果:
价值观:
(dt <- data.table(id=1:10,
group=c(rep(1, 5), rep(2, 5))))
# id group
# 1: 1 1
# 2: 2 1
# 3: 3 1
# 4: 4 1
# 5: 5 1
# 6: 6 2
# 7: 7 2
# 8: 8 2
# 9: 9 2
# 10: 10 2
Run Code Online (Sandbox Code Playgroud)
映射group到k:
(group.k <- …Run Code Online (Sandbox Code Playgroud)