我有以下几点data.frame:
group <- sample(c("egyptian", "american", "irish", "australian"), 50, TRUE)
E <- c(rnorm(50, 5, 6))
F <- c(rnorm(50, 7.8, 4.5))
G <- c(rnorm(50, 65, 16.7))
test <- data.frame(group=group, E=E, F=F, G=G)
Run Code Online (Sandbox Code Playgroud)
我的目标是生成一个data.frame包含group作为标题并在E下面列出其相应值的。
像这样data.frame:
egyptian <- c(rnorm(50,5,6))
american<- c(rnorm(50,5,6))
irish<- c(rnorm(50,5,6))
australian<- c(rnorm(50,5,6))
test <- data.frame(egyptian=egyptian, american=american,
irish=irish, australian=australian)
Run Code Online (Sandbox Code Playgroud)
我尝试对 2 列进行子集化,然后使用,dcast,但失败了。是否可以dcast从长到宽 2 列?
正如@jbaums 在评论中提到的,每个组的大小并不相同。
table(test$group)
# american australian egyptian irish
# 7 18 9 16
Run Code Online (Sandbox Code Playgroud)
最好设置种子以使其可复制。IE
set.seed(1)
group <- sample(c("egyptian", "american", ....)
Run Code Online (Sandbox Code Playgroud)
要将初始输入转换为预期输出(基于“E”列),我们可能需要基于分组变量(“group”)创建一个序列
library(reshape2)
test$ind <- with(test, ave(seq_along(group), group, FUN=seq_along))
dcast(test, ind~group, value.var='E')
Run Code Online (Sandbox Code Playgroud)
或者另一种base R选择是使用xtabs
xtabs(E~ind+group, test)
Run Code Online (Sandbox Code Playgroud)
但是,请注意,这将为那些缺失值组合填充“0”。对于dcast,默认情况下,我们将得到缺失组合的“NA”,我们可以通过fill参数更改它。