这似乎是一个非常简单的问题,但我找不到答案.
我有一个数据帧(让调用它df),包含n = 100列(C1,C2..., C100)和50行(R1,R2..., R50).我测试了数据框中的所有列,以确保它们是数字的.我想知道每列中的数据是否具有使用该shapiro.test()函数的正态分布.
我能够使用代码逐列进行:
> shapiro.test(df$Cn)
Run Code Online (Sandbox Code Playgroud)
要么
> shapiro.test(df[,c(Cn)])
Run Code Online (Sandbox Code Playgroud)
但是当我尝试在几个列上同时执行它时它不起作用:
> shapiro.test(df[,c(C1:C100)])
Run Code Online (Sandbox Code Playgroud)
返回错误:
Error in `[.data.frame`(x, complete.cases(x)) : undefined columns selected
Run Code Online (Sandbox Code Playgroud)
如果有人能够建议同时进行所有测试的方法,并最终将结果存储在新的数据帧/矩阵/列表/向量中,我将不胜感激.
谢谢 !
勒布
我想使用t.test函数来比较存储在数据帧中的值组.假设我的数据框有2列:"group"和"result"以及40行."result"列包含我想要比较的值,"group"列表示值被分割的组:例如,每组10个值的4个组(a,b,c,d).
如何指示我只想测试属于组a的值与属于组b的值?
或者,是否有一种简单的方法将属于组a的值提取到一个向量中(让我们称之为"vecta"),以便随意比较向量?
提前致谢 !勒布