我对R很新,所以这可能是一个简单的问题.我有一个数据表,其中包含如下物种的频率计数:
Acidobacteria 47
Actinobacteria 497
Apicomplexa 7
Aquificae 16
Arthropoda 26
Ascomycota 101
Bacillariophyta 1
Bacteroidetes 50279
...
Run Code Online (Sandbox Code Playgroud)
表中约有50种.正如您所看到的,某些值比其他值大很多.我希望有一个堆积的条形图,其中前5个物种的百分比和一个"其他"类别具有所有其他百分比的总和.所以我的条形图总共有6个类别(前5名和其他).
我有3个额外的数据集(样本网站),我想做同样的事情,只在每个数据集中突出显示第一个数据集的前5个,并将它们全部放在同一个图表上.最终图表将有4个堆叠条形图,显示第一个数据集中的顶级物种如何在每个附加数据集中发生变化.
我手工制作了一个样本图(将数据列在R之外,并在最终的百分比表中输入),让您了解我正在寻找的内容:http://dl.dropbox.com/u/1938620 /phylumSum2.jpg
我想将这些步骤放入R脚本中,以便为多个数据集创建这些图.
谢谢!
我有一个大矩阵,约300行和200000列.我想通过选择至少有一个值> 0.5或小于-0.5(不仅仅是特定值)的整列来缩小它.我想保留行名和列名.通过这样做,我能够得到一个真假的矩阵tmp<-mymat > 0.5 | mymat < -0.5.我想提取其中至少有一列的所有列TRUE.我试过简单mymat[tmp]但这只返回满足该条件的值的向量.如何获得原始矩阵的实际列?谢谢.