我正在与 R 合作。
在这里,我分享了我的数据样本...
structure(list(column_a = c("1_1", "1_1", "1_2", "1_2", "1_2",
"2_1", "2_2", "2_2", "3_1", "3_2"), column_b = c("kitchen", "tree",
"hate", "kind", "table", "dog", "human", "car", "moon", "rage"
)), row.names = c(NA, -10L), class = c("tbl_df", "tbl", "data.frame"
))
column_a column_b
1 1_1 kitchen
2 1_1 tree
3 1_2 hate
4 1_2 kind
5 1_2 table
6 2_1 dog
7 2_2 human
8 2_2 car
9 3_1 moon
10 3_2 rage
Run Code Online (Sandbox Code Playgroud)
我需要计算条件(1_1、1_2 等)产生的总单词的平均值。我唯一的问题是以“_1”结尾的条件总数为 50,以“_2”结尾的条件总数为 100。
因此,由于条件“1_1”产生了两个词(在样本中),我应该通过除以 50 来计算平均值。这是 2/50 = …
我正在使用 R 的一个名为 rstatix 的包,并且尝试使用函数 anova_test 执行方差分析测试。我的数据看起来像这样。
\nstructure(\n list(\n Cat = c(\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mel",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Mem",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men",\n "Men"\n ),\n count = c(\n 66L,\n 107L,\n 185L,\n …Run Code Online (Sandbox Code Playgroud) 我正在尝试使用 删除列名称的前 4 个字符stringr。我知道如何指定我想要保留的字符,但由于每列长度不同,我需要指定我不想保留的字符,但我不知道该怎么做。
我怎样才能做到这一点?