这是一个包含用户ID列的数据框:
> head(df)
uid
1 14070210
2 14080815
3 14091420
Run Code Online (Sandbox Code Playgroud)
为了参数,我想创建一个包含用户id的平方根的新列,以及另一个包含用户id哈希的新列.所以我这样做:
df_mutated <- df %>%
mutate(sqrt_uid = sqrt(uid), hashed_uid = digest(uid))
Run Code Online (Sandbox Code Playgroud)
... digest()来自摘要包.
虽然平方根似乎有效,但摘要函数为每个用户ID返回相同的值.
> head(df_mutated)
uid sqrt_uid hashed_uid
1 14070210 3751.028 f8c4b39403e57d85cd1698d2353954d0
2 14080815 3752.441 f8c4b39403e57d85cd1698d2353954d0
3 14091420 3753.854 f8c4b39403e57d85cd1698d2353954d0
Run Code Online (Sandbox Code Playgroud)
这对我来说很奇怪.如果没有dplyr,digest()函数会为不同的输入返回不同的值.我怎么不了解dplyr?
谢谢