在 R 中获取 data.frame 的样本

Question

在 R 中获取 data.frame 的样本

我在 R 中有以下数据框：

id<-c(1,2,3,4,10,2,4,5,6,8,2,1,5,7,7)
date<-c(19970807,19970902,19971010,19970715,19991212,19961212,19980909,19990910,19980707,19991111,19970203,19990302,19970605,19990808,19990706)
spent<-c(1997,19,199,134,654,37,876,890,873,234,643,567,23,25,576)
df<-data.frame(id,date,spent)

Run Code Online (Sandbox Code Playgroud)

我需要以提取所有客户观察结果的方式随机抽取 3 个客户（基于 id）。

Answer 1

mne*_*nel 6

你想使用%in% 和unique

df[df$id %in% sample(unique(df$id),3),]
##    id     date spent
## 4   4 19970715   134
## 7   4 19980909   876
## 8   5 19990910   890
## 10  8 19991111   234
## 13  5 19970605    23

Run Code Online (Sandbox Code Playgroud)

使用data.table以避免$引用

library(data.table)
DT <- data.table(df)

 DT[id %in% sample(unique(id),3)]
##    id     date spent
## 1:  1 19970807  1997
## 2:  4 19970715   134
## 3:  4 19980909   876
## 4:  1 19990302   567
## 5:  7 19990808    25
## 6:  7 19990706   576

Run Code Online (Sandbox Code Playgroud)

这可确保您始终评估 data.table 中的表达式。

归档时间：	13 年，2 月前
查看次数：	1992 次
最近记录：	12 年，7 月前