从查找表重命名列

jam*_*abb 0 r

我正在尝试使用查找表中的匹配重命名数据框中的列.

oldvars = c("mpg", "cyl" , "disp",  "hp", "drat", "wt", "qsec", "vs", "am", "gear", "carb")
newvars = c("Miles Per Gallon", "Cycle", "Displacement", "Horsepower", "Distance Rating", 
"Working Time", "Quick Second", "Versus", "America", "Gears", "Carbohydrates")

lookup = data.frame(oldvars, newvars)
mycars = mtcars
Run Code Online (Sandbox Code Playgroud)

使用查找列表匹配oldvars并将其更改为newvars,以便names(mycars)输出"Miles Per Gallon", "Cycle", "Displacement", "Horsepower", "Distance Rating", "Working Time", "Quick Second", "Versus", "America", "Gears", "Carbohydrates"

我已经尝试过colnames更改名称,但它并没有像我期望的那样读取变量.下列

for(i in 1:length(newvars)) {
  colnames(mycars)[oldvars[i]] = newvars[i]
} 
Run Code Online (Sandbox Code Playgroud)

只输出NAs

Gre*_*gor 7

如果你知道它们的顺序是相同的(就像你的例子中那样)那么你就可以做到

names(mycars) = newvars
Run Code Online (Sandbox Code Playgroud)

如果他们可能不会以相同的顺序(我交换matchdata.table):

oldvars = c("cyl" ,"mpg",  "disp",  "foo")
newvars = c( "Cycle", "Miles Per Gallon", "Displacement", "bar")

mycars = head(mtcars, 2) # short data frame to work with
Run Code Online (Sandbox Code Playgroud)

然后setnames是你的朋友确定正确的顺序:

name_match = match(names(mycars), lookup$oldvars)
name_match
[1]  2  1  3 NA NA NA NA NA NA NA NA

# assign the names
names(mycars)[na.omit(name_match)] = newvars[!is.na(name_match)]
Run Code Online (Sandbox Code Playgroud)

所以可以完成任务

library(data.table)
setDT(mycars) # convert the data frame to data.table
setnames(mycars, old = oldvars, new = newvars) # update names by reference
Run Code Online (Sandbox Code Playgroud)

如果你不喜欢这个plyr范例,那么rename也可以:

plyr::rename(mycars, setNames(newvars, oldvars))
Run Code Online (Sandbox Code Playgroud)