这是我的数据集(名为 g)现在的样子。我在 R 工作。
Q.35 | Q.36 | age | gender | country
2 | 2 | 1 | 20 | 2 | AU"
3 | 5 | 5 | 21 | 1 | AU"
Run Code Online (Sandbox Code Playgroud)
我想删除国家/地区代码上的那些引号(AU 而不是 AU")。但是我尝试过的正则表达式没有用。
h <- grep("\"", "", g)
h <- grep(""", "", g)
h <- grep('"', '', g)
Run Code Online (Sandbox Code Playgroud)
我怎样才能删除那些引号?
有效!我应该使用 gsub,而不是 grep。
但是 gsub 搞砸了我的代码,所以我意识到我必须将 gsub 应用于特定变量,如下所示:
h$country.f <- gsub("\"", "", h$country.f)
Run Code Online (Sandbox Code Playgroud)
grep仅在字符向量的每个元素内搜索匹配项,如果要替换特定模式的第一次出现,请使用sub或gsub替换所有出现的。
示例:
> h <- data.frame(age = c(20,21), country = c('AU"', 'AU"'))
> h$country <- gsub('"', '', h$country)
> h
# age country
# 1 20 AU
# 2 21 AU
Run Code Online (Sandbox Code Playgroud)