小编gro*_*413的帖子

如何在R中执行近似(模糊)名称匹配

我有一个大型数据集,专门用于生物学期刊,由不同的人组成很长一段时间.因此,数据不是单一格式.例如,在"AUTHOR"栏中,我可以找到John Smith,Smith John,Smith J等,而它是同一个人.我无法执行最简单的操作.例如,我无法弄清楚作者撰写的文章最多.

在R中是否有任何方法来确定不同名称中的大多数符号是否相同,将它们视为相同的元素?

analytics r openrefine

5
推荐指数
2
解决办法
5072
查看次数

标签 统计

analytics ×1

openrefine ×1

r ×1