小编Seb*_*ner的帖子

删除R中String中的重复元素

我在删除字符串中的重复元素时遇到了一些问题.我的数据看起来与此类似:


idvisit     path
1           1,16,23,59
2           2,14,14,19
3           5,19,23,19
4           10,10
5           23,23,27,29,23
Run Code Online (Sandbox Code Playgroud)

我有一个包含唯一ID的列和一个包含网页导航路径的列.右栏包含一些案例,其中页面刚重新加载,页面被跟踪两次甚至更多.页面用逗号分隔并保存为因子.我的问题是,我不想连续多个页面,所以数据应该是这样的.


idvisit     path
1           1,16,23,59
2           2,14,19
3           5,19,23,19
4           10
5           23,27,29,23
Run Code Online (Sandbox Code Playgroud)

应删除彼此相邻的多个页面.我知道如何使用regexpressions删除特定的多个数字,但我有大约20,000个不同的页面,并且不能为所有这些页面执行此操作.对于我的问题,有没有人有解决方案或提示?

谢谢塞巴斯蒂安

string r

2
推荐指数
1
解决办法
710
查看次数

标签 统计

r ×1

string ×1