我有一个像这样的巨大文件:
library(tidyverse)
test <- structure(list(one = c(5014, 5014, 5014, 5033, 5033, 5033, 5040,
5040, 5040, 5171, 5171, 5171, 5174, 5174, 5174, 5183, 5183, 5183,
5193, 5193, 5193, 5304, 5304, 5304), two = c(5033, 5040, 5304,
5014, 5040, 5304, 5014, 5033, 5304, 5174, 5183, 5331, 5171, 5183,
5331, 5171, 5174, 5331, 5161, 1538, 5190, 5014, 5033, 5040)), row.names = c(NA,
-24L), class = c("tbl_df", "tbl", "data.frame"))
两列中的数字以(递归?)方式与其他数字匹配(抱歉,我不知道如何更好地解释它)。在这个示例中,很明显(对于人类,而不是计算机)只有三个组。我怎样才能分开这些组?
我所需要的就是这样的:
组号
1 5014
1 5033
1 5040
1 5304
2 5171
2 5174
2 5183
2 5331
3 5193
3 5161
3 1538
3 5190
我想多个自连接是可能的,但这似乎非常乏味......