dane.tabela „kluczowe indeksy” lub „licznik grupowy”
Po utworzeniu klucza na danych.tabela:
set.seed(12345)
DT <- data.table(x = sample(LETTERS[1:3], 10, replace = TRUE),
y = sample(LETTERS[1:3], 10, replace = TRUE))
setkey(DT, x, y)
DT
# x y
# [1,] A B
# [2,] A B
# [3,] B B
# [4,] B B
# [5,] C A
# [6,] C A
# [7,] C A
# [8,] C A
# [9,] C C
# [10,] C C
Chciałbym uzyskać wektor całkowity podający dla każdego wiersza odpowiedni „indeks klucza”. Mam nadzieję, że oczekiwana wydajność (kolumnai
) poniżej pomoże wyjaśnić, co mam na myśli:
# x y i
# [1,] A B 1
# [2,] A B 1
# [3,] B B 2
# [4,] B B 2
# [5,] C A 3
# [6,] C A 3
# [7,] C A 3
# [8,] C A 3
# [9,] C C 4
# [10,] C C 4
Myślałem o użyciu czegoś takiegocumsum(!duplicated(DT[, key(DT), with = FALSE]))
ale mam nadzieję, że jest lepsze rozwiązanie. Uważam, że ten wektor może być częścią wewnętrznej reprezentacji tabeli i może istnieje sposób na uzyskanie do niego dostępu? Nawet jeśli tak nie jest, co byś zaproponował?