大きな値の列にはいくつかのNAが含まれている、大きな列のR data.table
があります。私は、1つ以上の値の列で完全にNAであるグループを削除したいが、グループ全体を保持する。キーの各列に対してこれを繰り返します。だから、ドロップしたいRデータテーブルからNAsのブロックを削除するには
library(data.table)
DT = data.table(
Series = rep(letters[1:12], each = 3),
Id = 1:12,
Value1 = c(1:3, NA, 5:9, rep(NA,3), 1:3, NA, 5:9, rep(NA,3), 1:3, NA, 5:9, rep(NA,3)),
Value2 = c(rep(NA,3), 1:4, NA, 6:9, rep(NA,3), 1:9, 1:9, rep(NA,3)))
DT
Series Id Value1 Value2
1: a 1 1 NA
2: a 2 2 NA
3: a 3 3 NA
4: b 4 NA 1
5: b 5 5 2
6: b 6 6 3
7: c 7 7 4
8: c 8 8 NA
9: c 9 9 6
10: d 10 NA 7
11: d 11 NA 8
12: d 12 NA 9
13: e 1 1 NA
14: e 2 2 NA
15: e 3 3 NA
16: f 4 NA 1
17: f 5 5 2
18: f 6 6 3
19: g 7 7 4
20: g 8 8 5
21: g 9 9 6
22: h 10 NA 7
23: h 11 NA 8
24: h 12 NA 9
25: i 1 1 1
26: i 2 2 2
27: i 3 3 3
28: j 4 NA 4
29: j 5 5 5
30: j 6 6 6
31: k 7 7 7
32: k 8 8 8
33: k 9 9 9
34: l 10 NA NA
35: l 11 NA NA
36: l 12 NA NA
Series Id Value1 Value2
:
- シリーズ:、D、E、H及びL
- Idsは:4、10、簡単な例を与えるために :11と12
正しい結果は次のようになります。
私はこのような値1のためのNAであることシリーズを見つけることができます:
DT[, sum(1-is.na(Value1)) == 0, by = Series][V1 == TRUE]
そして、私も
setkey(DT, Series)
DT = DT[DT[, sum(1-is.na(Value)) == 0, by = Series][V1 != TRUE]]
を行うことができ、私がこれまで管理し何3210
Series Id Value1 Value2
1: b 5 5 2
2: b 6 6 3
3: c 7 7 4
4: c 8 8 NA
5: c 9 9 6
6: f 5 5 2
7: f 6 6 3
8: g 7 7 4
9: g 8 8 5
10: g 9 9 6
11: i 1 1 1
12: i 2 2 2
13: i 3 3 3
14: j 5 5 5
15: j 6 6 6
16: k 7 7 7
17: k 8 8 8
18: k 9 9 9
Series Id Value1 Value2
しかし、最終的なテーブルにはV1が現れます。
理由だけではなく 'na.omit(DT)'と列の値を持つ行をドロップしますか? – Justin
'na.omit'はすべてのNAをただ削除しています。私は、「ブロック」全体がNAである場合にのみ削除したいと思います。この例では、mまたはzの値はないので、それらを削除する必要がありますが、2つのNAsを直列にドロップしたくないです。 – Corone
それから@Arunはあなたの答えを持っていますが、 .logical'です。 – Justin