
160
■
8
章 ケーススタディ:
NASA
メタデータのマイニング
8.2.2
キーワードのネットワーク
次に、同じデータセットで共起することが多いキーワードの組み合わせを知るた
めに、キーワードのネットワークを作りましょう(図8-3 参照)。
keyword_pairs <- nasa_keyword %>%
pairwise_count(keyword, id, sort = TRUE, upper = FALSE)
keyword_pairs
## # A tibble: 13,390
×
3
## item1 item2 n
## <chr> <chr> <dbl>
## 1 OCEANS OCEAN OPTICS 7324
## 2 EARTH SCIENCE ATMOSP
HERE 7318
## 3 OCEANS OCEAN COLOR 7270
## 4 OCEAN OPTICS OCEAN COLOR 7270
## 5 PROJECT COMPLETED 6450
## 6 EARTH SCIENCE ATMOSPHERIC WATER VAPOR 3142
## 7 ATMOSPHERE ATMOSPHERIC WATER VAPOR 3142
## 8 EARTH SCIENCE OCEANS 2762
## 9 EARTH SCIENCE LAND SURFACE 2718
## 10 EARTH SCIENCE BIOSPHERE 24
48
## # ... with 13,380 more ...