
■
129
7
章
ケーススタディ:
Twitter
アーカイブの比較
Twitter
を通じてオンラインで共有されるテキストは、多くの人々の注目を集め
ているテキストタイプの
1
つです。実際、本書で(そして広く一般に)使われている
センチメント辞書のいくつかは、もともとツイートの分析用に作られ、ツイートで
チェックされています。本書の著者は
2
人とも
Twitter
アカウントを持ち、かなり
頻繁に使っています。そこで、このケーススタディでは、ジュリア(
https://twitter.
com/juliasilge
)とデビッド(
https://twitter.com/drob
)の
Twitter
アーカイブ全体を比
較してみることにします。
7.1
データの取得とツイートの時間的分布
Twitter
ユ ー ザ は、
Twitter
の
Web
サ イ ト の 指 示(
https://support.twitter.com/
articles/2017
0160
)に従って、自分自身の
Twitter
アーカイブをダウンロードできま
す。私たちはそれぞれ自分のアーカイブをダウンロードしており、これからその特
徴を広く世間に公開したいと思っています。まず、
lubridate
パッケージを使って文
字列のタイムスタンプを
date-time
オブジェクトに変換し、全体的なツイートパター
ンを調べてみましょう(図7-1)。
library(lubridate)
library(ggplot2)
library(dplyr)
library(readr) ...