3.1 オートエンコーダー 3.1.1 データの準備 3.1.2 エンコーダーのモデリング 3.1.3 デコーダー 3.1.4 訓練 3.1.5 潜在空間の探索 3.1.6 潜在空間の可視化 3.2 変分オートエンコーダー(VAE) 3.2.1 VAEエンコーダーとデコーダー 3.2.2 エンコーダーの分布からのサンプリング 3.2.3 VAEの訓練 3.2.4 生成モデルとしてのVAE 3.3 CLIP 3.3.1 コントラスト損失 なぜ内積を使うのか 3.3.2 CLIPの利用:ステップ・バイ・ステップ 3.3.3 CLIPによるゼロショット画像分類 なぜ「ゼロショット分類」と呼ばれるのか 3.3.4 ゼロショット画像分類パイプライン 3.3.5 CLIPの活用例 3.4 CLIPの代替モデル 3.5 プロジェクト課題:セマンティック画像検索 3.6 まとめ 3.7 参考文献