第2章. データを整理する検索のための堅牢性アーキテクチャを設計する
この作品はAIを使って翻訳されている。ご意見、ご感想をお待ちしている:translation-feedback@oreilly.com
1日で全世界を発見しマッピングすることはできない。同様に、組織のITランドスケープを一度に発見しマッピングすることはできない。第1章で分かったように、データ・カタログの有効性は、それがいかにうまく構造化され、管理されているかに大きく依存する。簡単そうに聞こえるかもしれないが、アセットとそのメタデータの整理は単純ではない。データをグループ化する最も論理的な方法は何か?データ資産に最も関連するメタデータは何か?データ資産はどのように関連しているのか?複数の方法で関連付けることができるのか?データの機密性と機密性の相互関係はどうなっているのか?
この章では、このような疑問について説明し、データカタログに資産を集め、整理するプロセスを説明する。まずドメインをどのように整理するかから始め、ドメインにデータをどのように投入するかについて簡単に説明し、最後にデータカタログに表現されたデータをどのように整理するかについて説明する。
まず、ドメインをどのように整理するか見てみよう。
データカタログでドメインを整理する
第1章で説明したように、ドメインは論理的に一緒に属する資産をグループ化する。したがって、最初に行うべきことは、ドメインを作成することである。一度にすべてを作成する必要はなく、最初のデータソースをプッシュ/プルするために必要なものだけを作成すればよい。それができたら、次にドメイン内のアセットを整理する。これについては後で説明する。
しかし、データカタログの文脈でドメインを整理することは、実際にはどのような意味を持つのだろうか。データカタログでは、どのようなアセットを自分のドメインに入れるかを定義するのはドメインのオーナー次第である。以下のサブセクションでは、アーキテクト・ドメインのガイドを提供する。
データカタログにおけるドメインアーキテクチャ
ドメインを整理する作業は面倒なものだ。ドメインのリファレンスアーキテクチャがなければ、何から始めればいいのかさえわからないかもしれない。
図2-1にあるような、標準的な分類ツリー( )を想像してほしい。このツリーにはルートがあり、そこからサブカテゴリーに分かれ、さらにサブカテゴリーを持つことができる。これは、必要に応じて幅と深さを広げることができる構造である。
図2-1. 分類ツリー
それがドメインを整理する方法だ。しかし、どうやって?
恐れることはない。私は、データ・カタログのためのドメイン・アーキテクチャを作成し、データ・ソースを論理的かつ体系的にグループ化した。それを図2-2に示す。このアーキテクチャを手にすることで、ドメインを整理するときに舵をしっかりと握ることができるフレームワークを手に入れることができる。この は、すべてのデータソースを論理的かつ体系的にグループ化するための実践的ガイドである。
図2-2の最上位レベルはデータカタログのメインエントリである。 メインエントリはすべてのドメインのルートであり、論理的な出発点である。これをカタログ全体と考えよう。ここからすべてが細分化される。2つの理由から、複数のメインエントリを持つことは推奨されない(多くのデータカタログでは不可能である): ...
Become an O’Reilly member and get unlimited access to this title plus top books and audiobooks from O’Reilly and nearly 200 top publishers, thousands of courses curated by job role, 150+ live events each month,
and much more.
Read now
Unlock full access