
378
20 Automatisches Indexieren
• Zur Bestimmung der Ähnlichkeit verwendet die Informationswissenschaft
Koeffizienten von Jaccard und Sneath, von Dice sowie den Cosinus (nach Sal-
ton). Die Koeffizienten finden bei einer Treffermenge Einsatz und fuhren zu
einer Ähnlichkeitsmatrix der Trefferdokumente. Die darauf aufbauende
Clusteranalyse arbeitet entweder nach dem Single-Link-, dem Complete-Link
oder nach dem Group-Average-Link-Verfahren. Sinnvoll sind hierarchische
Klassierungen; an der Nutzerschnittstelle ist der Einsatz von Informationsvisu-
alisierung hilfreich.
Literatur
Anderberg, M.R. (1973): Cluster Analysis for Applications. - New York ...