About this document
Data Similarity and Dissimilarity Measures by Mandisa Ndlovu is a document available to read on EtoBox.
This section discusses methods for measuring data similarity and dissimilarity, which are essential for data mining applications like clustering and classification. It explains the concepts of data and dissimilarity matrices, proximity measures for various types of variables, and how to compute dissimilarity for nominal and binary variables. The document emphasizes the importance of these measures in identifying groups of similar data objects for analysis.
- Author
- Mandisa Ndlovu
- Language
- EN