When applying k-means to categorical data, which variant is the appropriate alternative?
-
A
k-modes, which uses mode instead of mean and Hamming-based dissimilarity
-
B
k-medoids, which selects actual data points as cluster centers
-
C
Fuzzy c-means, which allows soft cluster memberships
-
D
OPTICS, which uses reachability distances for ordering