Which statement best describes the unsupervised learning process when performing clustering on a large data set?