kmeans算法文本聚类java源码(分词,TF/IDF等)
算法思想:提取文档的TF/IDF权重,然后用余弦定理计算两个多维向量的距离来计算两篇文档的相似度,用标准的k-means算法,整个工程可以直接运行,
下载地址
用户评论