1. 首页
  2. 编程语言
  3. C#
  4. 文本聚类算法实现

文本聚类算法实现

上传者: 2019-02-21 07:35:01上传 ZIP文件 16.46KB 热度 51次
k均值算法文本聚类的具体实现过程 思路:计算两篇文档的相似度,最简单的做法就是用提取文档的TF/IDF权重,然后用余弦定理计算两个多维向量的距离。能计算两个文本间的距离后,用标准的k-means算法就可以实现文本聚类了。
用户评论
码姐姐匿名网友 2019-02-21 07:35:01

蛮好的,我觉得初始K值可以再优化下,找相对距离最大的,另外也可以根据 均值的加权平均 看数据突变情况,决定K的数量。

码姐姐匿名网友 2019-02-21 07:35:01

使用C#写的 有没有人用MATLAB写的 借鉴一下

码姐姐匿名网友 2019-02-21 07:35:01

挺好的,但是我不会改

码姐姐匿名网友 2019-02-21 07:35:01

可惜是C#的,没学过

码姐姐匿名网友 2019-02-21 07:35:01

C#写的,功能基本实现了。