1. 首页
  2. 数据库
  3. 其它
  4. 余弦相似性计算及python代码实现过程解析

余弦相似性计算及python代码实现过程解析

上传者: 2021-02-01 12:43:03上传 PDF文件 37.62KB 热度 35次
A:西米喜欢健身 B:超超不爱健身,喜欢打游戏 step1:分词 A:西米/喜欢/健身 B:超超/不/喜欢/健身,喜欢/打/游戏 step2:列出两个句子的并集 西米/喜欢/健身/超超/不/打/游戏 step3:计算词频向量 A:[1,1,1,0,0,0,0] B:[0,1,1,1,1,1,1] step4:计算余弦值 余弦值越大,证明夹角越小,两个向量越相似。 step5:python代码实现 import jieba import jieba.analyse def words2vec(words1=None, words2=None): v1 = [] v2 = [] t
下载地址
用户评论