1. 首页
  2. 移动开发
  3. 其他
  4. 论文研究 一种自动分类的网页搜索排序算法.pdf

论文研究 一种自动分类的网页搜索排序算法.pdf

上传者: 2020-07-17 12:07:25上传 PDF文件 1.14MB 热度 18次
针对传统网页排序算法Okapi BM25通常会出现网页与查询关键词领域无关的领域漂移现象,以及改进算法需要人工建立领域向量的问题,提出了一种基于BM25和softmax回归分类模型的网页搜索排序算法。方法对网页文本进行数据预处理并利用词袋模型进行网页文本的向量表示,之后通过少量的网页数据训练Softmax回归分类模型,来预测测试网页数据的类别分数,并与BM25信息检索的分数结合在一起,得到最终的网页排序结果。实验结果显示该检索算法无须人工建立领域向量,即可达到很好的网页排序结果。
下载地址
用户评论