您当前的位置: > 详细浏览

一种自动分类的网页搜索排序算法

请选择邀稿期刊:
摘要: 针对传统网页排序算法Okapi BM25通常会出现网页与查询关键词领域无关的领域漂移现象,以及改进算法需要人工建立领域向量的问题,提出了一种基于BM25和Softmax回归分类模型的网页搜索排序算法。该方法首先对网页文本进行数据预处理并利用词袋模型进行网页文本的向量表示,之后通过少量的网页数据来训练Softmax回归分类模型,来预测测试网页数据的类别分数,并与BM25信息检索的分数结合在一起,得到最终的网页排序结果。实验结果显示该检索算法无须人工建立领域向量,即可达到很好的网页排序结果。

版本历史

[V1] 2018-05-20 10:29:44 ChinaXiv:201805.00208V1 下载全文
点击下载全文
预览
许可声明
metrics指标
  •  点击量1241
  •  下载量751
评论
分享