或者

百度是如何把搜索结果序列展现给用户的

作者:dengying 浏览:1688 发布时间:2015-04-30
编辑 分享 评论 0

  

    要探讨当用户使用百度搜索引擎查询关键词的时候,百度如何把结果序列展现给用户。

  一、特征词库的类别的建立与更新

  众所周知,百度有特征词库,通过特征词库,可以对用户查询序列,进行判断。例如:当用户搜索“天龙八部在线观看” 、 “射雕英雄传在线观看” 、 “鹿鼎记在线观看” 、 “电视剧在线观看” 时, 由于这些待挖掘序列中的 “天龙八部” 、 “射雕英雄传” 、 “鹿鼎记” 、 “电视剧” 在需求特征词库中属于视频类需求的特征词, 并且 “在线观看” 这一关键词与上述视频类需求的特征词的共现频次达到一定阈值(共现阈值)时,根据关键词 “在线观看” , 提取关键词 “在线观看” 与视频需求类别的映射关系, 并根据映射关系来建立或更新需求特征词库。

  二、对词条的分类

  首先对查询序列进行切词处理获得切分后的词条, 再通过诸如对词条进行语义分析或根据词条在需求特征词库中进行匹配查询等方式, 来获得所述候选需求类别。例如:用户的查询序列为 “土豆上的热门影视剧” 时, 通过对其进行切词处理, 得到 “土豆 /热门 / 影视剧” , 由于影视剧一词具有明显的需求类别, 诸如视频、 下载、 图片、 演员介绍,再通过诸如对词条进行语义分析或根据所述词条在需求特征词库中进行匹配查询等方式, 来获得候选需求类别。

  当挖掘序列相对应的分类结果的用户累计点击次数超过预设点击阈值时, 基于所述分类结果所对应的需求类别, 提取待挖掘序列与需求类别的映射关系, 并根据映射关系来建立或更新需求特征词库,例如, 当待挖掘序列为“日本地震” 时, 根据该待挖掘序列对应的分类结果, 如视频类搜索结果、 新闻类搜索结果、图片类搜索结果, 若视频类搜索结果对应的用户累计点击次数为 300, 新闻类搜索结果对应的用户累计点击次数为 25000, 图片类搜索结果对应的用户累计点击次数为 700, 预设点击阈值为 10000 时, 将待挖掘序列对应的分类结果的用户累计点击次数与预设点击阈值进行比较, 并根据高于所述预设点击阈值的分类结果所对应的需求类别, 即新闻需求类别, 提取该待挖掘序列与新闻需求类别间的所述映射关系, 并根据映射关系来建立或更新需求特征词库。

  三、获取需求度

  1、获取与用户的查询序列相对应的原始搜索结果

  2、获取与查询序列相对应的候选需求类别

  对原始搜索结果进行处理,根据查询序列, 通过诸如对查询序列进行语义分析或根据查询序列在需求特征词库中进行匹配查询等方式, 来获得候选需求类别。例如, 当用户的查询序列为 “土豆上的热门影视剧” 时, 通过对其进行切词处理, 得到 “土豆 / 热门 /影视剧” , 由于影视剧一词具有明显的需求类别, 诸如视频、 下载、 图片、 演员介绍, 对该查询序列进行语义分析或在需求特征词库中进行匹配查询, 来获得候选需求类别, 例如根据 “影视剧” 可知该查询序列对应的候选需求类别包括视频、 下载、 图片、 演员介绍。

  3、根据查询序列与候选需求类别,确定与查询序列相对应的类别需求度

  根据查询序列和候选需求类别, 通过诸如对该查询序列所对应的搜索结果按类别进行统计分析或者对关于搜索结果的历史点击记录按类别进行统计分析, 确定所述查询序列对于每一候选需求类别的类别需求度。例如:“×× 影视明星” 时, 根据查询序列,得到候选需求类别包括视频、 新闻、 背景介绍、 音乐、 图片, 然后根据查询序列和候选需求类别, 通过诸如对该查询序列所对应的搜索结果按类别进行统计分析或者对关于搜索结果的历史点击记录按类别进行统计分析, 确定与所述查询序列相对应的类别需求度, 如, “×× 影视明星” 查询序列在视频类的类别需求度为 0.3 ; 查询序列在新闻类的类别需求度为 0.3 ; 查询序列在背景介绍类的类别需求度为 0.1 ; 查询序列在音乐类的类别需求度为 0.2 ; 以及查询序列在图片类的类别需求度为 0.1。

  需求度确定

  用户的查询序列为 “×× 影视明星” , 将查询序列在需求特征词库中进行匹配查询,当在需求特征词库中匹配查询到 ×× 影视明星属于明星列表并且该明星列表对应的需求类别包括视频、 新闻、 背景介绍、 音乐和图片时,得到与查询序列相对应的候选需求类别包括视频、 新闻、 背景介绍、 音乐和图片。结合该查询序列相应的大量用户的点击统计分析, 如:统计分析结果中表明视频类搜索结果、 新闻类搜索结果、 背景介绍类搜索结果、 音乐类搜索结果与图片类搜索结果的用户点击频次分别为 60000 次、 10000 次、 10000 次、 10000 次和10000 次, 则查询序列对于视频类搜索结果的类别需求度为 0.6, 而对于图片类搜索结果的类别需求度为0.1。


词条统计

  • 浏览次数:1688
  • 编辑次数:0次历史版本
  • 最近更新:2015-04-30
  • 创建者:dengying
  • 相关词条

    相关问答

    相关百科

    相关资讯