服务器限制外网访问造成主动推送失败(第二期)

来源:百度搜索资源平台     作者:搜索学院     时间:2019-02-27

在【院长帮帮忙】栏目露过面的站点是编织汇(www.bianzhihui.com),该站点通过反馈中心反馈页面内容迟迟不被抓取,经百度工程师追查,原来是因为页面上的无用时间信息——没有想到是不是?同学们快来看看这个案例吧。也想让院长帮助追查吗?


站点求助:现象

  编织汇火狐体育直播平台内容发布后几个礼拜都未曾收录。案例如下:

  http://www.bianzhihui.com/t/6717(教程详细页面举例)

  http://www.bianzhihui.com/u/12306 (用户页面举例)

  http://www.bianzhihui.com/h/154 (编织花样页面举例)

  我们已将这些url放入sitemap,并使用了百度统计的集成的JS推荐,但是未曾有改善。


站点求助:自查

  根据反馈中心的回复,使用抓取异常工具诊断:未发现异常


院长出手,内部追查

  工程师结论: spider抓取很及时,但因为该火狐体育直播平台没有设置内容产出时间,火狐体育直播平台底部却有个老旧时间日期,导致spider误以为网页内容老旧(具体策略较复杂,在此不做赘述)。建议增加页面内容产生时间,去掉没有必要的时间信息



  *以上为旧页面截图,“2014年9月9日”对时间识别造成干扰。


站点总结:

  1,网页上切忌勿乱加时间,如我们火狐体育直播平台的(始于2014年9月9日)这种时间是一个大忌

  2,网页内容尽可能加上产出时间,也就是发布时间

  3,百度site的结果时间和权重并无太多关系

  4,跟百度沟通的时候,一定要条例清晰,证据确凿。自身的问题一定要先排查准确。


【院长帮帮忙】第二期:服务器限制外网访问造成主动推送失败


【院长帮帮忙】第三期:无效搜索结果页是个祸害


【院长帮帮忙】第四期:URL构成越简单越平常越好


推荐阅读

我的火狐体育直播平台排名为什么突然下降?(第十期)


标签: 服务器