百度抓取网页判断该页面质量时,会受到该页面发布时间的影响。
而由于网站有时会面临着更换域名,而百度不会由于某个网站更换域名后,在重新收录时,就认为所有页面都是最新更新的。
所以,为了避免这种不公平的判断,百度会把页面内的文章发布日期作为其中一个判断标准,去判断该页面的发布时间,从而生成对应的快照时间。
所以,对于新站,若一次需要更新很多篇文章,又怕百度误认为是采集的,那么在每篇文章里,就一定要加上文章发布日期,从而“帮助”百度去“了解”该文章的发布时间。
百度爬到的文章时间几乎都不一样,百度会认为这个网站只是新域名,但是是旧数据,所以就不会随便把一次性更新的大量文章误认为是采集的了。
当然不是绝对的,因为百度判断页面质量的因素非常多,所以这个因素只是降低新站进入沙河的概率。
欢迎分享,转载请注明来源:夏雨云
评论列表(0条)