您当前的位置: 首页 > 时尚

一蜘蛛访问的次数停留时间以及抓取的数量

2018-10-28 12:13:12

通过对站日志的分析,我们可以很好的判断我们的站的健康程度,并且还可以看到蜘蛛抓取的记录以及用户的一些行为记录,这样数据对于我们来讲无疑是 提升站的一个关键,可以时刻的让我们看到站的不足之处,从而进行改正。然而今天与大家分享的主要是蜘蛛抓取的行为,希望对各位站长有所帮助。

(一)蜘蛛访问的次数、停留时间以及抓取的数量。

从小标题中的三个提到的数据我们可以了解到下面几点信息:

1、平均每次抓取页面数=总抓取量/访问次数

2、单页抓取停留=每次停留/每次抓取

3、平均每次停留时间=总停留时间/访问次数

以上三点载自百度百科。

从这些数据中我们可以很好的看出百度蜘蛛在我们站上的活跃度、是否亲和,以及我们站内容抓取的深度等等有效的数据。当我们站中总的访问频次、蜘 蛛停留的时间,以及站抓取程度的是否高,从这些都是可以看出我们站是否受到蜘蛛的喜爱。并且在我们单页面的蜘蛛停留时间的长短也可以看出我们的文章页 面是否受蜘蛛的喜爱。

小提示:如果你想要长期发展一个站的话,建议各位定期的整理出站数据报表,这样对我们站的发展也会有着很好的帮助。

(二)站目录蜘蛛抓取的统计。

通过站日志的分析,可以很好的看出我们的那些目录比的程度。对于那些我们不希望蜘蛛抓取的页面,也可以进 行屏蔽。

(三)站页面的抓取。

通过日常的日志分析统计中,我们可以看出那些站页面比较受蜘蛛的喜爱,并且可以了解到蜘蛛在这些页面的抓取行为,例如说蜘蛛是否抓取了一些没有被收 录价值的页面,或者重复的抓取了一些页面等,大家都知道这样会影响到我们站其他页面的权重传递的。就比如说的站皮肤栏目通常就要比名字栏目抓取的 勤快,收录健康程度也较好,所以现在定期在名字栏目的文章中添加进入一些图片,不仅仅美观还有效的提升了名字栏目文章的收录,所以通过分析,我们可以 屏蔽蜘蛛抓取这些没有价值的页面,也有效的提高了我们其他页面权重的传递,并且学习蜘蛛比较喜爱的页面优点来补充其他页面的不足。

(四)了解蜘蛛是否访问我们的页面以及访问页面的状态代码。

很多朋友的站主页快照经常不正常,站发布的文章也经常不收录,面对这样的情况我们都会想蜘蛛有没有到我们的站抓取。这时候我们也可以通过站日 志来看是否有蜘蛛IP的记录就可以了解蜘蛛是否来爬行我们的站,从而判断是否是我们站质量的原因导致不收录。并且也可以看出蜘蛛访问我们站页面的状 态代码,例如说301、503、403等,当出现这样情况的时候,我们尽早做处理,以免成为站降权的隐患。

(五)了解蜘蛛抓取的时间段。

通过日常日志分析总结中,你会很奇妙的发现一件事,那就是蜘蛛会在每天的一个特定时间内在站爬行抓取的很活跃,当我们了解到这样的情况,我们就可以再特定的时间去更新站内容,这个可以更加有效的让蜘蛛抓取我们站内容,从而达到一个秒收的效果。

总结:如果一个站想要长久发展的话,站长们一定要学会分析站日志,从而了解站每天的健康状况,并且发现异常情况的时候即使改正,这样不仅仅对 站有很大的帮助,还有效的防止站因为这些异常引发的降权、被K等现象。

文章来自 /供稿,转载请带上链接,谢谢。

注:相关站建设技巧阅读请移步到建站教程频道。

滨江金茂府
新湖明珠城
珠海海印又一城
推荐阅读