找回密码
 加入怎通
查看: 538|回复: 3

[站长八卦] 分析网站日志中百度蜘蛛返回304状态码的情况

[复制链接]
cjxlyy 发表于 2012-09-02 11:29:20 | 显示全部楼层 |阅读模式
  1、服务器缓存缘故3 Y, l4 q, P$ c4 Q
  设置缓存的作用一般都是为了加速网站的提前加载,就像我们在浏览器**问网站的时候也比较容易出现缓存问题,当你打开一个网站之后,如果该网站有更新或者 有 变化,直接点击首页会发现还是之前访问的页面,而ctrl+F5重新加载后才会显示新的页面,这其实就是缓存的缘故。另外,有的时候和一些较大的网站换
& o8 [% R6 U6 o' v  友情链接也会遇到,对方加了友链之后首页不会马上显示,会因为缓存而需要过一段时间才能显示。
/ W5 m4 g/ j2 C& d. K, T  2、网站结构问题7 R1 L  N5 f! `
  如果网站结构不能有效的让蜘蛛顺利爬行,也就是说虽然蜘蛛有抓取,但由于网站结构问题导致蜘蛛前后两次抓取内容相同,或者说蜘蛛每次抓取首页都只抓了那块固定的内容,那么就势必导致蜘蛛对首页的抓取返回304状态码。# Q( X$ u; g& p- L7 D3 [
  3、网站速度问题9 C+ U" v9 I& Q, d' W  V! f
  谷歌就针对网站的加载时间更新过算法,把网站加载时间纳入了排名因素,就算搜索引擎排名不重视这点,对于用户体验也是有很大影响,谁也不会愿意多花时间在 一个需要加载几十秒甚至几分 钟的网站上面。而对于搜索蜘蛛也是如此,网站的加载速度也会影响蜘蛛的正常抓取,一般情况下网站都是从上往下的加载,而有的时候由于速度因素导致网站只加 载了头部,后面部分而没有及时显示出来,也可能导致蜘蛛只抓取了头部部分内容,而由于一般网站的头部都是相同的,也就容易出现了抓取返回没更新的状态码。6 P) a+ C" c/ i7 B; P
  另外,网络线路的互通也是一个因素。
! v6 d) w4 k2 X( p9 K; ^' L  4、网站内容问题
9 c7 s1 I( I- \4 Q6 e8 O+ p7 ]- Q  网上查找了下关于304状态码的一些内容,不少人都认为是网站内容长期采集或是伪原创也能导致蜘蛛返回该状态码,因为网站内容采集或伪原创的确会降低网站 质量,导致百度不收录等情况,搜索蜘蛛也会认为网站内容不具备收录的意义,那么也就不会抓取新的内容而返回没有更新的状态。
) u4 K# Y& ?, E( y, M9 h5 z  5、重视该状态码
! o- L; r, W: h( y# }  既然304状态码是表示未更新的情况,那么经常出现就需要引起重视,同时也需要观察出现该状态码的同时网站各方面数据的变化和趋势,以便对该状态码的影响有较好的了解。
4 p% O9 O: S5 C/ L0 O, S( J/ {* q  暂时网站出现304状态码之后经过百度更新收录有所减少,前几天有过断断续续的网站无法访问的情况,第二天网站首页就被K掉,在更换服务器之后恢复网站正常访问,次日首页再次恢复,目前仍需要观察和分析,才能更好掌握该状态码。( q/ g8 D/ W' b
  本文由抑郁症的表现http://www.cjxl120.com/发布,转载请注明!
& ]& z$ ]% G3 e( p- k
回复

使用道具 举报

啊喔呃 发表于 2012-09-02 11:33:54 | 显示全部楼层
分析很全面,差不多就是这些情况
回复 支持 反对

使用道具 举报

艾格 发表于 2026-01-24 16:17:01 | 显示全部楼层
刚好遇到类似问题,看完这个帖子心里有底了
回复 支持 反对

使用道具 举报

maxiaoguo 发表于 2026-03-16 13:46:16 | 显示全部楼层
这个思路很新颖,打开了新世界的大门,谢谢分享
回复 支持 反对

使用道具 举报

    您需要登录后才可以回帖 登录 | 加入怎通

    本版积分规则

    QQ|手机版|小黑屋|网站地图|真牛社区 ( 苏ICP备2023040716号-2 )

    GMT+8, 2026-5-2 03:39 , Processed in 0.414040 second(s), 23 queries , Gzip On.

    免责声明:本站信息来自互联网,本站不对其内容真实性负责,如有侵权等情况请联系420897364#qq.com(把#换成@)删除。

    Powered by Discuz! X3.5

    快速回复 返回顶部 返回列表