Categories


Tags


网站日志的分析是每个SEO人员的必备技能之一

每个做SEO的站长们都应该基本分析网站日志的能力。因为通过网站的日志可以分析出搜索引擎蜘蛛的动态,用户访问的动态,以及发现网站哪些链接存在异常。

网站日志的分析和诊断就像给网站看病一样,我们通过网站日志的分析,可以更加清楚的知道网站的健康状况,可以利于这些数据让我们更好的做网站SEO优化。下面就和大家说下日志分析的一些事项:

常见的蜘蛛名称:

Baiduspider;Baiduspider-Image;Googlebot;Googlebot-Image;360Spider;sogou spider。

一、网站日志的重要作用?

1、通过网站日志可以了解蜘蛛对网站的基本爬取情况,可以知道蜘蛛的爬取轨迹和爬取量,通过我们的网站日志,外链的多和少和网站蜘蛛的爬取量是有直接影响的,我们所说的链接诱饵就是如果你做了一个外链,蜘蛛在爬取这个外链页面并把页面放出来时,蜘蛛可以通过你留的这个链接来爬取你的网站,而网站日志正是会记录下蜘蛛的这次爬取行动。

2、网站的更新频率也和网站日志中蜘蛛抓取的频率有关,一般来说更新频率越高,蜘蛛的抓取频率越高,而我们网站的更新不但仅只是新内容的添加同时还有我们的微调操作。

3、我们可以按照网站日志的反应情况,对我们的空间的某些事情和问题提前进行预警,因为办事器如果出问题的话在网站日志中会第一时间反映出来,要知道办事器的不变速度和打开速度两者都会直接影响我们的网站。

4、通过网站日志我们可以知道网站的那些页面是很受蜘蛛欢迎的,而哪些页面是蜘蛛连碰都不去碰的,同时我们还能发现有一些蜘蛛由于是过度爬取对我们的办事器资源损耗是很大的,我们要进行屏蔽工作。

二、如何下载日志及日志设置注意事项?

1、首先我们的空间要支持网站日志下载,这一点是很重要的,在我们购买空间之前必需要先问好支不支持网站日志下载,因为有的办事商是不提供这项办事的,如果支持的话空间后台一般都有日志WebLog日志下载这个功能把它下载到根目录在用FTP传到当地就可以,办事器的话可以设置将日志文件下载到指定路径。

2、这里有个很重要的问题,网站日志强烈建议设置成每小时生成一次,小型的企业站和页面内容较少的网站可以设置成一天,它默认是一天,如果内容多或者大型站设置成一天生成一次,那么一天只生成一个文件,这个文件会相当的大,我们有时电脑打开是会造成死机,设置的话找空间商协调设置即可。

三、网站日志的分析。

1、日志的后缀名是log的我们用记事本打开,选择格式里的自动换行这样看起来便利,同时用搜索功能搜索BaiduSpider和Googlebot这两个蜘蛛。

例如:

百度蜘蛛 2012-03-13 00:47:10 W3SVC177 116.255.169.37 GET / – 80 – 220.181.51.144 Baiduspider-favo+(+ baidu /search/spider ) 200 0 0 15256 197 265

谷歌机器人 2012-03-13 08:18:48 W3SVC177 116.255.169.37 GET /robots.txt – 80 – 222.186.24.26 Googlebot/2.1+(+ google /bot ) 200 0 0 985 200 31

我们分段来解释

2012-03-13 00:47:10 蜘蛛爬取的日期和时间点;W3SVC177 这个是机器码这个是惟一的 我们不去管它;116.255.169.37 这个IP地址是办事器的IP地址;GET 代表事件,GET后面就是蜘蛛爬取的网站页面,斜杠就代表首页,80 是端口的意思,220.181.51.144 这个IP则是蜘蛛的IP,这里快排发包技术小编告诉大家一个辨别真假百度蜘蛛的方法,我们电脑点击开始运行输入cmd打开命令提示符,输入nslookup空格加蜘蛛IP点击回车,一般真百度蜘蛛都有本身的办事器IP而假蜘蛛则没有。

如果网站中出现了大量的假蜘蛛则说明有人冒充百度蜘蛛来采集你的内容,你就需要注意了,如果太跋扈獗那会很占用你的办事器资源,我们需要屏蔽他们的IP.

200 0 0这里是状态码 状态码的意思可以在百度里搜索下;197 265最后两个数字则代表着拜候和下载的数据字节数。

2、我们分析的时候先看看状态码 200代表下载成功,304代表页面未修改,500代表办事器超时,这些是一般的其他代码可以百度一下,对于差别的问题我们要处理。

3、我们要看蜘蛛经常爬取哪些页面,我们要记录下来,分析他们为什么会经常被蜘蛛爬取,从而分析出蜘蛛所喜欢内容。

4、有时候我们的路径不统一出现带斜杠和不带斜杠的问题,蜘蛛会自动识别为301跳转到带斜杠的页面,这里我们就发现了搜索引擎是可以判断我们的目录的,所以我们要对我们的目录进行统一。


Public @ 2011-11-26 15:32:55

不同后缀的域名在搜索引擎中的权重有区别吗?

一般来说,权威专业的站点更能获得搜索引擎的喜爱。由于.edu和.gov后缀域名并不是任何人都能注册,需要注册单位出示相关机构材料证明才能注册,这两类域名上发布的信息具有居多的权威性和原创性,所以我们会发现.edu和.gov的站点总是在搜索中有好的排名。像Google那样的对全球网页进行索引的搜索引擎,当用户查询时候,它会把与用户所处地域和使用语言等信息匹配的搜索结果展示给用户,而不出现Google

Public @ 2018-05-12 15:25:27

国外SEO现况

有的读者问我国外SEO行业的现况怎样,因为我读的大部分博客和论坛都是英文的,对这方面稍微有一些了解。关于最新的国外SEO技术方面的情况,在其他帖子里都持续有介绍,这里就不多谈了,今天主要介绍几个SEO行业经营的特点。白帽SEO占据话语主流与国内SEO行业情况相比,国外SEO行业的话语主动权基本上是掌握在白帽SEO手里。无论是搜索引擎本身,还是网站设计公司或者客户,对SEO都有比较正确的认识。白帽S

Public @ 2012-03-01 16:14:11

服务器日志是什么?如何查看服务器日志?

服务器日志是服务器记录的各种系统和应用程序事件的文件。它们包括错误、警告和信息性事件,以及与服务器相关的活动。 服务器日志文件通常存储在特定的目录中,具体位置取决于操作系统和服务器类型。一般情况下,可以通过以下方法查看服务器日志: 1. 打开控制台:登录到服务器并打开控制台。控制台提供了一种快速查看日志文件的方法。 2. 使用命令行工具:在控制台或SSH会话中使用适当的命令行工具来查看日志

Public @ 2023-06-14 02:50:29

分享两款日志分析工具,光年日志和andiislog

我先简单介绍下这两款网站日志工具,iislog相对比较简单,日志分析很清晰,可以看下图。iislog能清晰的看到蜘蛛来访时间、蜘蛛类型、蜘蛛IP、链接方式、服务器返回的代码、最后是蜘蛛访问网站的地址,一目了然。分享两款iis网站日志分析工具 光年日志分析工具和iislog日志分析工具光年日志分析工具在分析的数据上做得更加细化,概要分析处可以看到各搜索引擎蜘蛛来访次数 、总停留时间(小时) 、总抓取

Public @ 2009-09-07 15:32:54

更多您感兴趣的搜索

0.499581s