Categories


Tags


怎样看原始日志文件

读者hiisee问

请问如何用PHP脚本在后台获取蜘蛛的详细信息呀?如哪里的蜘蛛/何时来的/搜索了哪几个页面/哪些它喜欢哪些不喜欢等,和判断浏览器是不是用一样的技术?谢谢,再次麻烦您了.

刚好关于流量统计和分析以前还没有谈过,这两天分几个方面专门谈一下。今天先来谈作为SEO,怎样读服务器原始日志文件(server raw logfile)。

网站服务器会把每一个访客来访时的一些信息自动记录下来,存在服务器原始日志文件中。

一般主机提供商会在控制面板提供给你下载这个文件,如果你的主机提供商不提供原始日志文件的话,你就该换地方了。

原始日志文件只是一个纯文字形式的文件,只要用文字编辑软件如WordPad或Notepad打开就可以了。

下面是我从上个月这个blog本身的日志文件中随机选取的一行,我们来看一下它包括哪些信息:

221.201.77.63 – – [02/Jul/2006:15:30:41 +0800] “GET /seoblog/2006/04/17/user-friendly-website/ HTTP/1.1” 200 19031 “http://www.baidu.com/s?

wd=PRADA%B9%D9%B7%BD%CD%F8%D5%BE&cl=3” “Mozilla/4.0 (compatible; MSIE 6.0; Windows NT 5.1; SV1; Alexa Toolbar)”

(注:虽然上面是很久以前的日志中的一段,但现在的日志文件所包含的信息格式是一样的,完全没有变化)

用户IP地址

221.201.77.63

这是访问人所使用的IP 地址,能够告诉你来访的人来自什么地理位置。如果你查一下这个IP地址所属位置,可以看到这位访客来自中国北京。

日期/时间

02/Jul/2006:15:30:41

这是某一个文件被访问的时间,和IP地址结合起来,你就可以跟踪某一个特定的用户,从一个网页到另一个网页的访问顺序。

时区

+0800

这个数字是相对格林威治时间的时区差多少,北京处于东8区。

服务器动作

GET /seoblog/2006/04/17/user-friendly-website/ HTTP/1.1

服务器要做的动作要么是GET,要么是POST。除了一些CGI脚本外,通常都应该是GET,也就是从服务器上获取某个网页或图片文件。

例子里的这行意思就是按HTTP/1.1协议(protocol)获取文件/seoblog/2006/04/17/user-friendly-website/

返回状态码

200

下一行是服务器反应是否成功。200就是说成功获取了文件,如果是返回了404,就是文件没有找到。401是需要密码,403禁止查看,500服务器错误,当然还有其他很多服务器状态码。

文件大小

19031

这一行指的是所获取的文件大小,在我们的来自例子里是19031 byte。

访客来源

http://www.baidu.com/s?wd=PRADA%B9%D9%B7%BD%CD%F8%D5%BE&cl=3

这一段是告诉我们访客是从哪里来到这一个网页。有可能是同一个网站的其他页,有可能是来自搜索引擎的搜索页,也可能是来自其它网站的链接。

例子里的是来自百度,搜索关键词是”PRADA官方网站”。

这段信息以前是非常重要的,流量分析系统可以从这个信息统计出搜索用户是搜索了什么关键词访问你的网站。可惜的是,现在所有搜索引擎都已经屏蔽了这段关键词信息,我们只能知道流量来自哪个搜索引擎,无法知道是来自什么关键词。

浏览器类型

Mozilla/4.0 (compatible; MSIE 6.0; Windows NT 5.1; SV1; Alexa Toolbar)

这最后一段所表示的是浏览器和用户电脑的一些信息。

比如上面这一段所表示的是用户所使用的电脑是与Netscape兼容的Mozilla浏览器,Windows NT操作系统,浏览器是IE6.0,装有Alexa Toolbar。

在这一段如果用户使用的是其他类型电脑或浏览器,或者来访问的是搜索引擎蜘蛛,你还可能看到这些代码:

Baiduspider+(+http://www.baidu.com/search/spider.htm)

Mozilla/4.0 (compatible; MSIE 6.0; Windows NT 5.0; Maxthon; Alexa Toolbar)

http://www.gougou.com RSS Online Reader

Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)

意义不用解释,一看就知道了。

跟踪用户轨迹

这是很多网站运行者需要研究的地方。

从日志文件中剔除对图片的访问,剔除中间插进来的其他访客的信息,只把来自某一个IP地址的用户在一段时间内所看的网页列出来,我们就能看到这个用户在你的网站上都做了哪些行动,看了哪些网页。

用户行为信息给网站运行者提供很大的帮助。

来源:seo每天一贴 Zac 昝辉


Public @ 2013-10-12 15:32:49

Matt Cutts谈总体搜索质量和新的基础架构

Matt Cutts在谷歌的一次采访中谈到了总体搜索质量和新的基础架构的问题。 他认为,谷歌一直在不断改进其搜索算法和质量评估方法,以便能够更好地为用户提供相关的搜索结果。此外,谷歌还在研究和改进搜索结果的呈现方式,使它们更易于理解和使用。 除此之外,Matt Cutts还提到了谷歌正在开发一种新的基础架构,以更好地支持其搜索和其它服务。这个新的基础架构将采用更先进的技术和系统,以提高谷歌的性

Public @ 2023-06-12 07:00:21

这些不常见的域名后缀,你怎么看?

目前,互联网上有一些开放注册的域名,如:类似的还有:.party, .science等。此类域名注册成本相对较低,因此成为了站群作弊者的温床,部分站群作弊者注册一个站点作弊,一旦被发现,马上新换另外一个。因此针对这类域名后缀,学堂君不建议各位站长们使用,可能会出现搜索收录延迟等问题;如有发现正当运营的此类域名站点,请在平台验证站点,系统效验站点内容后,则会保持跟其他正常域名一样的收录优先级,请各位

Public @ 2015-01-31 15:25:22

做网站SEO优化,网站日志分析是必备的技能

1. 编写有吸引力的标题和元标签:让你的网站在搜索引擎的搜索结果中脱颖而出。 2. 使用关键词:添加关键词来调整网站内容,更好地搜索到消费者想看到的东西。 3. 优化内部链接:通过优化内部链接,使搜索引擎非常容易发现你的网站。 4. 发布有质量的内容:优质的内容可以吸引到目标客户,并且可以长期增加搜索排名。 5. 增加外部链接:通过向其他网站添加链接,可以为你的网站提供权威性和可信度,

Public @ 2023-02-26 03:27:24

网站日志的分析是每个SEO人员的必备技能之一

之一是因为网站日志分析可以提供宝贵的数据和洞察力,帮助SEO人员了解网站的表现、用户行为以及搜索引擎的索引情况。以下是网站日志分析对于SEO人员的重要性: 1. 网站流量分析:通过分析网站日志,SEO人员可以了解网站的流量来源、用户访问路径和流量转化率。这些信息可以帮助他们确定哪些页面受欢迎,并帮助他们制定优化策略以提高流量和转化率。 2. 网站排名分析:网站日志分析可以帮助SEO人员了解搜索

Public @ 2023-07-20 23:00:42

更多您感兴趣的搜索

0.503623s