Categories


Tags


为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被搜狗收录?

sogou spider对网页的抓取,是通过网页与网页之间的链接实现的。

网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。

搜狗Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被搜狗收录,原因有两点:

A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化。

B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容。

如果您不希望这些私密性内容被搜狗收录,一方面可以通过robots协议加以限制;另一方面,也可以通过删除快照反馈给我们进行解决或者通过站长平台使用死链提交告知我们对其进行删除。


Public @ 2017-04-25 15:55:44

如何让我的网页不被百度收录?

百度严格遵循搜索引擎Robots协议(详细内容,参见http://www.robotstxt.org//)。您可以设置一个Robots文件以限制您的网站全部网页或者部分目录下网页不被百度收录。具体写法,参见:如何撰写Robots文件。如果您的网站在被百度收录之后才设置Robots文件禁止抓取,那么新的Robots文件通常会在48小时内生效,生效以后的新网页,将不再建入索引。需要注意的是,robot

Public @ 2019-10-18 15:55:52

百度搜索结果页面无限自动重复刷新,看不到搜索内容

当您使用百度搜索出现上述情况时,极有可能是您被  “  劫持  ”  了。  解决方案:1、建议您尝试加密连接https://www.baidu.com 进行搜索,看看问题是否依然存在。(1)需要注意的是,如果您的 IE 浏览器版本较低,比如在 IE8 及以下版本的浏览器中,是无法通过 https 加密链接使用百度服务的。(2)我们强烈建议您对 I

Public @ 2014-04-28 16:23:11

网站不收录怎么办?5个方法帮你解决!

关于网站不收录,需要分情况讨论,比如:新站点不收录、产品或者案例页面不收录、新发文章不收录、栏目页面不收录、聚合页面不收录、当天不收录、一周或者一个月不收录、网站被K、降权后恢复不收录等。。。。。不同的情况需要不同的方法去应对。今天科牛就结合自己的经验,分享下我处理这些问题的心得。网站不收录怎么办?5个方法帮你解决! 网站 经验心得 第1张一、新站点,一个月了还没有收录首先需要排除服务器访问慢、被

Public @ 2015-07-26 15:55:17

更多您感兴趣的搜索

0.502557s