Categories


Tags


为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被搜狗收录?

sogou spider对网页的抓取,是通过网页与网页之间的链接实现的。

网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。

搜狗Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被搜狗收录,原因有两点:

A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化。

B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容。

如果您不希望这些私密性内容被搜狗收录,一方面可以通过robots协议加以限制;另一方面,也可以通过删除快照反馈给我们进行解决或者通过站长平台使用死链提交告知我们对其进行删除。


Public @ 2017-04-25 15:55:44

搜索引擎定义

搜索引擎是指根据一定的策略、运用特定的计算机程序从互联网上采集信息,在对信息进行组织和处理后,为用户提供检索服务,将检索的相关信息展示给用户的系统。搜索引擎是工作于互联网上的一门检索技术,它指在提高人们获取搜集信息的速度,为人们提供更好的网络使用环境。从功能和原理上搜索引擎大致被分为全文搜索引擎、元搜索引擎、垂直搜索引擎和目录搜索引擎等四大类。   搜索引擎发展到今天

Public @ 2011-09-12 16:22:56

我想从搜索结果中彻底删除某个网页

为确保永久删除您的内容,请进行以下某项操作。如果您没有进行相应操作,那么您的网站稍后可能会重新显示在搜索结果中。A.如果网页已不存在,请确保服务器返回 404(未找到)或 410(不存在)。这样可让搜狗知道该网页已不存在,无需再在搜索结果中显示。B.如果网页仍存在,但您不想让其显示在搜索结果中,请使用 robots.txt 阻止 sogou spider 进行抓取。请注意,在通常情况下,即使您已通

Public @ 2010-05-25 15:35:25

如何让我的网站(独立网站或者blog)被百度收录?

百度会收录符合用户搜索体验的网站和网页。为促使百度Spider更快的发现您的站点,您也可以向我们提交一下您的网站的入口网址。提交地址是:http://zhanzhang.baidu.com/sitesubmit。您只需提交首页即可,无需提交详细的内容页面。百度的网页收录机制,只和网页价值有关,与百度推广等商业因素没有任何关联。

Public @ 2015-11-21 15:55:53

网站不收录怎么办,这几个自测是否没做过?

作为AI语言模型,我不能确定你是否做过这几个自测。但是,如果你的网站没有被收录,你可以采取以下步骤: 1. 使用Google和Bing的Webmaster工具提交网站地图,这有助于搜索引擎更快地索引您的网站。 2. 确保您的网站内容是唯一的,有价值的且更新频繁。可以添加博客文章、新闻和其他有用的信息,以吸引搜索引擎的注意。 3. 确保您的网站上有良好的元标记,例如标题标记、描述标记和关键字标

Public @ 2023-06-13 01:00:25

更多您感兴趣的搜索

0.483232s