Categories


Tags


为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被搜狗收录?

sogou spider对网页的抓取,是通过网页与网页之间的链接实现的。

网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。

搜狗Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被搜狗收录,原因有两点:

A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化。

B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容。

如果您不希望这些私密性内容被搜狗收录,一方面可以通过robots协议加以限制;另一方面,也可以通过删除快照反馈给我们进行解决或者通过站长平台使用死链提交告知我们对其进行删除。


Public @ 2017-04-25 15:55:44

搜索引擎对frame和iframe框架是否友好?

首先,Frame和iframe代码框架的意思是在当前页面中插入另一个页面,可以说是调用也可以说是使用代码插入。比方我们在的页面为a.html 对于a.html的页面我们存在不满意,但是为了达到某种目的。而再创建以个页面b.html 然后把b.html用js调用的方式或是其他div以及代码方式插入到a.html 。可以理解为b.html是当前页面中(a.html)的独立子页面,与父页面同时展示。需要

Public @ 2010-11-09 16:22:40

精确匹配搜索

(1)双引号“”如果您的查询词很长,360搜索可能会根据拆分后的查询词给出搜索结果,如果您不想输入的查询出被拆分,可以给您的查询词加上双引号。例如,如果您只想搜索北京大学的相关信息,而不是北京的所有大学的信息,您可以在搜索框中输入“北京大学”。(2)书名号《》在360搜索中,中文书名号是可以被查询的,加上书名号的查询词会有2个功能:一是可以在搜索结果中显示带书名号的关键词;二是保证这个词不会被拆分

Public @ 2014-06-24 16:22:47

 新建的网站未收录怎么办?

答:页面是否被收录,与页面是否具有价值有关,原则上内容越贴近用户的搜索需要,网页就会越快地被搜索引擎收录。但通常情况下页面从产生到收录需要一定周期,时间从几分钟到几天不等,这取决于网页的搜索价值和重要性的高低。长时间不收录的原因可能包括:1) 页面被惩罚整站或目录没有进行收录,2) 网页没有被搜索引擎发现,因为网页没有放置外部链接,本身是个孤岛页面。针对第一种情况,首先请查看网站是否出现过无法打开

Public @ 2014-10-05 15:34:34

如何让我的网站(独立网站或者blog)被百度收录?

要让你的网站被百度收录,你可以执行以下几个步骤: 1. 创建和提交 sitemap: 创建网站地图(sitemap)并将其提交给百度站长平台。网站地图是一个包含你网站所有页面的清单,百度蜘蛛可以通过这个清单更好地了解你的网站结构。 2. 提交网站URL: 在百度站长平台上提交你的网站URL,这将通知百度搜索引擎你的网站的存在。提交时,确保提供准确且完整的网站URL。 3. 注册百度站长平台:

Public @ 2023-06-30 23:50:24

更多您感兴趣的搜索

0.390220s