Categories


Tags


为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被搜狗收录?

sogou spider对网页的抓取,是通过网页与网页之间的链接实现的。

网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。

搜狗Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被搜狗收录,原因有两点:

A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化。

B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容。

如果您不希望这些私密性内容被搜狗收录,一方面可以通过robots协议加以限制;另一方面,也可以通过删除快照反馈给我们进行解决或者通过站长平台使用死链提交告知我们对其进行删除。


Public @ 2017-04-25 15:55:44

我想从搜索结果中删除整个网站或某个目录的内容?

情况一您是网站拥有者如果您是网站拥有者,则需要在验证网站所有权后申请删除整个网站或目录。为确保永久删除您的目录或网站,请使用 robots.txt 阻止抓取工具访问该目录(如果要删除的是网站,则应阻止抓取工具访问您的整个网站)。我们建议您在请求删除目录前或请求删除后不久执行该操作。否则,您的内容稍后可能会重新显示在搜索结果中。仅返回 404 HTTP 状态代码还不够,因为可能出现这样一种情况:即某

Public @ 2019-05-28 15:35:23

为什么我的网站收录量下降?

原因一:搜狗策略更新调整,对于搜狗引擎来说,更新调整是必须的,这才能不断提高用户得到的搜索结果的质量,一般的更新调整对于质量正常的网站的流量和排名并不大,此时小幅度的下降并不影响大局;但是对于质量本身存在问题的网站,如大篇幅影响正文阅读的广告、涉及色情、涉枪涉暴、违法乱纪等网站,这类网站往往会被策略的更新调整直接影响,这种情况下站长需要坚持提升网站质量,坚持非恶意优化,才能重新获得好的收录。原因二

Public @ 2020-07-20 15:34:37

新站,百度一直不收录,怎么诊断?

百度一直不收录新站的诊断,从这四个方面:1、查询域名历史,确保没被拉黑。如果这个域名之前被人用来做了灰色行业,则可能被百度等搜索引擎拉入黑名单。查看域名历史的查询工具:https://didi.seowhy.com/history.html2、进入百度搜索资源平台,确保抓取诊断正常。对首页、1-2个栏目页面、任选5-10个内页进行抓取诊断。确保能够成功抓取,并返回200。3、检查robots.tx

Public @ 2018-12-02 15:55:28

怎么查询网站近一个月的收录?

可以通过以下方式查询一个网站近一个月的收录: 1. 使用搜索引擎:在搜索引擎中输入site:网站URL,例如site:example.com,然后在搜索结果中选择“最近一个月”或“过去30天”的选项,即可看到该网站在最近一个月内被收录的文章或页面。 2. 使用SEO工具:有些SEO工具可以提供网站近一个月的收录情况,例如Ahrefs、SEMrush等。登录工具账户后,进入“站点探索”或“站点管

Public @ 2023-06-05 15:00:12

更多您感兴趣的搜索

0.615366s