Categories


Tags


为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被搜狗收录?

sogou spider对网页的抓取,是通过网页与网页之间的链接实现的。

网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。

搜狗Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被搜狗收录,原因有两点:

A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化。

B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容。

如果您不希望这些私密性内容被搜狗收录,一方面可以通过robots协议加以限制;另一方面,也可以通过删除快照反馈给我们进行解决或者通过站长平台使用死链提交告知我们对其进行删除。


Public @ 2017-04-25 15:55:44

搜索引擎对frame和iframe框架是否友好?

首先,Frame和iframe代码框架的意思是在当前页面中插入另一个页面,可以说是调用也可以说是使用代码插入。比方我们在的页面为a.html 对于a.html的页面我们存在不满意,但是为了达到某种目的。而再创建以个页面b.html 然后把b.html用js调用的方式或是其他div以及代码方式插入到a.html 。可以理解为b.html是当前页面中(a.html)的独立子页面,与父页面同时展示。需要

Public @ 2010-11-09 16:22:40

原创的文章被同行抄袭,该怎么办?

如果你的原创文章被同行抄袭了,以下是一些可能的应对措施: 1.与抄袭者直接联系。你可以尝试联系抄袭者并要求他们删除抄袭内容。如果他们没有回应或拒绝合作,你可能需要采取其他措施。 2.通知抄袭网站管理者。如果抄袭者将抄袭内容发布在任何网站上,你可以通知该网站的管理者。他们可能会采取行动,从网站上删除抄袭内容。 3.向你的雇主或学校报告。如果你的文章被抄袭,特别是如果你在公司或学校工作,你可能需

Public @ 2023-04-19 12:50:24

网站有搜索索引,但迟迟没有收录的原因

1.新站点:如果您的网站是新站点,搜索引擎则需要时间来发现并收录您的站点。您可以通过提交站点地图或使用搜索引擎的 Webmaster 工具来加速索引。 2.网站结构问题:如果您的网站结构复杂,搜索引擎可能无法完全抓取并索引您的页面。您需要确保您的网站结构清晰,并使用正确的标记和元素。 3.缺乏质量内容:搜索引擎收录的主要目的是提供高质量的搜索结果。如果您的网站内容质量不佳或与其他网站内容相似,

Public @ 2023-06-13 17:50:31

更多您感兴趣的搜索

0.564668s