Categories


Tags


robots简介

搜索引擎通过一种程序robot(又称spider),自动访问互联网上的网页并获取网页信息。

您可以在您的网站中创建一个纯文本文件robots.txt,在这个文件中声明该网站中不想被robot访问的部分,这样,该网站的部分或全部内容就可以不被搜索引擎收录了,或者指定搜索引擎只收录指定的内容。

robots.txt(统一小写)是一种存放于网站根目录下的ASCII编码的文本文件,它通常告诉网络搜索引擎的漫游器(又称网络蜘蛛),此网站中的哪些内容是不能被搜索引擎的漫游器获取的,哪些是可以被(漫游器)获取的。 因为一些系统中的URL是大小写敏感的,所以robots.txt的文件名应统一为小写。robots.txt应放置于网站的根目录下。如果想单独定义搜索引擎的漫游器访问子目录时的行为,那么可以将自定的设置合并到根目录下的robots.txt,或者使用robots元数据。

Robots.txt协议并不是一个规范,而只是约定俗成的,所以并不能保证网站的隐私。注意Robots.txt是用字符串比较来确定是否获取URL,所以目录末尾有和没有斜杠"/"这两种表示是不同的URL,也不能用"Disallow: *.gif"这样的通配符。

其他的影响搜索引擎的行为的方法包括使用robots元数据:

<meta name="robots" content="noindex,nofollow" />

这个协议也不是一个规范,而只是约定俗成的,通常搜索引擎会识别这个元数据,不索引这个页面,以及这个页面的链出页面

robots.txt文件放在哪里?

robots.txt文件应该放在网站根目录下。举例来说,当robots访问一个网站时,首先会检查该网站中是否存在这个文件,如果机器人找到这个文件,它就会根据这个文件的内容,来确定它访问权限的范围。

来源:360站长平台


Public @ 2022-05-30 16:09:18

新手如何掌握制作和提交网站地图?

制作网站地图: 1. 确定网站结构:确定网站的所需页面、页面之间的关系以及内容分布。 2. 确定信息架构:根据网站结构,制定信息架构,将各个页面的内容划分为不同的类别和子类别。 3. 绘制网站地图:使用绘图工具或专业的网站地图制作软件绘制网站地图,将页面之间的关系以树状结构展示。 4. 确认并完善:与网站设计师、开发人员合作,确认网站地图是否准确无误,并根据实际情况进行完善。 提交网站地图:

Public @ 2023-04-11 17:00:45

网站URL显示品牌名字怎么弄

要在网站URL中显示品牌名称,您需要使用自定义域名。这意味着您需要注册一个与您的品牌名称相匹配的域名,并将其设置为您的网站的主要域名。 如果您正在使用WordPress等内容管理系统,您可以在设置中更改您的域名,并使用插件来确保您的品牌名称在URL中显示。 如果您正在使用自定义开发的网站,则可以在代码中指定您的品牌名称,以便在URL中使用。您可以将品牌名称添加到URL的开头、结尾或中间,具体取

Public @ 2023-04-29 06:00:07

搜索引擎的Robots协议

robots.txt是一种存放于网站根目录下的文本文件,用于告诉搜索引擎的爬虫(spider),此网站中的哪些内容是不应被搜索引擎的索引,哪些是可以被索引。通常认为,robots.txt文件用来搜索引擎对目标网页的抓取。robots.txt协议并不是一个规范,而只是约定俗成的,通常搜索引擎会识别这个文件,但也有一些特殊情况。对于Google来说,使用robots也未必能阻止Google将网址编入索

Public @ 2018-04-08 16:09:21

更多您感兴趣的搜索

0.545930s