Categories


Tags


robots里这样写,就能避免蜘蛛爬这个“index.htm”这个首页?

我robots这样写是不是就能避免蜘蛛爬这个“index.htm”这个首页?

User-agent: *

Disallow: /index.htm

11-30.

我的index.htm是现在默认的首页,想屏蔽蜘蛛抓取。让蜘蛛爬另一个文档,主要是规避备案巡查

我的网站和我备案的不一样,服务器那边要求改,我就整了个htm文档来规避下。

写法没有问题。但正常的不建议屏蔽首页地址,,“index.htm”这个后缀地址是需要处理掉的。

当然,如果只是应付备案短暂需求,,就只能这样处理。

后续备案处理后,尽快处理后缀“index.htm”。同时robots修改回去。

来源:搜外网


Public @ 2019-12-16 16:09:25

大型网站SEO优化技巧

大型网站SEO优化技巧可以分为以下几个方面: 1. 关键词研究和优化:通过市场调研和竞争对手分析,确定适合网站的关键词,并在网站的标题、描述、内容和URL等地方进行优化。 2. 内容优化:创建高质量、有足够信息价值的内容,确保内容的原创性和独特性,并定期更新内容。 3. 网站结构优化:确保网站的结构布局清晰,页面链接合理,便于搜索引擎的抓取和索引。 4. 外部链接优化:通过建立高质量的外部

Public @ 2023-06-29 17:00:18

单页面快速获取百度排名办法

一、 背景:网站名称:浪起激光网站表现:企业站 , 权重3 , 收录1000+ ,域名时间 9年。程序:zblog页面:伪静态处理:域名/分类/id.html单页面:伪静态处理:域名/pinyin.htmlTAG:这个是重点,相信站长都会使用这种聚合标签;域名/pinyin.html更新:日常更新,偶尔原创,大部分伪原创(不是伪原创软件生产)内链:主关键词链接到首页,长尾词多链接到tag二、 过程

Public @ 2015-05-06 15:25:10

百度搜索robots协议全新升级公告

尊敬的用户: 为了更好地保护您的隐私和内容权益,百度搜索已经全新升级了robots协议。该协议将更加严格地限制搜索引擎爬取您的网站内容,以保障您的权益。 更新后的robots协议针对以下内容进行了调整: 1.增加禁止搜索引擎爬取的网页类型,如登录页、支付页、个人信息页等。 2.增加网站所有者对搜索引擎爬取的细节设置,包括最大爬取频率、爬取深度、爬取延时等。 3.优化 robots.txt

Public @ 2023-04-17 05:00:13

禁止搜索引擎收录的方法

1. 什么是robots.txt文件?搜索引擎使用spider程序自动访问互联网上的网页并获取网页信息。spider在访问一个网站时,会首先会检查该网站的根域下是否有一个叫做 robots.txt的纯文本文件,这个文件用于指定spider在您网站上的抓取范围。您可以在您的网站中创建一个robots.txt,在文件中声明 该网站中不想被搜索引擎收录的部分或者指定搜索引擎只收录特定的部分。请注意,仅当

Public @ 2015-10-28 16:08:55

更多您感兴趣的搜索

0.696591s