Categories


Tags


robots使用误区

误区一:我的网站上的所有文件都需要蜘蛛抓取,那我就没必要在添加robots.txt文件了。反正如果该文件不存在,所有的搜索蜘蛛将默认能够访问网站上所有没有被口令保护的页面。

每当用户试图访问某个不存在的URL时,服务器都会在日志中记录404错误(无法找到文件)。每当搜索蜘蛛来寻找并不存在的robots.txt文件时,服务器也将在日志中记录一条404错误,所以你应该做网站中添加一个robots.txt。

误区二:在robots.txt文件中设置所有的文件都可以被搜索蜘蛛抓取,这样可以增加网站的收录率。

网站中的程序脚本、样式表等文件即使被蜘蛛收录,也不会增加网站的收录率,还只会浪费服务器资源。因此必须在robots.txt文件里设置不要让搜索蜘蛛索引这些文件。

具体哪些文件需要排除, 在robots.txt使用技巧一文中有详细介绍。

误区三:搜索蜘蛛抓取网页太浪费服务器资源,在robots.txt文件设置所有的搜索蜘蛛都不能抓取全部的网页。

如果这样的话,会导致整个网站不能被搜索引擎收录。

来源:360站长平台


Public @ 2017-10-31 16:09:18

Apache IIS/.net 制作404页面

Apache服务器上创建404页面: 1. 创建一个新文本文件,命名为404.html(注意,扩展名必须为html)。 2. 打开这个文件,并添加如下代码: 404页面不在这里 抱歉,您正在寻找的页面不在这里 请尝试检查您输入的URL或联系网站管理员。 3. 保存文件并将其上传到您的网站根目录下的相

Public @ 2023-04-17 19:50:47

nofollow标签的作用有重大变化

nofollow标签最初是由Google引入的,旨在告诉搜索引擎跟踪链接的方式。它的作用是让网站管理员控制搜索引擎是否跟踪某个链接并传递权重。也就是说,如果一个页面包含了nofollow标签,搜索引擎就不会将该页面与被链接的页面相关联,也不会将该页面作为链接目标的一部分考虑。这样可以避免一些不必要的链接传递权重,同时可以防止人工操纵搜索引擎排名。 然而,随着时间的推移,nofollow标签的作用

Public @ 2023-06-05 14:00:19

更多您感兴趣的搜索

0.562383s