Categories


Tags


网站日志在哪里?如何下载日志?

网站日志是做SEO时网站管理员和搜索引擎对话沟通的途径。通过日志,了解搜索引擎蜘蛛的访问情况。在很多时间,我们需要查看网站日志。以获得了解搜索引擎如何爬取咱们的网站。

如何下载日志

通过FTP访问网站的根目录。可以看到一个包含log的文件夹,这是存放日志的地方。

微信图片_20181108173907.

如何查看日志

下载、解压、打开日志文件,日志文件内容如:

61.135.168.22 - - [11/Jan/2009:04:02:45 +0800] "GET /bbs/thread-7303-1-1.html HTTP/1.1" 200 8450 "-" "Baiduspider+(+http://www.baidu.com/search/spider.htm)" (注:百度,这部分为本文添加)

203.208.60.43 - - [11/Jan/2009:04:02:43 +0800] "GET /sns/space-13563-do-friend-view-me.html HTTP/1.1" 200 5162 "-" "Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)" (注:Google)

202.160.178.21 - - [11/Jan/2009:04:02:44 +0800] "GET /sns/space.php?uid=323 HTTP/1.0" 200 7535 "-" "Mozilla/5.0 (compatible; Yahoo! Slurp China; http://misc.yahoo.com.cn/help.html)" (注:雅虎)

65.55.220.217 - - [11/Jan/2009:04:02:57 +0800] "GET /ucenter/avatar.php?uid=12373&size=small&type=virtual HTTP/1.1" 301 - "-" "msnbot-media/1.1 (+http://search.msn.com/msnbot.htm)" (注:MSN)

日志文件样板全文下载:

http://edu.seowhy.com/ziliao/wwwlog20090112.log

如何分析日志

蜘蛛名称:百度->baiduspider、Google ->Googlebot、Msn ->msnbot、yahoo ->Slurp、yodao ->YoudaoBot、sogou ->Sogou+get+spider。在日志文件里,搜索以上蜘蛛名称。就可以看到蜘蛛抓取的痕迹。

我们分析的主要点是,HTTP状态码,如以上的200和301。

" 200 5162 " 代表正常抓取,这次抓取了5162个字节。

不同的服务器或虚拟主机设置的日志记录内容不同。

有的如:200 0 33834 237 953 我们通过多看几条记录,观察规律,可以判断第三个数字代表字节数。

有的如:200 0 0或200 0 64 这是没有记录抓取字节数。注意:200 0 0和200 0 64 没代表什么问题。所谓200 0 64代表要被K的言论没有根据,一般的网站都有64代码。

在日志里,发现比较多的HTTP状态码是,200(正常)、304(没变化)、404(错误链接)。

304代表,自从上次抓取后,该内容没有更新。一般情况下,网站的图片经常会返回该值。

404代表,访问的这个链接是错误链接。这个错误链接,一方面来自原本存在后来删除了网页,另一方面可能来自本来就不存在,但其他人外链了这么个死链接。

来源:搜外网


Public @ 2012-04-17 15:32:53

网站长期不收录的页面怎么解决?什么原因导致不收录?

以下是造成网站长期不收录的一些原因和解决办法: 1.robots.txt文件禁止收录。检查网站的robots.txt文件是否禁止了相应页面的收录。如果禁止了,需要修改该文件。 2.页面质量不高。如果页面质量不高、内容不充实、重复度高,那么搜索引擎就不会收录该页面。解决办法是优化网站内容、提高页面质量。 3.缺少外部引用链接。高质量的外部链接可以提升网站的可信度和排名,同时也是搜索引擎的一种收

Public @ 2023-03-30 23:00:41

网站被百度降权怎么办?

1:检查网站是否使用了H1标签,除博客外任何网站经历避免使用H1标签,如果网站被降权,则去掉H1标签。2:检查是否有不良友情链接,检查这些链接的页面链接都是什么地方、IP是什么,这个IP是否被处罚过,详情可看卢松松曾经写的“如何检查同IP下的网站是否安全”。3:检查网站是否使用过Alt,特别是LOGO上面是否使用了关键字的Alt标签,如果有则去掉。4:如果是新站刚刚收录,那么应该蛋定,这个时候很可

Public @ 2013-05-26 15:38:17

日志中显示页面被抓取了,会收录吗?

日志记录并不是搜索引擎收录的直接因素,因此页面被抓取并不代表会被收录。收录与抓取相关,但并不完全取决于抓取。搜索引擎根据页面内容的质量、权威度、更新频率等多方面因素进行评估,如果页面符合搜索引擎的收录标准,才有可能被收录。

Public @ 2023-04-18 06:50:05

服务器日志是什么?如何查看服务器日志?

服务器日志是指服务器所生成的记录了各种系统操作、网络请求、资源使用、错误信息等记录的文件。通过查看服务器日志,可以了解服务器的运行状态和问题,以便及时发现和解决各种问题。 具体查看服务器日志的方法取决于服务器的操作系统和日志管理工具的不同。以下是一些常见的查看服务器日志的方法: 1. 使用命令行工具:在Linux或UNIX系统中,可以使用命令行工具如tail、grep、less来查看日志文件。

Public @ 2023-08-01 04:00:18

更多您感兴趣的搜索

0.476759s