Categories


Tags


Google技术副总裁谈Google排名算法

今天是Google新闻发布日2006,大家可以看新闻发布会的实况,长达3个多小时。在发布会上Google总裁Eric Schmidt谈到Google的核心还是搜索,相关人员介绍了四个新产品,其中Google Trend对关键词研究很有用。

最感兴趣的是Google技术部门副总裁Alan Eustace谈Google排名的情况。所以我只跳到这个部分看了一下,大概半小时。下面拣记得的重点介绍给大家。

Alan首先谈到的是蜘蛛爬行,基本上就是跟踪所发现的链接。

速度非常重要。上一次Google在主页上发布的信息是,在数据库中有80亿网页。如果每秒爬行一个网页的话,这80亿的网页需要250多年才能爬行完。所以高速爬行网页非常重要。

爬行时的另外一个问题是,大概有50%的网页都是重复内容。所以Google所收录的80亿其实是已经丢掉了一半后的数字,真正爬行的有可能是200亿文件。

爬行时还有一个危险就是无限循环。比如说跟踪某个网页上日历的链接,可能在这个日历上总是有“下一个月”这个按钮,产生无限循环。因为网页程序可以无限制的生成下一个月的月历,Google蜘蛛就出不来了。

10%到20%的网站每个月都会更新内容,更新度也很重要。

然后是索引,索引就和一本书的索引差不多。比如说用户搜索heart attack(心脏病暴发),heart出现在文件5,9,25,attack出现在文件7,9,22,那么很明显第九个网页是符合条件的网页,这样搜索范围就已经限制在包含搜索词的网页内。

当然这个数量还是巨大的,再怎么从这里面挑出最好的结果呢?也就是进一步计算排名。

Google用两百多个信号来计算排名,这是新信息。

Alan提到了锚文字和PageRank。

举斯坦弗大学网页作为例子,很多其他网站会连向斯坦弗大学的网页,那么可以合理假定斯坦弗大学的网站权威性比较高,这也就是PR的意义。

然后是锚文字,也就是链接文字。比如在斯坦弗大学的网页上,一个以“Knight fellows”为链接文字的链接到其他网站,那么这个链接文字本身就在一定程度上说明了那个网页的主题,就算在那个网页上面Knight fellows这个词根本没有出现。

这个排名过程必须是自动的,不可能人工去调节这些排名。

Alan谈到大约20%到25%的搜索关键词都是独特的,也就是说以前从来没有别人所搜索过的。用户都非常有创意,会以各种各样形式组合的词来做搜索。

一个关键词搜索是由上千架机器所处理的。

Alan接着谈到垃圾技术,比如说在留言本里留下垃圾链接,这种技术对Google来说早就不起作用了。再比如有的作弊的人建立大量的网站,在这些网站之间互相链接,这对Google也不起作用。

他加了一句:对别的搜索引擎起不起作用,那就不知道了。

Google在做算法调整的时候,依据是多少人受益。比如说做某个调整,40%的人会觉得搜索质量提高,40%的人觉得没什么变化,20%的人觉得搜索质量降低,Google的决定就会是进行这个调整。

不可能在100%的搜索词下满足100%的人。

Alan还提到很多其他语言的搜索也非常困难,比如中文分词技术。

这段谈话倒没有很出人意料的地方,但Google负责技术的副总裁自己谈Google排名算法就已经很难得了。

等有时间再完整看一遍,看有什么新东西。

来源:SEO每天一贴 Zac 昝辉


Public @ 2010-05-24 15:30:10

大型网站的SEO引爆点

1.高质量内容: 网站的内容质量是SEO优化的关键。确保网站中的所有页面都有高质量的内容可以吸引更多的访问者,并在搜索引擎中获得更好的排名。 2.关键词研究: 对于大型网站来说,关键词研究是一个决定性因素。通过了解潜在客户搜索的关键词并将其合理地应用于网站的内容中,可以大幅提高网站的SEO排名。 3.技术优化: 技术优化包括页面加载速度、网站结构、移动友好等方面。这可以协助搜索引擎更好地了解网

Public @ 2023-04-28 00:50:16

站长须知的14个健康生活细节

广大草根站长们,如果你不想过劳死,如果你不想未老先秃顶,如果你不想年纪轻轻就已经挺起将军肚犹如十月怀胎。那么你最好认真看完这篇文章。无限博客说的好:不懂得珍惜自己身体的站长不是好站长。虽然这篇文章中不会有什么“干货”,但它却可能真正让你受益终生。其中的道理,不用我说,你肯定明白。接下来我会从工作和生活两方面,分别阐述一些有关健康的经验和需要注意的地方。这些经验不仅适合站长,也适合所有“靠电脑为生”

Public @ 2015-12-30 15:33:04

Google产品评论算法更新

4月8号,Google官方博客发表了一篇贴子,公布一次所谓“产品评论更新”(product reviews update)。这个算法更新4月8号当天开始上线,22号基本完成上线。目前这个更新只限于英文搜索。这个算法针对的打击对象是过去几年搜索引擎比较少提到的,Google算是又开辟了一个新战场。目前来看,这次更新的影响还是比较明显的,尤其是对电商、购物网站的影响比较大,国内做购物、产品类网站SEO

Public @ 2009-12-25 15:54:59

Matt Cutts谈总体搜索质量和新的基础架构

Matt Cutts在谷歌的一次采访中谈到了总体搜索质量和新的基础架构的问题。 他认为,谷歌一直在不断改进其搜索算法和质量评估方法,以便能够更好地为用户提供相关的搜索结果。此外,谷歌还在研究和改进搜索结果的呈现方式,使它们更易于理解和使用。 除此之外,Matt Cutts还提到了谷歌正在开发一种新的基础架构,以更好地支持其搜索和其它服务。这个新的基础架构将采用更先进的技术和系统,以提高谷歌的性

Public @ 2023-06-12 07:00:21

更多您感兴趣的搜索

0.590353s