Categories


Tags


Google PageRank的计算源代码

最近对google的PageRank(网页等级)比较感兴趣,一直想知道如何不用google toolbar来获取pr值。苦苦搜索之后,找到如下代码:

<?php

/**

This code is released unto the public domain

*/

//header("Content-Type: text/plain; charset=utf-8");

define('GOOGLE_MAGIC', 0xE6359A60);

//unsigned shift right

function zeroFill($a, $b)

{

$z = hexdec(80000000);

if ($z & $a)

{

$a = ($a>>1);

$a &= (~$z);

$a |= 0x40000000;

$a = ($a>>($b-1));

}

else

{

$a = ($a>>$b);

}

return $a;

}

function mix($a,$b,$c) {

$a -= $b; $a -= $c; $a ^= (zeroFill($c,13));

$b -= $c; $b -= $a; $b ^= ($a<<8);

$c -= $a; $c -= $b; $c ^= (zeroFill($b,13));

$a -= $b; $a -= $c; $a ^= (zeroFill($c,12));

$b -= $c; $b -= $a; $b ^= ($a<<16);

$c -= $a; $c -= $b; $c ^= (zeroFill($b,5));

$a -= $b; $a -= $c; $a ^= (zeroFill($c,3));

$b -= $c; $b -= $a; $b ^= ($a<<10);

$c -= $a; $c -= $b; $c ^= (zeroFill($b,15));

return array($a,$b,$c);

}

function GoogleCH($url, $length=null, $init=GOOGLE_MAGIC) {

if(is_null($length)) {

$length = sizeof($url);

}

$a = $b = 0x9E3779B9;

$c = $init;

$k = 0;

$len = $length;

while($len >= 12) {

$a += ($url[$k+0] +($url[$k+1]<<8) +($url[$k+2]<<16) +($url[$k+3]<<24));

$b += ($url[$k+4] +($url[$k+5]<<8) +($url[$k+6]<<16) +($url[$k+7]<<24));

$c += ($url[$k+8] +($url[$k+9]<<8) +($url[$k+10]<<16)+($url[$k+11]<<24));

$mix = mix($a,$b,$c);

$a = $mix[0]; $b = $mix[1]; $c = $mix[2];

$k += 12;

$len -= 12;

}

$c += $length;

switch($len)              /* all the case statements fall through */

{

case 11: $c+=($url[$k+10]<<24);

case 10: $c+=($url[$k+9]<<16);

case 9 : $c+=($url[$k+8]<<8);

/* the first byte of c is reserved for the length */

case 8 : $b+=($url[$k+7]<<24);

case 7 : $b+=($url[$k+6]<<16);

case 6 : $b+=($url[$k+5]<<8);

case 5 : $b+=($url[$k+4]);

case 4 : $a+=($url[$k+3]<<24);

case 3 : $a+=($url[$k+2]<<16);

case 2 : $a+=($url[$k+1]<<8);

case 1 : $a+=($url[$k+0]);

/* case 0: nothing left to add */

}

$mix = mix($a,$b,$c);

/*-------------------------------------------- report the result */

return $mix[2];

}

//converts a string into an array of integers containing the numeric value of the char

function strord($string) {

for($i=0;$i<strlen($string);$i++) {

$result[$i] = ord($string{$i});

}

return $result;

}

// http://www.example.com/ - Checksum: 6540747202

$url = 'info:'.$_GET['url'];

$ch = GoogleCH(strord($url));

$url='info:'.urlencode($_GET['url']);

echo file_get_contents("http://www.google.com/search?client=navclient-auto&ch=6$ch&ie=UTF-8&oe=UTF-8&features=Rank&q=$url");

/* use curl send the user angent

$curl = curl_init("http://www.google.com/search?client=navclient-auto&ch=6$ch&ie=UTF-8&oe=UTF-8&features=Rank&q=$url");

curl_setopt ($curl, CURLOPT_USERAGENT, "Mozilla/4.0 (compatible; GoogleToolbar 2.0.110-big; Windows 2000 5.0)");

curl_exec($curl);

*/

?>

</></>

来源:月光博客


Public @ 2022-12-07 15:39:09

Google链接分析专利

商业周刊今天发表一篇文章谈搜索引擎市场的竞争情况。Matt Cutts很快发了个贴子评论了下。搜索引擎各自的商业模式,关注点和优缺点就不多说了。引起我兴趣的是Matt Cutts特意提到一个Google链接分析的专利。这个专利是Google在2001年申请,2003年2月批准的,美国专利号号6526440。Google和其他搜索引擎公司都有大把的专利,但拿出来谈的很少,哪些已经用在排名算法里外人就

Public @ 2017-10-08 16:21:56

TrustRank算法

TrustRank是一种基于Web搜索的信息检索技术,用于挖掘有质量的网页,并将其置于搜索结果的顶部。它可以准确地将有质量的网页与搜索词相关联,从而过滤掉某些无关的链接,让有质量的网页出现在搜索结果中。 TrustRank算法通过跟踪搜索引擎向用户展示的链接的信誉来确定搜索结果的顺序。同时它会检测用户的反馈,比如点击量,浏览时间,以及用户评价,用于调整页面排列顺序。这样的话,用户就可以更加准

Public @ 2023-02-27 09:48:21

Google PR 值是什么?怎样计算?

相信对SEO感兴趣的人,都听说过Google PR值,英文全称是PageRank,缩写为PR,中文通常称为网页级别。所谓Google PR,是由 Google的两位创始人Larry Page 和 Sergey Brin 在斯坦福大学开发的衡量网页重要性的一个指标。朴素的思路是,一个网页导入链接越多,页面应该就更重要,所以PR值就越高。PR可以理解为页面之间的投票行为,网页A链接到网页B时,Goog

Public @ 2018-11-18 15:39:03

Google PR劫持

一直不太想说Google PR劫持这个话题,因为怕造成一些人刻意利用来骗其他的站长。不过前几天在点石有几个帖子都涉及到了这个问题。而且我再想想,如果有人就想欺骗,还是可以找到这个方法的。不如在这里公开讨论一下,让大家都知道,反而可以减少上当的可能性。大家都知道,Google PR是站长们都在追逐的东西,虽然不一定对排名有多大用,但是光那一段工具条上的绿色,越长就越让人兴奋。今天要谈的就是PR劫持,

Public @ 2020-03-03 15:39:05

更多您感兴趣的搜索

0.692805s