SEO实战密码:60天网站流量提高20倍(第4版)
上QQ阅读APP看本书,新人免费读10天
设备和账号都新为新人

2.5.5 Hilltop算法

Hilltop算法是由Krishna Bharat在2000年左右研究的,于2001年申请了专利,并且把专利授权给Google使用,后来Krishna Bharat本人也加入了Google。

Hilltop算法可以简单理解为与主题相关的PR值。传统PR值与特定关键词或主题没有关联,只计算链接关系。这就有可能出现某种漏洞。比如一个关于环保内容的大学页面的PR值极高,上面有一个链接连向一个儿童用品网站,这个链接出现的原因可能仅仅是因为这个大学页面维护人是个教授,他太太在那个卖儿童用品的公司工作。这种与主题无关、却有着极高PR值的链接,有可能使一些权威性、相关性并不高的网站反而获得很好的排名。

Hilltop算法就在尝试矫正这种可能出现的疏漏。Hilltop算法同样是计算链接关系,不过它更关注来自主题相关页面的链接权重。Hilltop算法把这种主题相关页面称为专家文件。显然,它针对不同主题或搜索词有不同的专家文件。

根据Hilltop算法,用户搜索查询词后,Google先按正常排名算法找到一系列相关页面并排名,然后计算这些页面有多少是来自专家文件的、与主题相关的链接,来自专家文件的链接越多,页面的排名分值越高。按Hilltop算法的最初构想,一个页面至少要有两个来自专家文件的链接,才能返回一定的Hilltop值,不然返回的Hilltop值将为零。

根据专家文件链接计算的分值被称为LocalRank。排名程序根据LocalRank值,对原本传统排名算法计算的排名做重新调整,给出最后排名。这就是前面讨论的搜索引擎在排名阶段最后的过滤和调整步骤。

Hilltop算法在最初写论文和申请专利时对专家文件的选择有不同描述。在最初的研究中,Krishna Bharat把专家文件定义为包含特定主题内容,并且有比较多导出链接到第三方网站的页面,这有些类似于HITS算法中的枢纽页面。专家文件链接指向的页面与专家文件本身应该没有关联,这种关联指的是来自同一个主域名下的子域名,来自相同或相似IP地址的页面等。最常见的专家文件通常来自学校、政府及行业组织网站。

在最初的Hilltop算法中,专家文件是预先挑选的。搜索引擎可以根据最常见的搜索词,预先计算出一套专家文件,用户搜索时,排名算法从事先计算的专家文件集合中选出与搜索词相关的专家文件子集,再从这个子集中的链接计算LocalRank值。

不过在2001年所申请的专利中,Krishna Bharat描述了另外一个挑选专家文件的方法。专家文件并不预先选择,用户搜索特定查询词后,搜索引擎按传统算法挑出一系列初始相关页面,这些页面就是专家文件。Hilltop算法在这个页面集合中再次计算哪些网页有来自集合中其他页面的链接,并为其赋予比较高的LocalRank值。由传统算法得到的页面集合已经具备了相关性,这些页面再提供链接给某一个特定页面,这些链接的权重自然就很高了。这种挑选专家文件的方法是实时进行的。

通常认为Hilltop算法对2003年底的佛罗里达更新有重大影响,不过Hilltop算法是否真的已经被融入进Google排名算法中,没有人能够确定。Google从来没有承认,但也没有否认自己的排名算法中使用了这项专利。不过从对排名结果的观察和招揽Krishna Bharat至麾下等迹象看,Hilltop算法思想得到了Google的极大重视。

Hilltop算法提示SEO,建设外部链接时更应该关注与主题相关,并且本身排名就不错的网站和页面。最简单的方法是搜索某个关键词,目前排在前面的页面就是最好的链接来源,甚至可能一个来自竞争对手网站的链接效果是最好的。当然,获得这样的链接难度最大。这里说的排在前面,是指排名前几百位的页面,而不仅仅是普通用户会看的前二三十位页面,能排在前几百位都已经算是专家文件了。