saved by12 people, first byKevin on 2006-07-31, last byShengwen Yang on 2008-08-01
PageRank 是基于「从许多优质的网页链接过来的网页,必定还是优质网页」的回归关系,来判定所有网页的重要性。
Google 被评价的优点不仅仅在于去除无用的(广告)标语构成单一页面的功能、独自的 Cache 系统、动态制成摘要信息、为实现高速检索而设置的分散系统(数千台规模的Linux群集器)等,而其中最大的优点正是它检索结果的正确性。一种能够自动判断网页重要性的技术「PageRank是(网页等级)」就是为此而设计的一种技术。
当然,重要性高的页面如果和检索词句没有关联同样也没有任何意义。为此 Google 使用了精练后的文本匹配技术,使得能够检索出重要而且正确的页面。
-
提高 PageRank 的要点,大致有3个。
- 反向链接数 (单纯的意义上的受欢迎度指标)
- 反向链接是否来自推荐度高的页面 (有根据的受欢迎指标)
- 反向链接源页面的链接数 (被选中的几率指标)