Google 的秘密- PageRank 彻底解说

Google 的秘密- PageRank 彻底解说


来源:中国网络传播网  作者:佚名

索引

  1. 前言
  2. PageRank 的基本概念
  3. 怎样求得 PageRank
  4. 实际应用时的问题
  5. Namazu 上的实际安装实验
  6. 对 PageRank 的个人见解
  7. 参考文献
  8. 附录:「guguru?/gouguru?

Google 的秘密- PageRank 彻底解说 中文版

原著:Google の秘密 - PageRank 徹底解説 Hajime BABA / 馬場 肇   
翻译:Kreny / 袁 黄琳
创作于:2003/12   最后更新: 2004年1月23日 12:06  关键词:pagerank, google, link
翻译说明: 一些语句的翻译上使用了意译,使得尽可能得符合中文的理解和说明思路。
版权声明:可以任意转载,转载时请务必以超链接形式标明文章原始出处和作者信息及本声明
http://linux.dalouis.com/pagerank_cn.htm

返回首页


本文对作为评价甚高的搜索引擎 Google 的核心技术之一 PageRank (网页等级)的基本的概念和评价原理进行解释。

索引

  1. 前言
  2. PageRank 的基本概念
  3. 怎样求得 PageRank
  4. 实际应用时的问题
  5. Namazu 上的实际安装实验
  6. 对 PageRank 的个人见解
  7. 参考文献
  8. 附录:「guguru?/gouguru?

★(2003/7/1) 拙著『Namazu系统的构筑和活用』已作修订。 详情请看 介绍页面 。

★(2003/5/20) 与 Google 有关的在线新闻报道一览(日语)已被分离到 另一张页面(googlenews.html) 。

★(2001/2/28) Namazu 的索引中使用的计算 PageRank 的 Perl 脚本 prnmz-1.0.tar.gz 公开下载。

1.前言

最近,搜索引擎 Google (http://www.google.com/)非常引人注目。Google 是基于现担任 CEO 的 Larry Page 和担任总经理的 Sergey Brin (2001年2月)在就读于美斯坦福大学研究生院时所开发的搜索引擎的一种检索服务。Google 从1998年9月开始服务,但Netscape Communications 在 Google 的测试阶段就开始与其合作,美国 Yahoo! 公司也从2000年6月起将默认搜索引擎(美国 Yahoo! 不能检索时作为增补的搜索引擎)由原先合作的 Inktomi 转换为了 Google。日语版 Google 在2000年9月正式登场,现已被 BIGLOBE(NEC)所采用。 (注:2001年4月 Yahoo! JAPAN 和 @NIFTY,7月索尼,2002年1月 Excite 也相继与 Google 建立了协作关系)。

Google 被评价的优点不仅仅在于去除无用的(广告)标语构成单一页面的功能、独自的 Cache 系统、动态制成摘要信息、为实现高速检索而设置的分散系统(数千台规模的Linux群集器)等,而其中最大的优点正是它检索结果的正确性。一种能够自动判断网页重要性的技术「PageRank是(网页等级)」就是为此而设计的一种技术。 本文的目的就是以尽可能浅显易懂的语言来说明 PageRank 系统的概要和原理。

以下是 PageRank 的一篇基础文章。

Lawrence Page, Sergey Brin, Rajeev Motwani, Terry Winograd, 'The PageRank Citation Ranking: Bringing Order to the Web', 1998,
http://www-db.stanford.edu/~backrub/pageranksub.ps

为了更高效地计算 PageRank,以下是改良以后的一篇论文。

Taher H. Haveliwala, 'Efficient Computation of PageRank', Stanford Technical Report, 1999,
http://dbpubs.stanford.edu:8090/pub/1999-31

另外,以下是 PageRank 的演示用资料(PowerPoint)。

Larry Page, 'PageRank: Bringing Order to the Web',
http://hci.stanford.edu/~page/papers/pagerank/ (已失效)

接下来就对这两篇文章(另加一篇资料)进行基本说明。 首先,用简单的例子来解说 PageRank 的概念,再归结到使用超链接关系的排序系统来解决大规模疏松疏矩阵的特性值的问题。然后我们会接触一些在现实世界中应用基本模型时出现的问题和对应方法。接下来,为了探讨是否能够作为「个人化 PageRank」使用,进行对免费全文检索系统 Namazu 的安装实验并对其结果进行阐述。最后发表我对 PageRank 的个人见解。

|<< << < 1 2 3 4 5 6 7 8 9 10 > >> >>|


·上一篇文章:搜索引擎垃圾
·下一篇文章:百度关键词竞价价格查询


转载请注明转载网址:
http://www.jmkt.cn/html/search/133732928.htm