PageRank 搜索引擎有关

PageRank
http://infolab.stanford.edu/pub/papers/google.pdf
维基百科,自由的百科全书
跳转到: [url=#column-one]导航[/url], [url=#searchInput]搜索[/url]
[url=/zh-cn/File:WikiPR.PNG]PageRank 搜索引擎有关 - luiweiping-002 - 〖下里巴人〗[/url] Google的工具条标示出中文维基百科首页的PageRank
PageRank网页排名,又称网页级别Google左侧排名佩奇排名,是一种由[url=/zh-cn/%E6%90%9C%E7%B4%A2%E5%BC%95%E6%93%8E]搜索引擎[/url]根据[url=/zh-cn/%E7%BD%91%E9%A1%B5]网页[/url]之间相互的[url=/zh-cn/%E8%B6%85%E9%93%BE%E6%8E%A5]超链接[/url]计算的网页排名技术,以[url=/zh-cn/Google%E5%85%AC%E5%8F%B8]Google公司[/url]创办人[url=/zh-cn/%E6%8B%89%E9%87%8C%C2%B7%E4%BD%A9%E5%A5%87]拉里·佩奇[/url](Larry Page)之姓来命名。此技术通常和[url=/zh-cn/%E6%90%9C%E7%B4%A2%E5%BC%95%E6%93%8E%E4%BC%98%E5%8C%96]搜索引擎优化[/url]有关,[url=/zh-cn/Google]Google[/url]用它来体现网页的相关性和重要性。[url=/zh-cn/Google]Google[/url]的创始人[url=/zh-cn/%E6%8B%89%E9%87%8C%C2%B7%E4%BD%A9%E5%A5%87]拉里·佩奇[/url]和[url=/zh-cn/%E8%B0%A2%E5%B0%94%E7%9B%96%C2%B7%E5%B8%83%E6%9E%97]谢尔盖·布林[/url]于[url=/zh-cn/1998%E5%B9%B4]1998年[/url]在[url=/zh-cn/%E6%96%AF%E5%9D%A6%E7%A6%8F%E5%A4%A7%E5%AD%A6]斯坦福大学[/url]发明了这项技术。[url=#_note-0][1][/url]
PageRank通过网络浩瀚的超链接关系来确定一个页面的等级。Google把从A页面到B页面的链接解释为A页面给B页面投票,Google根据投票来源(甚至来源的来源,即链接到A页面的页面)和投票目标的等级来决定新的等级。简单的说,一个高等级的页面可以使其他低等级页面的等级提升。
目录[[url=javascript:toggleToc()]隐藏[/url]]
  • [url=#PageRank.E8.AE.A9.E9.93.BE.E6.8E.A5.E6.9D.A5.22.E6.8A.95.E7.A5.A8.22]1 PageRank让链接来"投票"[/url]
  • [url=#PageRank.E7.AE.97.E6.B3.95]2 PageRank算法[/url] 
  • [url=#.E7.AE.80.E5.8D.95.E7.9A.84]2.1 简单的[/url]
  • [url=#.E5.AE.8C.E6.95.B4.E7.9A.84]2.2 完整的[/url]
  • [url=#.E8.87.AAGoogle.E7.B6.B2.E7.AB.99.E7.AE.A1.E7.90.86.E5.93.A1.E5.B7.A5.E5.85.B7.E7.A7.BB.E9.99.A4]3 自Google网站管理员工具移除[/url]
  • [url=#.E5.8F.82.E8.A7.81]4 参见[/url]
  • [url=#.E5.8F.83.E8.80.83.E8.B3.87.E6.96.99]5 参考资料[/url]
  • [url=#.E5.A4.96.E9.83.A8.E9.8F.88.E6.8E.A5]6 外部链接[/url]
  • [[url=/w/index.php?title=PageRank&action=edit&section=1]编辑[/url]] PageRank让链接来"投票"一个页面的“得票数”由所有链向它的页面的重要性来决定,到一个页面的[url=/zh-cn/%E8%B6%85%E9%93%BE%E6%8E%A5]超链接[/url]相当于对该页投一票。一个页面的PageRank是由所有链向它的页面(“链入页面”)的重要性经过[url=/zh-cn/%E9%80%92%E5%BD%92]递归[/url]算法得到的。一个有较多链入的页面会有较高的等级,相反如果一个页面没有任何链入页面,那么它没有等级。
    [url=/zh-cn/2005%E5%B9%B4]2005年[/url]初,Google为网页链接推出一项新属性[url=/w/index.php?title=Nofollow&action=edit&redlink=1]nofollow[/url],使得网站[url=/zh-cn/%E7%AE%A1%E7%90%86%E5%91%98]管理员[/url]和[url=/zh-cn/%E7%BD%91%E5%BF%97]网志[/url]作者可以做出一些Google不计票的链接,也就是说这些链接不算作"投票"。nofollow 的设置可以抵制评论垃圾。
    Google工具条上的PageRank指标从0到10。它似乎是一个对数标度算法,细节未知。PageRank 是 Google 的商标,其技术亦已经申请[url=/zh-cn/%E4%B8%93%E5%88%A9]专利[/url]。
    PageRank算法中的[url=/w/index.php?title=%E7%82%B9%E5%87%BB%E7%AE%97%E6%B3%95&action=edit&redlink=1]点击算法[/url]是由[url=/w/index.php?title=Jon_Kleinberg&action=edit&redlink=1]Jon Kleinberg[/url]提出的。
    [[url=/w/index.php?title=PageRank&action=edit&section=2]编辑[/url]] PageRank算法[[url=/w/index.php?title=PageRank&action=edit&section=3]编辑[/url]] 简单的假设一个由4个页面组成的小团体:AB, C 和 D。如果所有页面都链向A,那么APR(PageRank)值将是BC 及 D的和。
    PR(A) = PR(B) + PR(C) + PR(D)继续假设B也有链接到C,并且D也有链接到包括A的3个页面。一个页面不能投票2次。所以B给每个页面半票。以同样的[url=/zh-cn/%E9%80%BB%E8%BE%91]逻辑[/url],D投出的票只有三分之一算到了A的 PageRank 上。
    PageRank 搜索引擎有关 - luiweiping-002 - 〖下里巴人〗换句话说,根据链处总数平分一个页面的PR值。
    PageRank 搜索引擎有关 - luiweiping-002 - 〖下里巴人〗最后,所有这些被换算为一个百分比再乘上一个系数q。由于下面的算法,没有页面的PageRank会是0。所以,Google通过数学系统给了每个页面一个最小值1 − q
    PageRank 搜索引擎有关 - luiweiping-002 - 〖下里巴人〗所以一个页面的 PageRank 是由其他页面的PageRank计算得到。Google 不断的重复计算每个页面的 PageRank。如果您给每个页面一个随机 PageRank 值(非0),那么经过不断的重复计算,这些页面的 PR 值会趋向于正常和稳定。这就是搜索引擎使用它的原因。
    [[url=/w/index.php?title=PageRank&action=edit&section=4]编辑[/url]] 完整的这个方程式引入了随机浏览的概念,即有人上网无聊随机打开一些页面,点一些链接。一个页面的PageRank值也影响了它被随机浏览的概率。为了便于理解,这里假设上网者不断点网页上的链接,最终到了一个没有任何链出页面的网页,这时候上网者会随机到另外的网页开始浏览。
    为了对那些有链出的页面公平,q = 0.15(q的意义见上文)的算法被用到了所有页面上,估算页面可能被上网者放入书签的概率。
    所以,这个等式如下:
    PageRank 搜索引擎有关 - luiweiping-002 - 〖下里巴人〗p1,p2,...,pN是被研究的页面,M(pi)是链入pi页面的数量,L(pj)是pj链出页面的数量,而N是所有页面的数量。
    PageRank值是一个特殊矩阵中的特征向量。这个特征向量为
    PageRank 搜索引擎有关 - luiweiping-002 - 〖下里巴人〗R是等式的答案
    PageRank 搜索引擎有关 - luiweiping-002 - 〖下里巴人〗如果pj不链向pi, 而且对每个j都成立时,PageRank 搜索引擎有关 - luiweiping-002 - 〖下里巴人〗等于 0
    PageRank 搜索引擎有关 - luiweiping-002 - 〖下里巴人〗这项技术的主要缺点是旧的页面等级会比新页面高。因为即使是非常好的新页面也不会有很多上游链接,除非它是某个站点的子站点。
    这就是PageRank需要多项算法结合的原因。PageRank似乎倾向于[url=/zh-cn/%E7%BB%B4%E5%9F%BA%E7%99%BE%E7%A7%91]维基百科[/url]页面,在条目名称的搜索结果中总在大多数或者其他所有页面之前。原因主要是维基百科内相互的链接很多,并且有很多站点链入。
    Google经常处罚恶意提高PageRank的行为,至于其如何区分正常的链接交换和不正常的链接堆积仍然是[url=/zh-cn/%E5%95%86%E4%B8%9A%E6%9C%BA%E5%AF%86]商业机密[/url]。
    [[url=/w/index.php?title=PageRank&action=edit&section=5]编辑[/url]] 自Google网站管理员工具移除2009年10月14日,Google员工苏珊·莫斯科(Susan Moskwa)确认该公司已自其网站管理员工具部分移除 PageRank。她对这部分移除的公告表示:“我们长久以来一直在告诫人们不应该过分注重 PageRank;很多网站站主似乎认为对他们来说得时时追踪的网站最重要指标,而这简直是个误解。”[url=#_note-Moskwa-1][2][/url]然而在苏珊确认后两天, PageRank 仍旧在Google工具栏上显示。
    [[url=/w/index.php?title=PageRank&action=edit&section=6]编辑[/url]] 参见
  • [url=/zh-cn/Google]Google[/url]
  • [url=/zh-cn/Google%E7%82%B8%E5%BD%88]Google炸弹[/url]
  • [[url=/w/index.php?title=PageRank&action=edit&section=7]编辑[/url]] 参考资料
    1. [url=#_ref-0]^[/url] Google Technology
    2. [url=#_ref-Moskwa_1-0]^[/url] Susan Moskwa.PageRank Distribution Removed From WMT.于2009年10月16日查阅.

    [[url=/w/index.php?title=PageRank&action=edit&section=8]编辑[/url]] 外部链接
  • Our Search: Google Technology by Google 英文
  • Google 的秘密- PageRank 彻底解说中文版
  • 查询页面PageRank的工具
  • 快速查询PageRank的工具,也可查询网站的反向连结
  • 显示▼隐藏▲ [url=/zh-cn/Template:Google_%E5%85%AC%E5%8F%B8]查[/url] • [url=/zh-cn/Template_talk:Google_%E5%85%AC%E5%8F%B8]论[/url] •  • 
    [url=/zh-cn/Google%E5%85%AC%E5%8F%B8]Google公司[/url]董事会主席兼执行总长:[url=/zh-cn/%E5%9F%83%E9%87%8C%E5%85%8B%C2%B7%E6%96%BD%E5%AF%86%E7%89%B9]埃里克·施密特[/url] · 董事兼技术总监:[url=/zh-cn/%E8%B0%A2%E5%B0%94%E7%9B%96%C2%B7%E5%B8%83%E6%9E%97]谢尔盖·布林[/url] · 董事兼产品总监:[url=/zh-cn/%E6%8B%89%E9%87%8C%C2%B7%E4%BD%A9%E5%A5%87]拉里·佩奇[/url] · 
    其他董事:[url=/zh-cn/%E4%BF%9D%E7%BE%85%C2%B7%E6%AD%90%E5%BE%B7%E5%AF%A7]保罗·欧德宁[/url] · [url=/w/index.php?title=%E7%BA%A6%E7%BF%B0%C2%B7%E4%BA%A8%E5%B0%BC%E6%96%AF&action=edit&redlink=1]约翰·亨尼斯[/url] · [url=/w/index.php?title=%E9%98%BF%E7%91%9F%C2%B7%E8%8E%B1%E6%96%87%E6%A3%AE&action=edit&redlink=1]阿瑟·莱文森[/url] · [url=/w/index.php?title=%E5%AE%89%C2%B7%E9%A9%AC%E7%91%9F&action=edit&redlink=1]安·马瑟[/url] · [url=/w/index.php?title=%E7%BA%A6%E7%BF%B0%C2%B7%E6%9D%9C%E5%B0%94&action=edit&redlink=1]约翰·杜尔[/url] · [url=/w/index.php?title=%E6%8B%89%E5%A7%86%C2%B7%E5%B8%8C%E6%8B%89%E5%A7%86&action=edit&redlink=1]拉姆·希拉姆[/url] · [url=/w/index.php?title=%E9%9B%AA%E8%8E%89%C2%B7%E8%92%82%E6%A0%BC%E6%9B%BC&action=edit&redlink=1]雪莉·蒂格曼[/url] · 
    首席财务官:[url=/w/index.php?title=%E5%B8%95%E7%89%B9%E9%87%8C%E5%85%8B%C2%B7%E7%9A%AE%E5%88%87%E7%89%B9&action=edit&redlink=1]帕特里克·皮切特[/url] 高级顾问:[url=/zh-cn/%E9%98%BF%E5%B0%94%C2%B7%E6%88%88%E5%B0%94]阿尔·戈尔[/url]广告[url=/w/index.php?title=Ad_Manager&action=edit&redlink=1]Ad Manager[/url] · [url=/w/index.php?title=Adscape&action=edit&redlink=1]Adscape[/url] · [url=/zh-cn/Google_AdSense]AdSense[/url] · [url=/w/index.php?title=Google_Advertising_Professionals&action=edit&redlink=1]Advertising Professionals[/url] · [url=/w/index.php?title=AdWords&action=edit&redlink=1]AdWords[/url] · [url=/zh-cn/Google%E5%88%86%E6%9E%90]分析[/url] · [url=/w/index.php?title=Google_Checkout&action=edit&redlink=1]Checkout[/url] · [url=/zh-cn/DoubleClick]DoubleClick[/url] ·
    通讯[url=/w/index.php?title=Google_Alerts&action=edit&redlink=1]Alerts[/url] · [url=/zh-cn/Google%E6%97%A5%E5%8E%86]日历[/url] · [url=/zh-cn/Google%E6%9C%8B%E5%8F%8B%E7%BE%A4]朋友群[/url] · [url=/zh-cn/Gmail]Gmail[/url] · [url=/zh-cn/Google%E7%B6%B2%E4%B8%8A%E8%AB%96%E5%A3%87]网上论坛[/url] · [url=/zh-cn/Google_Talk]Talk[/url] · [url=/w/index.php?title=Google_Latitude&action=edit&redlink=1]Latitude[/url] · [url=/zh-cn/Orkut]Orkut[/url] · [url=/zh-cn/Google%E9%98%85%E8%AF%BB%E5%99%A8]阅读器[/url] · [url=/zh-cn/Google%E7%BF%BB%E8%AF%91]翻译[/url]([url=/zh-cn/%E8%AF%91%E8%80%85%E5%B7%A5%E5%85%B7%E5%8C%85]译者工具包[/url]) · [url=/zh-cn/Google_Voice]谷歌之音[/url] · [url=/zh-cn/Google_Wave]Wave[/url]
    软件[url=/zh-cn/Google_Chrome]Chrome[/url] · [url=/zh-cn/Google_Chrome_OS]Chrome OS[/url] · [url=/zh-cn/Google%E6%A1%8C%E9%9D%A2]桌面[/url] · [url=/zh-cn/Google%E5%9C%B0%E7%90%83]地球[/url] · [url=/w/index.php?title=Google_Gadgets&action=edit&redlink=1]Gadegts[/url] · [url=/w/index.php?title=Gmail_Mobile&action=edit&redlink=1]Gmail Mobile[/url] · [url=/zh-cn/Google%E8%BB%9F%E9%AB%94%E9%9B%86]软件精选[/url] · [url=/zh-cn/Picasa]Picasa[/url] · [url=/w/index.php?title=PowerMeter&action=edit&redlink=1]PowerMeter[/url] · [url=/zh-cn/SketchUp]SketchUp[/url] · [url=/zh-cn/Google_Talk]Talk[/url] · [url=/zh-cn/Google%E5%B7%A5%E5%85%B7%E5%88%97]工具栏[/url] · [url=/w/index.php?title=Google_Updater&action=edit&redlink=1]Updater[/url] · [url=/w/index.php?title=Urchin&action=edit&redlink=1]Urchin[/url] · [url=/w/index.php?title=Google_Browser_Sync&action=edit&redlink=1]Browser Sync[/url] · [url=/zh-cn/%E8%B0%B7%E6%AD%8C%E6%8B%BC%E9%9F%B3%E8%BE%93%E5%85%A5%E6%B3%95]拼音输入法[/url] · [url=/zh-cn/%E8%B0%B7%E6%AD%8C%E9%87%91%E5%B1%B1%E8%AF%8D%E9%9C%B8]谷歌金山词霸[/url]
    平台[url=/zh-cn/Google%E8%B4%A6%E6%88%B7]账户[/url] · [url=/zh-cn/Android]Android[/url] · [url=/zh-cn/Google_App_Engine]App Engine[/url] · [url=/w/index.php?title=Google_Apps&action=edit&redlink=1]Apps[/url] · [url=/w/index.php?title=Google_Base&action=edit&redlink=1]Base[/url] · [url=/w/index.php?title=BigTable&action=edit&redlink=1]BigTable[/url] · [url=/w/index.php?title=Caja&action=edit&redlink=1]Caja[/url] ·[url=/w/index.php?title=Google_Co-op&action=edit&redlink=1]Co-op[/url] · [url=/zh-cn/Gears]Gears[/url] · [url=/zh-cn/Google%E6%AA%94%E6%A1%88%E7%B3%BB%E7%B5%B1]文件系统[/url] · [url=/w/index.php?title=Health&action=edit&redlink=1]Health[/url] · [url=/w/index.php?title=Native_Client&action=edit&redlink=1]Native Client[/url] · [url=/w/index.php?title=OpenSocial&action=edit&redlink=1]OpenSocial[/url] · [url=/zh-cn/Google_Wave]Wave[/url]
    开发工具[url=/w/index.php?title=AJAX_APIs&action=edit&redlink=1]AJAX APIs[/url] · [url=/zh-cn/Google_Code]Google Code[/url] · [url=/w/index.php?title=Gadgets_API&action=edit&redlink=1]Gadgets API[/url] · [url=/w/index.php?title=GData&action=edit&redlink=1]GData[/url] · [url=/w/index.php?title=Google%E6%9C%BA%E5%99%A8%E4%BA%BA&action=edit&redlink=1]机器人[/url] · [url=/w/index.php?title=Guice&action=edit&redlink=1]Guice[/url] · [url=/w/index.php?title=GWS&action=edit&redlink=1]GWS[/url] · [url=/w/index.php?title=Image_Labeler&action=edit&redlink=1]Image Labeler[/url] · [url=/zh-cn/KML]KML[/url] · [url=/zh-cn/MapReduce]MapReduce[/url] · [url=/w/index.php?title=SketchUp_Ruby&action=edit&redlink=1]SketchUp Ruby[/url] · [url=/w/index.php?title=Sitemaps&action=edit&redlink=1]Sitemaps[/url] · [url=/zh-cn/Google%E5%A4%8F%E6%97%A5%E7%A8%8B%E5%BC%8F%E7%A2%BC%E5%A4%A7%E8%B3%BD]编程之夏[/url] · [url=/w/index.php?title=TechTalks&action=edit&redlink=1]TechTalks[/url] · [url=/w/index.php?title=Web_Toolkit&action=edit&redlink=1]Web Toolkit[/url] · [url=/w/index.php?title=Website_Optimizer&action=edit&redlink=1]Website Optimizer[/url]
    出版和发布[url=/zh-cn/Blogger]Blogger[/url] · [url=/zh-cn/Google%E4%B9%A6%E7%AD%BE]书签[/url] · [url=/zh-cn/Google%E6%96%87%E4%BB%B6]文件[/url] · [url=/zh-cn/FeedBurner]FeedBurner[/url] · [url=/zh-cn/IGoogle]iGoogle[/url] · [url=/zh-cn/Jaiku]Jaiku[/url] · [url=/zh-cn/Knol]Knol[/url] · [url=/zh-cn/Google_Map_Maker]Map Maker[/url] · [url=/zh- ...
    posted @ 2009-11-07 20:39  下里巴人or知己  阅读(570)  评论(0编辑  收藏  举报