电脑桌面
添加小米粒文库到电脑桌面
安装后可以在桌面快捷访问

Google的秘密VIP免费

Google的秘密_第1页
Google的秘密_第2页
Google的秘密_第3页
Google的秘密PageRank彻底解说中文版索引1.前言2.PageRank的基本概念3.怎样求得PageRank4.实际应用时的问题5.Namazu上的实际安装实验6.对PageRank的个人见解7.参考文献8.附录:「guguru?/gouguru?★(2003/7/1)拙著『Namazu系统的构筑和活用』已作修订。详情请看介绍页面。★(2003/5/20)与Google有关的在线新闻报道一览(日语)已被分离到另一张页面(googlenews.html)。★(2001/2/28)Namazu的索引中使用的计算PageRank的Perl脚本prnmz-1.0.tar.gz公开下载。1.前言最近,搜索引擎非常引人注目。Google是基于现担任CEO的LarryPage和担任总经理的SergeyBrin(2001年2月)在就读于美斯坦福大学研究生院时所开发的搜索引擎的一种检索服务。Google从1998年9月开始服务,但NetscapeCommunications在GOOGLE的测试阶段就开始与其合作,美国Yahoo公司也从2000年6月起将默认搜索引擎(美国Yahoo不能检索时作为增补的搜索引擎)由原先合作的Inktomi转换为了Google。日语版GOOGLE在2000年9月正式登场,现已被Biglobe(NEC)所采用。(注:2001年4月YahooJAPAN和@NTFTY,7月索尼,2002年1月Excite也相继与Google建立了协作关系)。Google被评价的优点不仅仅在于去除无用的(广告)标语构成单一页面的功能、独自的Cache系统、动态制成摘要信息、为实现高速检索而设置的分散系统(数千台规模的Linux群集器)等,而其中最大的优点正是它检索结果的正确性。一种能够自动判断网页重要性的技术「PageRank是(网页等级)」就是为此而设计的一种技术。本文的目的就是以尽可能浅显易懂的语言来说明PageRank系统的概要和原理。以下是PageRank的一篇基础文章。LawrencePage,SergeyBrin,RajeevMotwani,TerryWinograd,'ThePageRankCitationRanking:BringingOrdertotheWeb',1998,为了更高效地计算PageRank,以下是改良以后的一篇论文。TaherH.Haveliwala,'EfficientComputationofPageRank',StanfordTechnicalReport,1999,另外,以下是PageRank的演示用资料(PowerPoint)。LarryPage,'PageRank:BringingOrdertotheWeb',(已失效)接下来就对这两篇文章(另加一篇资料)进行基本说明。首先,用简单的例子来解说PageRank的概念,再归结到使用超链接关系的排序系统来解决大规模疏松疏矩阵的特性值的问题。然后我们会接触一些在现实世界中应用基本模型时出现的问题和对应方法。接下来,为了探讨是否能够作为「个人化PageRank」使用,进行对免费全文检索系统Namazu的安装实验并对其结果进行阐述。最后发表我对PageRank的个人见解。另外,为了能够理解以下的说明内容,需要大学基础课程程度的数学知识(尤其是线形代数)。然而为使文科生也能够顺利读下去,尽可能地不用算式来说明问题,同时,为了加入笔者个人的见解,没有加入像原文那么多的算法和数字,也存在许多不够严密和欠正确的地方,事先在次声明。具体内容请参照原文。PageRank(TM)是美国Google公司的登记注册商标。2.PageRank的基本概念PageRank是基于「从许多优质的网页链接过来的网页,必定还是优质网页」的回归关系,来判定所有网页的重要性。在以下冗长的说明中,许多部分大量地使用了专业用语,会造成理解上的困难。这一章虽然准备集中于定性而简单的解说,但是,即使如此也会有怎么也不明白的时候,此时只要能够理解「从许多优质的网页链接过来的网页,必定还是优质网页」这一思考方法也就非常得可贵了。因为在所有几个要点中,这个是最重要的思考方法。关于PageRankPageRank,有效地利用了Web所拥有的庞大链接构造的特性。从网页A导向网页B的链接被看作是对页面A对页面B的支持投票,Google根据这个投票数来判断页面的重要性。可是Google不单单只看投票数(即链接数),对投票的页面也进行分析。「重要性」高的页面所投的票的评价会更高,因为接受这个投票页面会被理解为「重要的物品」。根据这样的分析,得到了高评价的重要页面会被给予较高的PageRank(网页等级),在检索结果内的名次也会提高。PageRank是Google中表示网页重要性的综合性指标,而且不会受到各种检索(引擎)的影响。倒不如说,PageRank就是基于对"使用复杂的算法而得到的链接构造"的分析,从而得出的各网页本身的特性。...

1、当您付费下载文档后,您只拥有了使用权限,并不意味着购买了版权,文档只能用于自身使用,不得用于其他商业用途(如 [转卖]进行直接盈利或[编辑后售卖]进行间接盈利)。
2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。
3、如文档内容存在违规,或者侵犯商业秘密、侵犯著作权等,请点击“违规举报”。

碎片内容

状元书阁+ 关注
实名认证
内容提供者

爱好英语教学和互联网行业,热爱教育事业,兢兢业业

确认删除?
VIP
微信客服
  • 扫码咨询
会员Q群
  • 会员专属群点击这里加入QQ群
客服邮箱
回到顶部