ImageVerifierCode 换一换
格式:PPT , 页数:14 ,大小:368.50KB ,
文档编号:2636327      下载积分:18 文币
快捷下载
登录下载
邮箱/手机:
温馨提示:
系统将以此处填写的邮箱或者手机号生成账号和密码,方便再次下载。 如填写123,账号和密码都是123。
支付方式: 支付宝    微信支付   
验证码:   换一换

优惠套餐
 

温馨提示:若手机下载失败,请复制以下地址【https://www.163wenku.com/d-2636327.html】到电脑浏览器->登陆(账号密码均为手机号或邮箱;不要扫码登陆)->重新下载(不再收费)。

已注册用户请登录:
账号:
密码:
验证码:   换一换
  忘记密码?
三方登录: 微信登录  
下载须知

1: 试题类文档的标题没说有答案,则无答案;主观题也可能无答案。PPT的音视频可能无法播放。 请谨慎下单,一旦售出,概不退换。
2: 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。
3: 本文为用户(三亚风情)主动上传,所有收益归该用户。163文库仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对上载内容本身不做任何修改或编辑。 若此文所含内容侵犯了您的版权或隐私,请立即通知163文库(点击联系客服),我们立即给予删除!。
4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
5. 本站仅提供交流平台,并不能对任何下载内容负责。
6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

版权提示 | 免责声明

1,本文(云计算Mapreduce简介PPT课件.ppt)为本站会员(三亚风情)主动上传,163文库仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对上载内容本身不做任何修改或编辑。
2,用户下载本文档,所消耗的文币(积分)将全额增加到上传者的账号。
3, 若此文所含内容侵犯了您的版权或隐私,请立即通知163文库(发送邮件至3464097650@qq.com或直接QQ联系客服),我们立即给予删除!

云计算Mapreduce简介PPT课件.ppt

1、Google云计算的强大处理能力目录目录 1.为何云计算有强大的处理能力 2.云计算的构成要素 3.MapReduce分布式编程模型的结构 4.MapReduce对数据处理的流程 5.容错机制强大的分布式处理能力强大的分布式处理能力 云计算:其概念是由Google提出的,这是一个美丽的网络应用模式。 主要目的:它旨在通过网络把多个成本相对较低的计算实体整合成一个具有强大计算能力的完美系统。强大的分布式处理能力强大的分布式处理能力 由几十万甚至大约100万台廉价的服务器所组成的网络。这些机器单个而论的话,其性能并不比家用台式机强大多少。但是这个网络存储的数据量惊人,能容纳不计其数的网络数据拷贝,

2、因此搜索速度能够更快,在眨眼之间便能为数十亿的搜索提交答案。向云规模的数据处理迈进标志着我们在信息处理方面发生了翻天覆地的转变。从最基本的层面讲,云的发展就如同100年前人类用电的进程演变,当时的农场和公司逐渐关闭了自己的发电机,转而从高效的发电厂购买电力。Google的高管们很早前就开始展望这一转变并为之进行筹划准备。googlegoogle云计算的构成要素云计算的构成要素 谷歌文件系统GFS(海量的数据访问存储) Chubby分布式锁服务(分布式环境下并发操作的同步) MapReduce分布式编程模型的结构(并行数据处理) BigTable结构化数据存储系统(管理组织海量的数据)googl

3、egoogle云计算的构成要素云计算的构成要素Map函数(映射)和Reduce函数(化简)Map操作是可以高度并行的,这对高性能要求的应用以及并行计算领域的需求非常有用。统计词频的MapReduce函数的核心代码非常简短,主要就是实现这两个函数。map(String key, String value):/ key: 文件名/ value: 文件内容for each word w in value:EmitIntermediate(w, 1);reduce(String key, Iterator values):/ key: a word/ values: a list of countsi

4、nt result = 0;for each v in values:result += ParseInt(v);Emit(AsString(result);3.MapReduce3.MapReduce分布式编程模型的结构分布式编程模型的结构过程过程1.MapReduce库先把user program的输入文件划分为M份2.user program的副本中有一个称为master,其余称为worker,master是负责调度的,为空闲worker分配作业3.被分配了Map作业的worker,开始读取对应分片的输入数据,Map作业数量是由M决定的,map函数产生的中间键值对被缓存在内存中。4.缓存

5、的中间键值对会被定期写入本地磁盘,而且被分为R个区,R的大小是由用户定义的,将来每个区会对应一个Reduce作业;这些中间键值对的位置会被通报给master,master负责将信息转发给Reduce worker。过程过程5.master通知分配了Reduce作业的worker它负责的分区在什么位置,当Reduce worker把所有它负责的中间键值对都读过来后,先对它们进行排序,使得相同键的键值对聚集在一起。6.reduce worker遍历排序后的中间键值对,对于每个唯一的键,都将键与关联的值传递给reduce函数,reduce函数产生的输出会添加到这个分区的输出文件。7.当所有的Map和

6、Reduce作业都完成了,master唤醒正版的user program,MapReduce函数调用返回user program的代码。容错机制容错机制由于MapReduce函数库是设计用于在成百上千台机器上处理海量数据的,所以这个函数库必须考虑到机器故障的容错处理。master会定期发送命令轮询每一台worker机器。如果在一定时间内有一台worker机器一直没有响应,master就认为这个worker失效了。所有这个worker机器上正在处理的map 任务或者reduce任务都被设置成为空闲状态,被其他worker重新执行。解决方法:在master中,定期会设定检查点(checkpoint)。如果master任务失效了,可以从上次最后一个检查点开始启动另一个master进程。 谢谢!谢谢!

侵权处理QQ:3464097650--上传资料QQ:3464097650

【声明】本站为“文档C2C交易模式”,即用户上传的文档直接卖给(下载)用户,本站只是网络空间服务平台,本站所有原创文档下载所得归上传人所有,如您发现上传作品侵犯了您的版权,请立刻联系我们并提供证据,我们将在3个工作日内予以改正。


163文库-Www.163Wenku.Com |网站地图|