码迷,mamicode.com
首页 > 其他好文 > 详细

MapReduce面试题整理与收集

时间:2020-02-01 16:01:53      阅读:95      评论:0      收藏:0      [点我收藏+]

标签:多次   应该   不能   不用   toc   tle   逻辑   com   而且   

一、MapReduce基本常识

二、MapReduce要点

1、combiner的组件需要注意什么?

??因为combiner在MapReduce过程中可能调用也可能不调用,可能调用一次也可能调用多次,无法确定和控制。
??所以,combiner的使用原则是:有或没有都不能影响业务逻辑,是不是用combiner都不能影响最终reducer的结果。而且,combiner的输出kv应该跟reducer的输入kv对应起来。因为有时使用combiner不当的话会对统计结果造成错误结局,还不如不用。比如对所有数求平均数:

Mapper端使用combiner
3 5 7 ->(3+5+7)/3=5
2 6 -> ( 2+6)/3=4
Reducer
(5+4)/2=9/2≈4.5 不等于 (3+%+7+2+6)/5=23/5≈4.6

MapReduce面试题整理与收集

标签:多次   应该   不能   不用   toc   tle   逻辑   com   而且   

原文地址:https://www.cnblogs.com/nthforsth/p/12248189.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!