Hadoop计算框架特性 1.数据量大不是问题,数据倾斜是个问题。 2.jobs数比较多的作业运行效率相对比较低,比如即使有几百行的表,如果多次关联多次汇总,产生十几个jobs,耗时很长。原因是map reduce作业初始化的时间是比较长的。 3.sum,count,max,min等UDAF,不怕数据倾斜问题,hado... 大数据 2023-10-04 132 点赞 2 评论 200 浏览