Hive中的四种排序一、Order by二、Sort by 三、distribute by四、Cluster by
一、Order byorder by会对输入的数据做全局排序,因此只有一个reducer,多个reducer无法保证全局有序。只有一个reducer的弊端在于当输入的数据量较大时,需要较长的计算时间。order by跟数据库中的order by功能一致,按照某一项或几项排序输出。它与数据库中 order by 的区别在于在hive.mapred.mode = strict 模式下