Hive中Order by和Sort by的区别是什么?
http://www.crazyant.net/1456.html
Hive基于HADOOP来执行分布式程序的,和普通单机程序不同的一个特点就是最终的数据会产生多个子文件,每个reducer节点都会处理partition给自己的那份数据产生结果文件,这导致了在HADOOP环境下很难对数据进行全局排序,如果在HADOOP上进行order by全排序,会导致所有的数据集中在一台reducer
转载
2014-12-29 14:58:13 ·
1181 阅读 ·
0 评论