情况一 如果其中一张表为小表,可以直接在map端join的方式进行聚合 情况二 如果两张表都是大表,可以采用联合key的方式进行聚合。联合key的第一个部分join on的部分为公共字段,第二部分添加一个flag,就是一个标记,用来区分两张表,0代表着表A,1代表着表B。用来让Reduce端区分两张表的信息。在Mapper进行表的处理,join on公共字段相同的数据划分到同一个分区中,进而传输到一个reduce中,然后进行聚合。 每篇一言: 粗粮可以养胃,书籍可以养气,景致可以养心。