关于hive中Map join 时大表left join小表的问题
Posted 孙中明
tags:
篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了关于hive中Map join 时大表left join小表的问题相关的知识,希望对你有一定的参考价值。
关于hive中Map join 时大表left join小表的问题
在hive
中,(启用Map join
时) 大表left join
小表,加载从右向左,所以小表会加载进内存,存储成map
键值对,通过大表驱动小表,来进行join
,即大表中的join
字段作为key
来获取value
进行join
。
在MySQ
L中,left join
加载从左向右,即join
左边的表会先加载进内存,与右边表进行join
。
mapjoin
时要让小表进内存,大表进内存的话可能会因为过大的原因,导致mapjoin
无法实现,从而转为reduce join
。
mysql
跟hive
加载顺序不同。
最先加载的是驱动表,最好是小表。
以上是关于关于hive中Map join 时大表left join小表的问题的主要内容,如果未能解决你的问题,请参考以下文章