hive语句执行顺序

hive语句和mysql都可以通过 explain+代码 查看执行计划,这样就可以查看执行顺序

SQL语句书写顺序:
select … from … where … group by … having … order by …
SQL语句执行顺序:
from … where … group by … having … select … order by …
from … on … join … where … group by … having … select … distinct … order by … limit

………………………………………………………………………………………………………..

hive语句执行顺序:
from … where … select … group by … having … order by …

基于MapReduce引擎

Map阶段:
    1.执行from加载,进行表的查找与加载
    2.执行where过滤,进行条件过滤与筛选
    3.执行select查询:进行输出项的筛选
    4.执行group by分组:描述了分组后需要计算的函数
    5.map端文件合并:map端本地溢出写文件的合并操作,每个map最终形成一个临时文件。
                   然后按列映射到对应的reduceReduce阶段:


Reduce阶段:
    1.group by:对map端发送过来的数据进行分组并进行计算。
    2.select:最后过滤列用于输出结果
    3.limit排序后进行结果输出到HDFS文件

你可能感兴趣的:(hive)