黑马程序员AI智能助手

首页技术文章正文

Hive和Hadoop协作执行任务的工作原理是什么？

更新时间:2022-06-02 来源:黑马程序员浏览量:

Hive是基于Hadoop的一个数据仓库工具，主要用来对数据进行抽取、转换、加载操作。HiveQL可以将结构化的数据文件映射为一张数据表，允许熟悉SQL的用户查询数据，也允许熟悉MapReduce的开发者开发自定义的mapper和reducer来处理内建的mapper和 reducer无法完成的复杂的分析工作，相对于Java代码编写的MapReduce来说，Hive的优势更加明显。Hive利用Hadoop的HDFS存储数据，利用Hadoop的MapReduce执行查询。

Hadoop的MapReduce执行查询的工作原理

Hive和Hadoop协作执行任务的工作原理

(1) 用户通过用户接口向Driver提交executeQuery。

(2) Driver向Compiler发送获取计划的请求。

(3) Compiler根据用户提交的executeQuery去MetaStore获取需要的元数据信息。

(4) MetaStore向Compiler发送元数据信息。

(5) Compiler得到元数据信息，并向Driver发送计划。

(6) Driver 向EXECUTION ENGINE提交executePlan。

(7) 用户接口向Driver发起获取结果集(fetchResults)的请求。

(8）Driver向EXECUTION ENGINE发起获取结果集的请求。

(9）EXECUTION ENGINE向Driver发送结果集，Driver获取到结果集后返回用户接口。

上一篇：Python大数据培训：basemap怎么安装 下一篇：Python培训：绘制甘特图

最新资讯

相关阅读

分享到：

javaee

python大数据

web

ui

cloud

test

c

netmarket

pm

Linux

movies

robot

uids

AI

jdbc

选择校区

北京校区

申请试听名额

申请试听名额

申请试听名额

申请试听名额

申请试听名额

申请试听名额

申请试听名额

申请试听名额

申请试听名额

申请试听名额

申请试听名额

申请试听名额

申请试听名额

申请试听名额

热门课程推荐

更多>>

首页|校区分布|师资力量|关于我们|报名流程

常见问题|技术资讯

江苏传智播客教育科技股份有限公司版权所有
Copyright 2006-2023, All Rights Reserved

在线咨询我要报名

和我们在线交谈！