Hadoop生态组件对比
-
Hive和Hadoop、Spark是什么关系?分布式计算框架组件关系解析
Hive不是独立分布式计算引擎,而是分布式计算框架中的数据仓库翻译层与元数据中枢,核心关系可概括为“HDFS管存储、执行引擎管计算、Hive管SQL与元数据、MySQL管定义、HBase补点查”,Hive在Hadoop生态中扮演“翻译官”角色:向上承接类SQL查询,向下把任务翻译给MapReduce、Tez或S……
Hive不是独立分布式计算引擎,而是分布式计算框架中的数据仓库翻译层与元数据中枢,核心关系可概括为“HDFS管存储、执行引擎管计算、Hive管SQL与元数据、MySQL管定义、HBase补点查”,Hive在Hadoop生态中扮演“翻译官”角色:向上承接类SQL查询,向下把任务翻译给MapReduce、Tez或S……