Hive简介及核心概念

1.简介

Hive 是一个构建在 Hadoop 之上的数据仓库,它可以将结构化的数据文件映射成表,并提供类 SQL 查询功能,用于查询的 SQL 语句会被转化为 MapReduce 作业,然后提交到 Hadoop 上运行。

特点:

1. 简单、容易上手 (提供了类似 sql 的查询语言 hql),使得精通 sql 但是不了解 Java 编程的人也能很好地进行大数据分析;

3. 灵活性高,可以自定义用户函数 (UDF) 和存储格式;

4. 为超大的数据集设计的计算和存储能力,集群扩展容易;

5. 统一的元数据管理,可与 presto/impala/sparksql 等共享数据;

你可能感兴趣的:(Hive,hive,hadoop,数据仓库)