什么是Hive 博客分类: Hive Hive
程序员文章站
2024-03-15 11:53:17
...
一 什么是Hive
1、Hive是构建于Hadoop HDFS之上的一个数据仓库基础架构。
2、Hive可以用来进行数据提取转化加载(ETL)。
3、Hive定义了简单的类似SQL查询语言,称为HQL,它允许熟悉SQL的用户查询数据。
4、Hive允许熟悉MapReduce开发者开发自定义的mapper和reducer来处理内建的mapper和reducer无法完成的复杂的分析工作。
5、Hive是HQL解析引擎,他将SQL语句转移成M/R Job,然后在Hadoop执行。
6、Hive的表其实就是HDFS的目录/文件。
二 Hive的元数据
1、Hive将元数据存储在数据库中(metastore),支持mysql、derby等数据库。derby是默认数据库。
2、Hive中的元数据包括表的名字,表的列和分区及其属性,表的属性(是否为外部表等),表的数据所在目录等。
推荐阅读
-
hive java api 博客分类: hive hive
-
hive 自定义函数 博客分类: hive hive
-
什么是Hive 博客分类: Hive Hive
-
hive hiveconf 配置 博客分类: Hive hive
-
关于HIVE的小白经验 博客分类: hadoophive Hadoophive
-
[hive error] check the manual that corresponds to your MySQL server version for 博客分类: linuxhive hivelinuxerror
-
Hive 3.x 支持 ACID 增删改查 博客分类: 大数据 hive hadoop 大数据
-
Hive To Elasticsearch 博客分类: hadoopelasticsearchhive
-
hive-ha 安装 博客分类: linuxhive linuxhivehahadoophdfs
-
Hive 3.x 支持 ACID 增删改查 博客分类: 大数据 hive hadoop 大数据