什么是Hive

来源:互联网 发布:数据透视表 总计图标 编辑:程序博客网 时间:2024/05/21 17:02
一 什么是Hive
1、Hive是构建于Hadoop HDFS之上的一个数据仓库基础架构。
2、Hive可以用来进行数据提取转化加载(ETL)。
3、Hive定义了简单的类似SQL查询语言,称为HQL,它允许熟悉SQL的用户查询数据。
4、Hive允许熟悉MapReduce开发者开发自定义的mapper和reducer来处理内建的mapper和reducer无法完成的复杂的分析工作。
5、Hive是HQL解析引擎,他将SQL语句转移成M/R Job,然后在Hadoop执行。
6、Hive的表其实就是HDFS的目录/文件。
 
二 Hive的元数据
1、Hive将元数据存储在数据库中(metastore),支持mysql、derby等数据库。derby是默认数据库。
2、Hive中的元数据包括表的名字,表的列和分区及其属性,表的属性(是否为外部表等),表的数据所在目录等。


 

 

 
  • 大小: 112.2 KB
  • 查看图片附件