今天就跟大家聊聊有关如何掌握Hive架构,可能很多人都不太了解,为了让大家更加了解,小编给大家总结了以下内容,希望大家根据这篇文章可以有所收获。
Hive是建立在Hadoop上的数据仓库基础构架,它提供了一系列的工具,可以用来进行数据提取转化加载,这是一种可以存储、查询和分析存储在Hadoop中的大规模数据的机制。Hive定义了简单的类 SQL 查询语言,它允许熟悉SQL的用户查询数据。因此掌握Hive是学习大数据的必修课,那么掌握Hive架构需要学什么呢?本文将为大家讲述Hive的具体学习内容,下面是Hive视频教程的学习大纲:
第一章 数据管理与数据仓库
1. 数据分析系统不同数据来源
2. 数据管理--文件管理服务&跨部门文件管理规范
3. 数据管理--文件管理规范示例
4. 数据管理--数据质量检测
5. 数据仓库--基本概念&和数据库区别
6. 数据仓库--数据仓库主要特征
7. 数据仓库--数据仓库分层架构
8. 数据仓库--数据仓库元数据管理
第二章 Apache Hive介绍及安装部署
1. 介绍&Hive实现思路模拟
2. 架构&组件
3. 与RDBMS区别
4. 安装部署--内置derby版以及缺陷
5. 安装部署-mysql版安装
6. 安装部署-几种交互方式
7. 初体验-理解什么是映射
第三章 Apache Hive—DDL
1. DDL--创建表--数据类型&分隔符
2. DDL--创建表--默认分隔符
3. DDL--创建表--分区表创建
4. DDL--创建表--双分区表&小结
5. DDL--创建表--分桶表创建&分桶数据导入
6. DDL--创建表--分桶表总结&分桶表好处
7. DDL--创建表--内外部表&like复制
8. DDL--修改表&显示命令
第四章 Apache Hive—DML
1. DML--load装载数据
2. DML--insert&多重插入&动态分区
3. DML--导出数据
4. DML--select查询
第五章 Apache Hive—函数及其他操作
1. join操作
2. 命令行&参数配置方式
3. 内置运算符函数&dual测试方式
4. 自定义函数UDF开发
5. 了解transform
6. 特殊分隔符处理
看完上述内容,你们对如何掌握Hive架构有进一步的了解吗?如果还想了解更多知识或者相关内容,请关注亿速云行业资讯频道,感谢大家的支持。
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。