在线客服
扫描二维码
下载博学谷APP扫描二维码
关注博学谷微信公众号
Hive是建立在Hadoop上的数据仓库基础构架,它提供了一系列的工具,可以用来进行数据提取转化加载,这是一种可以存储、查询和分析存储在Hadoop中的大规模数据的机制。Hive定义了简单的类 SQL 查询语言,它允许熟悉SQL的用户查询数据。因此掌握Hive是学习大数据的必修课,那么掌握Hive架构需要学什么呢?本文将为大家讲述Hive的具体学习内容,下面是Hive视频教程的学习大纲:
第一章 数据管理与数据仓库
1. 数据分析系统不同数据来源
2. 数据管理--文件管理服务&跨部门文件管理规范
3. 数据管理--文件管理规范示例
4. 数据管理--数据质量检测
5. 数据仓库--基本概念&和数据库区别
6. 数据仓库--数据仓库主要特征
7. 数据仓库--数据仓库分层架构
8. 数据仓库--数据仓库元数据管理
第二章 Apache Hive介绍及安装部署
1. 介绍&Hive实现思路模拟
2. 架构&组件
3. 与RDBMS区别
4. 安装部署--内置derby版以及缺陷
5. 安装部署-mysql版安装
6. 安装部署-几种交互方式
7. 初体验-理解什么是映射
第三章 Apache Hive—DDL
1. DDL--创建表--数据类型&分隔符
2. DDL--创建表--默认分隔符
3. DDL--创建表--分区表创建
4. DDL--创建表--双分区表&小结
5. DDL--创建表--分桶表创建&分桶数据导入
6. DDL--创建表--分桶表总结&分桶表好处
7. DDL--创建表--内外部表&like复制
8. DDL--修改表&显示命令
第四章 Apache Hive—DML
1. DML--load装载数据
2. DML--insert&多重插入&动态分区
3. DML--导出数据
4. DML--select查询
第五章 Apache Hive—函数及其他操作
1. join操作
2. 命令行&参数配置方式
3. 内置运算符函数&dual测试方式
4. 自定义函数UDF开发
5. 了解transform
6. 特殊分隔符处理
总而言之,该课程适合有一定大数据基础的学员进行学习。在完成上面的学习大纲后,大家就可以在hive上建立企业自己的数据数仓平台,还能针对企业自己的业务实现自己的UDF函数。大家还在等什么?现在就在下方填写课程试听申请,立即就能获取相应的视频课程在线学习!
— 申请免费试学名额 —
在职想转行提升,担心学不会?根据个人情况规划学习路线,闯关式自适应学习模式保证学习效果
讲师一对一辅导,在线答疑解惑,指导就业!
相关推荐 更多
如何通过云计算大数据在线培训视频学习项目实战经验?
目前通过参加云计算大数据培训是成为进入大数据行业的重要途径之一。而对于时间并不充裕或者无法脱产学习以及异地学习的朋友而言,更多的选择云计算大数据在线培训的方式学习。那如果通过云计算大数据在线培训视频学习项目实战经验呢?
7156
2019-08-06 19:00:46
大数据在线学习零基础教程有哪些?
数据开发日新月异,目前国内的数据产业链逐步形成,而大数据也成为了市场上最热门的求职领域之一。高薪且无限的发展前景吸引着许多人想要进入大数据这个行业,但是对于许多零基础的初学者来讲,往往遇到的首要问题,就是没有适合自己学习资源。为了帮助广大的大数据初学者能够轻松入门大数据,下面为大家推荐一些优质的大数据在线学习零基础教程。
4623
2020-05-15 15:24:46
什么是Hive?为什么要用Hive?
Hive是建立在Hadoop上的数据仓库基础构架。对于有一定基础的大数据学习者来讲,Hive是必须掌握的核心技术。本文主要带大家来认识一下Hive,了解什么是Hive?为什么要用Hive?如果大家对这些问题好奇,就一起看看接下来的内容吧~
8955
2020-06-03 18:08:30
常用的大数据实时计算框架有哪些?
在大数据技术中,有离线计算、批量计算、实时计算以及流式计算,其中,离线计算和实时计算指的是数据处理的延迟;批量计算和流式计算指的是数据处理的方式。
4786
2021-03-10 09:50:12
10月数据库排行榜出炉,火速围观!
十月份的数据库榜单出炉啦!DB-Engines最近发布了2021年10月份的数据库排名,网站是根据数据库管理系统当前的流行程度进行排名,排名每月更新一次。这份榜单分析主要为数据库相关从业人员提供一个技术方向的参考,其中数据库排名情况并非依据产品市场占有率等因素。
3291
2021-10-19 18:27:08