长沙尚学堂|十年树人|成就高薪
致力推动IT教育,我们正在行动    全国咨询热线:0731-83072091

Impala&Oozie视频教程

主       讲:庞磊
类       型:高级教程
适合对象:
课程介绍

       Impala是Cloudera公司主导开发的新型查询系统,它提供SQL语义,能查询存储在Hadoop的HDFS和HBase中的PB级大数据。
      优点:
      1、Impala不需要把中间结果写入磁盘,省掉了大量的I/O开销。

     2、省掉了MapReduce作业启动的开销。MapReduce启动task的速度很慢(默认每个心跳间隔是3秒钟),Impala直接通过相应的服务进程来进行作业调度,速度快了很多。

     3、Impala完全抛弃了MapReduce这个不太适合做SQL查询的范式,而是像Dremel一样借鉴了MPP并行数据库的思想另起炉灶,因此可做更多的查询优化,从而省掉不必要的shuffle、sort等开销。

       4、通过使用LLVM来统一编译运行时代码,避免了为支持通用编译而带来的不必要开销。

       5、用C++实现,做了很多有针对性的硬件优化,例如使用SSE指令。

       6、使用了支持Data locality的I/O调度机制,尽可能地将数据和计算分配在同一台机器上进行,减少了网络开销。

课程目录

尚学堂科技_庞磊_01.impala简介
尚学堂科技_庞磊_02.impala架构、外部shell_3
尚学堂科技_庞磊_03.impala内部shell、存储、sql
尚学堂科技_庞磊_05.oozie简介
尚学堂科技_庞磊_06.oozie视频


标签:教程视频
分享:0
上一篇:Hive视频教程
下一篇:Linux视频教程
开班计划
热门文章
视频下载
猜你喜欢

有位老师想和您聊一聊