01_Hadoop学习笔记内容说明
Hadoop学习笔记内容说明_00
1、 观看云帆大数据梦琪老师的《企业级 Hadoop 1.x 应用开发基础课程》2014年4月左右版本。
2、 博客是在梦琪老师的随堂笔记上改动的,方便的是自己以后回顾学习,也或许能给需要改方面帮助的同行提供些许帮助,在此非常感谢梦琪老师。
3、 本系列是在CentOS6.4+hadoop1.2.1上实验通过的。
4、 由于本人刚刚接触,对Linux也只是初步了解,实验过程中遇到比较奇葩的问题,也在此博客写出。
5、 云帆大数据官网公布了一些公开的视频资源,大家可以前往学习。
第一个专题
Linux 系统环境搭建和基本命令使用:上课使用虚拟机,CentOS 6.4 64 位操作系统,基本命令要 熟悉,一次课时。
第二至五个专题(Hadoop 1.x 系列的核心,基础)
Hadoop 本地(单机)模式和伪分布式模式安装:Hadoop 1.x 理论知识,架构体系,安装模式, 认识 HDFS 文件系统,运行 MapReduce 程序 WordCount,如何查看 Hadoop 源码,Hadoop 1.x 包的 结构等等,三次课时。
HDFS 的体系结构、Shell 操作、Java API 使用和应用案例:深入讲解 HDFS 相关内容,包括 HDFS 架构与设计,优缺点,如何存储文件;如何访问 HDFS 文件系统,HDFS Shell 命令行、JAVA API 方式 方式;讲解一些企业中的小案例,比如小文件存储处理、类似百度网盘的分析(使用 HDFS)等等, 三到四次课时。
MapReduce 入门、框架原理、深入学习和相关 MR 面试题:深入讲解 MapReduce,架构体系,执 行流程,MapReduce 执行细节,讲解 MapReduce 编写(WordCount):数据类型、输入输出格式、 Combine、Partitioner、Sort 和 Group,插入企业中 MapReduce 简单使用案例,七到八次课时。
Hadoop 集群安装管理、NameNode 安全模式和 Hadoop 1.x 串讲复习:属于 Hadoop 运维工程师 的课程,集群的安装部署(建立在伪分布式安装基础上)、NN SafeMode、Hadoop 管理员命令的使用。 添加节点(机器)、卸载节点(机器),监控 Hadoop 集群,三次课时。
第六至十个专题(Hadoop 1.x 生态系统,HBase 和 Hive)
HBase 入门、存储原理、Shell 命令、Java API 操作和应用案例:分布式数据库(NoSql 数据库),
类似于 Oracle 数据库,存储几十亿行数据,上万列数据。准实时查询,与 MR 很好的集成,进行计算 处理数据。体系架构、访问(Shell 和 API)、MapReduce、管理,深入的讲解,四次课时左右。
Zookeeper 集群安装、回顾 HBase 和 MySql 5.1 安装与基本使用:主要为 HBase 和 Hive 基础理论 讲解。Zookeeper 协调 HBase,MySql 作为 Hive 元数据管理。两次课时。
Hive 安装、配置元数据、HiveQL 语句学习和应用案例
串讲复习 HDFS、MapReduce、HBase、Hive 和 Sqoop 安装与数据导入导出:整体复习,串讲 Hadoop、 HBase 和 Hive,在企业中如何使用,如何考虑,结合三者进行考虑。Sqoop 用于数据的导入导出,将 关系型数据库中的数据与 HBase 和 Hive 之间的相互导入导出。三次课时。
答疑总结、任务调度 Azkaban 安装和使用:进行整个 Hadoop 1.x 课程的答疑,与项目的讲解, 讲 解任务调度框架,如何管理 Job、管理 Hive。
第十一个专题
Hadoop 2.2.0 介绍、集群安装和商业版 Hadoop 介绍:Hadoop 2.X 介绍,Hadoop 2.4.0 为基础讲解, 理论讲解:与 Hadoop 1.x 不同;优点在哪里。安装:分布式安装,HDFS 和 MapReduce 程序测试。 介绍商业版的 Hadoop:对 Apache 开源 Hadoop 版本的包括,CDH Hortonworrsk,Interl,华为,IBM; 两次课时。
第十二个专题
Cloudera Hadoop 介绍、CM4.8 安装和部署 CDH4.5:商业版 hadoop CDH 的介绍,以及管理工具
CM 的安装,两次课时。
01_Hadoop学习笔记内容说明的更多相关文章
- Angular6 学习笔记——内容投影, ViewChild和ContentChild
angular6.x系列的学习笔记记录,仍在不断完善中,学习地址: https://www.angular.cn/guide/template-syntax http://www.ngfans.net ...
- .NET GC机制学习笔记
学习笔记内容来自网络资料摘录http://www.cnblogs.com/springyangwc/archive/2011/06/13/2080149.html 1.GC介绍 Garbage Col ...
- jeecms学习笔记
jeecms学习笔记 内容管理系统 1.栏目列表标签 作用:获取栏目的列表 [@cms_channel_list] [#list tag_list as b] <a href="${b ...
- C++内存管理学习笔记(3)
/****************************************************************/ /* 学习是合作和分享式的! /* Auth ...
- python3.4学习笔记(十七) 网络爬虫使用Beautifulsoup4抓取内容
python3.4学习笔记(十七) 网络爬虫使用Beautifulsoup4抓取内容 Beautiful Soup 是用Python写的一个HTML/XML的解析器,它可以很好的处理不规范标记并生成剖 ...
- Android学习笔记(二十)——自定义内容提供器
//此系列博文是<第一行Android代码>的学习笔记,如有错漏,欢迎指正! 如果我们想要实现跨程序共享数据的功能,官方推荐的方式就是使用内容提供器,可以通过新建一个类去继承 Conten ...
- Android学习笔记(十九)——内容提供器
//此系列博文是<第一行Android代码>的学习笔记,如有错漏,欢迎指正! 内容提供器(Content Provider)主要用于在不同的应用程序之间实现数据共享的功能,它提供了一套完整 ...
- python3.4学习笔记(十三) 网络爬虫实例代码,使用pyspider抓取多牛投资吧里面的文章信息,抓取政府网新闻内容
python3.4学习笔记(十三) 网络爬虫实例代码,使用pyspider抓取多牛投资吧里面的文章信息PySpider:一个国人编写的强大的网络爬虫系统并带有强大的WebUI,采用Python语言编写 ...
- VSTO学习笔记(九)浅谈Excel内容比较
原文:VSTO学习笔记(九)浅谈Excel内容比较 说起文件内容比较,或许我们首先想到的是UltraCompare这类专业比较的软件,其功能非常强大,能够对基于文本的文件内容作出快速.准确的比较,有详 ...
随机推荐
- Keil(MDK-ARM)使用教程(一)_界面+菜单
Ⅰ.概述 今天总结Keil(MDK-ARM)界面和菜单相关的内容,详情请往下看. 关于Keil的下载.安装和新建工程我已将在前面做了详细的总结,不懂的可以参考我博客里面相关的文章.该文章是在新建好工程 ...
- tcpdump http://www.cnblogs.com/daisin/articles/5512957.html
http://www.cnblogs.com/daisin/articles/5512957.html
- 15:开发Rsync服务启动脚本案例
[root@m01 ~]# rsn_count="ps -ef|grep 'rsync --d[a]emon'|wc -l" [root@m01 ~]# echo ${rsn_co ...
- Tomcat运行流程
Connector介绍 1.1 Connector的种类 Tomcat源码中与connector相关的类位于org.apache.coyote包中,Connector分为以下几类: Http Conn ...
- 问题解决 —— Http Status 500
在完成JavaWeb项目的过程中经常会出现这种错误 500:指的是服务器内部错误 通常遇到这种情况,我会去看控制台的信息,那里肯定会有提示,空指针(值没有传过去),或者java.sql.SQLExce ...
- -webkit-transition: all .2s ease-in-out;
W3C标准中对CSS3的transition这是样描述的:CSS的transition允许CSS的属性值在一定的时间区间内平滑地过渡.这种效果可以在鼠标单击.获得焦点.被点击或对元素任何改变中触发,并 ...
- [ JS 进阶 ] 基本类型 引用类型 简单赋值 对象引用 (转)
ECMAScirpt 变量有两种不同的数据类型:基本类型,引用类型.也有其他的叫法,比如原始类型和对象类型,拥有方法的类型和不能拥有方法的类型,还可以分为可变类型和不可变类型,其实这些叫法都是依据这两 ...
- 浅谈usort、uasort、uksort
前言:这三个函数都是php提供给开发者自定义的数组排序函数. 1.usort:按值排序,索引重新定义 a.基础案例 //自定义比较的函数 function mysort($a,$b){ if($a = ...
- xshell ftp报错:找不到匹配的outgoing encryption算法
场景:由于登陆跳板机都是从采用密钥的方式进行登陆的,然后在传输文件的时候报错 报错信息: 解决方案: 点击属性--->选择aes256-ctr加密方式默认这里是没有选择的 再次连接就成功连接上去 ...
- 【BZOJ2707】[SDOI2012]走迷宫 Tarjan+拓扑排序+高斯消元+期望
[BZOJ2707][SDOI2012]走迷宫 Description Morenan被困在了一个迷宫里.迷宫可以视为N个点M条边的有向图,其中Morenan处于起点S,迷宫的终点设为T.可惜的是,M ...