article / aiznoyer
没水平的押题
以下打勾的是本学期考到的,没考的基本上是剩下的了。。。挺无语的,重点是MapReduce的工作流程,甚至需要大家写Map函数的代码(那有没有可能明年考Reduce函数的代码)。
押题
以下打勾的是本学期考到的,没考的基本上是剩下的了。。。挺无语的,重点是MapReduce的工作流程,甚至需要大家写Map函数的代码(那有没有可能明年考Reduce函数的代码)。
不过总体来说挺简单的,送分的地方比较多,基本上把备考文档看个两遍上个80没啥问题(但是需要自己配一遍环境!!!)
- 简述大数据的内涵
- 简述大数据的4V特征
- 试述Hadoop的体系架构
- 试述Hadoop的运行模式及其优缺点
- 简述HDFS有哪些可靠性机制。备份节点和Secondary NameNode的区别是什么?(工作原理)
- 试述HDFS一个名称节点的优点、缺点
- 试述Shuffle机制各个阶段的主要作用(重点)
- 试述YARN体系架构中三大核心组件及各自功能
- 试述ZooKeeper如何保障数据安全
- 简述Hive和传统关系数据库的区别和联系
特别附加:
- 文件系统命令(书本P64-P68)
比较常见的文件系统命令:
(1)显示文件/log/text1.txt的基本信息
shell
hadoop fs -ls /log/text1.txt
(2)显示test目录下包含的文件数量
shell
hadoop fs -count /test
(3)将/test目录下文件test1.txt移动到/txt目录
shell
hadoop fs -mv /text1.txt /txt
(4)将文件/test/file1复制到/test/file2目录下
shell
hadoop fs -cp /test/file1 /test/file2
(5)删除文件/test/file1.txt
shell
hadoop fs -rm /test/file1.txt
(6)将Linux本地文件/home/xuluhui/text1.txt复制到HDFS目录/user/xuluhui下面,并重命名为text2.txt
shell
hadoop fs -put /home/xuluhui/text1.txt /user/xuluhui/text2.txt
(7)将HDFS目录/user/xuluhui下的文件合并,输出到本地文件系统,保存为/home/xuluhui/test.txt
shell
hadoop fs -getmerge /user/xuluhui /home/xuluhui/test.txt
(8)输出HDFS目录/user/xuluhui下文件test.txt到标准输出
shell
hadoop fs -cat /user/xuluhui/test.txt
(9)在HDFS目录/user下创建目录data1和data2
shell
hadoop fs -mkdir /user/data1 /user/data2
(10)显示文件input.txt的尾部内容
shell
hadoop fs -tail /user/input.txt
(11)更改/user/data1的权限为766
shell
hadoop fs -chmod 766 /user/data1