article / aiznoyer

没水平的押题

以下打勾的是本学期考到的,没考的基本上是剩下的了。。。挺无语的,重点是MapReduce的工作流程,甚至需要大家写Map函数的代码(那有没有可能明年考Reduce函数的代码)。

押题

以下打勾的是本学期考到的,没考的基本上是剩下的了。。。挺无语的,重点是MapReduce的工作流程,甚至需要大家写Map函数的代码(那有没有可能明年考Reduce函数的代码)。

不过总体来说挺简单的,送分的地方比较多,基本上把备考文档看个两遍上个80没啥问题(但是需要自己配一遍环境!!!)

  • 简述大数据的内涵
  • 简述大数据的4V特征
  • 试述Hadoop的体系架构
  • 试述Hadoop的运行模式及其优缺点
  • 简述HDFS有哪些可靠性机制。备份节点和Secondary NameNode的区别是什么?(工作原理)
  • 试述HDFS一个名称节点的优点、缺点
  • 试述Shuffle机制各个阶段的主要作用(重点)
  • 试述YARN体系架构中三大核心组件及各自功能
  • 试述ZooKeeper如何保障数据安全
  • 简述Hive和传统关系数据库的区别和联系

特别附加:

  • 文件系统命令(书本P64-P68)

比较常见的文件系统命令:

(1)显示文件/log/text1.txt的基本信息

shell
hadoop fs -ls /log/text1.txt

(2)显示test目录下包含的文件数量

shell
hadoop fs -count /test

(3)将/test目录下文件test1.txt移动到/txt目录

shell
hadoop fs -mv /text1.txt /txt

(4)将文件/test/file1复制到/test/file2目录下

shell
hadoop fs -cp /test/file1 /test/file2

(5)删除文件/test/file1.txt

shell
hadoop fs -rm /test/file1.txt

(6)将Linux本地文件/home/xuluhui/text1.txt复制到HDFS目录/user/xuluhui下面,并重命名为text2.txt

shell
hadoop fs -put /home/xuluhui/text1.txt /user/xuluhui/text2.txt

(7)将HDFS目录/user/xuluhui下的文件合并,输出到本地文件系统,保存为/home/xuluhui/test.txt

shell
hadoop fs -getmerge /user/xuluhui /home/xuluhui/test.txt

(8)输出HDFS目录/user/xuluhui下文件test.txt到标准输出

shell
hadoop fs -cat /user/xuluhui/test.txt

(9)在HDFS目录/user下创建目录data1和data2

shell
hadoop fs -mkdir /user/data1 /user/data2

(10)显示文件input.txt的尾部内容

shell
hadoop fs -tail /user/input.txt

(11)更改/user/data1的权限为766

shell
hadoop fs -chmod 766 /user/data1