暂无图片
暂无图片
暂无图片
暂无图片
暂无图片
大数据面试题 100道.pdf
328
62页
12次
2022-06-17
免费下载
大数据工程师面试题
1. 选择题
1.1. 下面哪个程序负责 HDFS 数据存储。
a)NameNode b)Jobtracker c)Datanode d)secondaryNameNode e)tasktracker
答案 C datanode
1.2. HDfS 中的 block 默认保存几份?
a)3 b)2 c)1 d)不确定
答案 A 默认 3
1.3. 下列哪个程序通常与 NameNode 在一个节点启动?
a)SecondaryNameNode b)DataNode c)TaskTracker d)Jobtracker
答案 D
1.4. HDFS 默认 Block Size
a)32MB b)64MB c)128MB
答案:B
1.5. 下列哪项通常是集群的最主要瓶颈
a)CPU b)网络 c)磁盘 IO d)内存
答案:C 磁盘
首先集群的目的是为了节省成本,用廉价的 pc 机,取代小型机及大型机。小型机和大型机
有什么特点?
1.cpu 处理能力强
2.内存够大,所以集群的瓶颈不可能是 a d
3.如果是互联网有瓶颈,可以让集群搭建内网。每次写入数据都要通过网络(集群是内网),
然后还要写入 3 份数据,所以 IO 就会打折扣。
1.6. 关于 SecondaryNameNode 哪项是正确的?
a)它是 NameNode 的热备 b)它对内存没有要求
c)它的目的是帮 NameNode 合并编辑日志,减少 NameNode 启动时间
d)SecondaryNameNode 应与 NameNode 部署到一个节点
答案 C
1.7. 下列哪项可以作为集群的管理
a)Puppet b)Pdsh c)Cloudera Manager d)Zookeeper
答案 ABD
具体可查看什么 ZookeeperZookeeper 的作用是什么,在 Hadoop hbase 中具体作
用是什么。
1.8. Client 端上传文件的时候下列哪项正确
a)数据经过 NameNode 传递给 DataNode
b)Client 端将文件切分为 Block,依次上
c)Client 只上传数据到一台 DataNode,然后 NameNode 负责 Block 复制工作
答案 B
分析:Client NameNode 发起文件写入的请求。NameNode 根据文件大小和文件块配置
情况,返回给 Client 它所管理部分 DataNode 的信息。Client 将文件划分为多个 Block,根
DataNode 的地址信息按顺序写入到每一个 DataNode 块中。具体查看 HDFS 体系结构
简介及优缺点。
1.9. 下列哪个是 Hadoop 运行的模式
a)单机版 b)伪分布式 c)分布式
答案 ABC 单机版,伪分布式只是学习用的。
of 62
免费下载
【版权声明】本文为墨天轮用户原创内容,转载时必须标注文档的来源(墨天轮),文档链接,文档作者等基本信息,否则作者和墨天轮有权追究责任。如果您发现墨天轮中有涉嫌抄袭或者侵权的内容,欢迎发送邮件至:contact@modb.pro进行举报,并提供相关证据,一经查实,墨天轮将立刻删除相关内容。

评论

关注
最新上传
暂无内容,敬请期待...
下载排行榜
Top250 周榜 月榜