Hadoop面试题之Hadoop基础

本文总结了Hadoop面试中的基础问题,包括Hadoop的主要瓶颈、运行模式、生态系统组件及其作用、Hadoop的配置文件及作用、集群中关键进程的功能、默认端口及其含义,以及Hadoop集群的管理和优化。
摘要由CSDN通过智能技术生成

Hadoop面试题之Hadoop基础

一 Hadoop面试题

1.1 Hadoop基础(☆☆)

1.1.1 下列哪项通常是集群的最主要瓶颈(C)磁盘 IO

A.CPU
B.网络
C.磁盘 IO
D.内存

1.1.2 下列哪个是Hadoop运行的模式?(ABC)单机版、伪分布式、完全分布式

A.单机版
B.伪分布式
C.完全分布式

1.1.3 列举几个hadoop生态圈的组件并做简要描述(Zookeeper、Flume、Hbase、Hive、Sqoop)

1)Zookeeper:是一个开源的分布式应用程序协调服务,基于zookeeper可以实现同步服务,配置维护,命名服务。
2)Flume:一个高可用的,高可靠的,分布式的海量日志采集、聚合和传输的系统。
3)Hbase:是一个分布式的、面向列的开源数据库, 利用Hadoop HDFS作为其存储系统。
4)Hive:基于Hadoop的一个数据仓库工具,可以将结构化的数据档映射为一张数据库表,并提供简单的sql 查询功能,可以将sql语句转换为MapReduce任务进行运行。
5)Sqoop:将一个关系型数据库中的数据导进到Hadoop的 HDFS中,也可以将HDFS的数据导进到关系型数据库中。

1.1.4 解释“hadoop”和“hadoop 生态系统”两个概念。(Hadoop框架本身;hadoop生态系统还包括保证hadoop框架正常高效运行其他框)

Hadoop是指Hadoop框架本身;hadoop生态系统,不仅包含hadoop,还包括保证hadoop框架正常高效运行其他框架,比如zookeeper、Flume、Hbase、Hive、Sqoop等辅助框架。

1.1.5 简要描述如何安装配置apache的一个开源Hadoop,只描述即可,无需列出具体步骤,列出具体步骤更好。(11步)

1

  • 0
    点赞
  • 8
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值