关闭

大数据面试题分享

349人阅读 评论(0) 收藏 举报
分类:

1.Hadoop集群可以运行的3个模式?


单机(本地)模式
伪分布式模式
全分布式模式

2.  单机(本地)模式中的注意点?

在单机模式(standalone)中不会存在守护进程,所有东西都运行在一个JVM上。这里同样没有DFS,使用的是本地文件系统。单机模式适用于开发过程中运行MapReduce程序,这也是最少使用的一个模式。

3.  伪分布模式中的注意点?

伪分布式(Pseudo)适用于开发和测试环境,在这个模式中,所有守护进程都在同一台机器上运行。

4.  VM是否可以称为Pseudo

不是,两个事物,同时Pseudo只针对Hadoop

5.  全分布模式又有什么注意点?

全分布模式通常被用于生产环境,这里我们使用N台主机组成一个Hadoop集群,Hadoop守护进程运行在每台主机之上。这里会存在Namenode运行的主机,Datanode运行的主机,以及task tracker运行的主机。在分布式环境下,主节点和从节点会分开。

6.  Hadoop是否遵循UNIX模式?

是的,在UNIX用例下,Hadoop还拥有“conf”目录。

7.  Hadoop安装在什么目录下?

ClouderaApache使用相同的目录结构,Hadoop被安装在cd/usr/lib/hadoop-0.20/

8.  NamenodeJob trackertask tracker的端口号是?

Namenode70Job tracker30Task tracker60

9.  Hadoop的核心配置是什么?

Hadoop的核心配置通过两个xml文件来完成:1hadoop-default.xml2hadoop-site.xml。这些文件都使用xml格式,因此每个xml中都有一些属性,包括名称和值,但是当下这些文件都已不复存在。

10.  那当下又该如何配置?

Hadoop现在拥有3个配置文件:1core-site.xml2hdfs-site.xml3mapred-site.xml。这些文件都保存在conf/子目录下。

11.  RAM的溢出因子是?

溢出因子(Spill factor)是临时文件中储存文件的大小,也就是Hadoop-temp目录。

12.  fs.mapr.working.dir只是单一的目录?

fs.mapr.working.dir只是一个目录。

13.  hdfs-site.xml3个主要属性?


dfs.name.dir决定的是元数据存储的路径以及DFS的存储方式(磁盘或是远端)
dfs.data.dir决定的是数据存储的路径
fs.checkpoint.dir用于第二Namenode

14.  如何退出输入模式?

退出输入的方式有:1,按ESC2,键入:q(如果你没有输入任何当下)或者键入:wq(如果你已经输入当下),并且按下Enter

15.  当你输入hadoopfsck /造成“connection refused java exception’”时,系统究竟发生了什么?

这意味着Namenode没有运行在你的VM之上。

0
0
查看评论

大数据工程师面试题(七)

9. 面试问题: 1.从前到后从你教育背景(学过哪些课)到各个项目你负责的模块,问的很细(本以为他是物理学博士,但是所有的技术都懂) 2.hadoop 的 namenode 宕机,怎么解决 先分析宕机后的损失,宕机后直接导致client无法访问,内存中的元数据丢失,但是硬盘中的元数据应该还...
  • u011682879
  • u011682879
  • 2017-02-26 10:02
  • 6622

大数据面试题及答案-汇总版

大数据面试题及答案 汇总版                                  ...
  • albg_boy
  • albg_boy
  • 2017-11-02 14:22
  • 3717

大数据工程师面试题(三)

2.13. 简述hadoop的调度器 FIFO schedular:默认,先进先出的原则 Capacity schedular:计算能力调度器,选择占用最小、优先级高的先执行,依此类推 Fair schedular:公平调度,所有的job具有相同的资源。 2.14. 列出你开发mapredu...
  • u011682879
  • u011682879
  • 2017-02-19 15:39
  • 3016

大数据量10道面试题及解析

  海量数据处理:十道面试题与十个海量数据处理方法总结 作者:July、youwang、yanxionglu。 时间:二零一一年三月二十六日 本文之总结:教你如何迅速秒杀掉:99%的海量数据处理面试题。有任何问题,欢迎随时交流、指正。 出处:http://blog.csd...
  • hzp666
  • hzp666
  • 2017-04-19 09:16
  • 485

大数据面试题记录

1 海量日志数据,提取出某日访问百度次数最多的那个IP
  • xlf13872135090
  • xlf13872135090
  • 2014-08-25 11:18
  • 7983

大数据面试-05-大数据工程师面试题

2)HashMap和HashTable,ArrayList和Vector,ArrayList和LinkedList的区别 1 HashMap不是线程安全的 hashmap是一个接口 是map接口的子接口,是将键映射到值的对象,其中键和值都是对象,并且不能包含重复键,但可以包含重复值。 HashMap...
  • qq_21383435
  • qq_21383435
  • 2018-01-12 15:28
  • 95

大数据面试题分析

最近看到一些大数据的面试题,今天就在这里好好分析一下。大数据面试题的条件一般都要求我们处理一批计算机内存放不下的数据。当我们遇到这种面试题时,我们会不知到该怎么办,其实我们可以通过以下这些思想来完成大数据处理:  1. 哈希切分  哈希切分就是将一个大文件,利用哈希的原理,将...
  • qq_33417547
  • qq_33417547
  • 2016-11-10 15:12
  • 773

大数据常见面试题汇总(一)

大数据常见面试题汇总(一)
  • high2011
  • high2011
  • 2016-06-06 13:47
  • 17319

大数据面试-01-大数据工程师面试题

1. 选择题 1.1. 下面哪个程序负责 HDFS 数据存储。 c)Datanode 答案 C datanode 1.2. HDfS 中的 block 默认保存几份? a)3 份 答案 A 默认 3 份 1.3. 下列哪个程序通常与 NameNode 在一个节...
  • qq_21383435
  • qq_21383435
  • 2018-01-12 14:52
  • 202

腾讯大数据面试及参考答案[2017]

Hadoop面试45个题目和参考答案http://www.aboutyun.com/forum.php?mod=viewthread&tid=21404&extra=page%3D1
  • wuxintdrh
  • wuxintdrh
  • 2017-04-03 18:28
  • 1681
    个人资料
    • 访问:490570次
    • 积分:5143
    • 等级:
    • 排名:第6444名
    • 原创:103篇
    • 转载:139篇
    • 译文:0篇
    • 评论:17条
    博客专栏
    文章分类
    最新评论