分布式文件系统HDFS架构和数据读写流程

Hadoop核心由HDFS和MapReduce组成,HDFS负责分布式存储,MapReduce负责分布式计算。

Hadoop框架整体架构

Hadoop整体架构如下图所示,NameNode(命名节点/管理节点)和DataNode(数据节点)构成了HDFS的主要框架,JobTracker和TaskTracker构成了MapReduce的主要框架。
在这里插入图片描述

HDFS

HDFS(Hadoop Distributed File System)是GFS的开源实现,是一个高度容错性的分布式文件系统,其特点如下:

  • 能够运行在廉价机器上,硬件出错常态,需要具备高容错性
  • 流式数据访问,而不是随机读写
  • 面向大规模数据集,能够进行批处理、能够横向扩展
  • 简单一致性模型,假定文件是一次写入、多次读取

HDFS也有一定的缺点:

  • 不支持低延迟数据访问
  • 不适合大量小文件存储(因为每条元数据占用空间是一定的)
  • 不支持并发写入,一个文件只能有一个写入者
  • 不支持文件随机修改,仅支持追加写入

HDFS的架构采用主从架构(master/slave),一个典型的HDFS集群包含一个NameNode节点和多个DataNode节点。NameNode节

  • 1
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值