Hadoop File System

Hadoop分布式文件系统(HDFS)是一个高容错性的系统,适合部署在廉价硬件上。本文深入探讨了HDFS的架构,包括NameNode和DataNode的角色,以及文件如何分块存储。还详细分析了写入过程、机架感知策略和安全模式,强调了元数据管理和读取数据的流程。HDFS设计为一次写入、多次读取,不支持文件的修改,其数据复制策略确保了数据的可靠性和可用性。
摘要由CSDN通过智能技术生成

Hadoop分布式文件系统(HDFS)是一种旨在在商品硬件上运行的分布式文件系统。它与现有的分布式文件系统有许多相似之处。但是,与其他分布式文件系统的区别很明显。HDFS具有高度的容错能力,旨在部署在低成本硬件上。HDFS提供对应用程序数据的高吞吐量访问,适用于具有大型数据集的应用程序。

 

 

 

 

 


架构


HDFSæ¶æ

这是HDFS的一个简单架构图。

Rack1和Rack2是两台DataNode,也就是两台从节点。

NameNode是主节点。

其中Datanode是运行在从节点的一个进程,而Namenode是运行在主节点的一个进程。

DataNode负责数据的存储,而NameNode负责元数据的管理。

在HDFS中,我们存储数据可以看成一个数据块一个数据块的存储,每个文件都会分割成很多数据块,现在版本应该默认时128M了吧,毕竟计算机性能比以前好了,而且数据量也越来越大了。

而且对于一个文件,它的多个数据块大小都一样,都是设置的数据块大小,除了最后一块。也就是说,数据是一条条往数据块里面写,然后每写满一个数据块大小就分出一个数据块,这样就可以将前面的数据块都给填满,除了最后一块可能填不满之外。这样做的道理就是为了能够将数据尽可能和计算机性能匹配,你如果到处都是几kB或者几MB的文件,大量的这些杂碎文件就变成了很多任务,交给了很多线程去处理,无疑会

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

小满锅lock

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值