第3章 分布式文件系统HDFS(精心梳理 详解HDFS )

本文详细介绍了分布式文件系统HDFS的结构、设计需求、演变过程、特点、相关概念,包括块、名称节点、数据节点、第二名称节点以及元数据。HDFS采用主从结构,通过多副本存储实现容错和高可用性,但存在低延迟访问不足、小文件存储效率低等问题。文章还讨论了HDFS的存储原理,如数据的冗余存储策略和错误恢复机制,并介绍了Federation架构解决的单点故障问题。
摘要由CSDN通过智能技术生成

分布式文件系统(Distributed File System)是一种通过网络实现文件在多台主机上进行分布式存储的文件系统。分布式文件系统的设计一般采用“Client/Server(客户机/服务器)”模式,客户端以特定的通信协议通过网络与服务器建立连接,提出文件访问请求,客户端和服务器可以通过设置访问权来限制请求方对底层数据存储块的访问。

分布式文件系统的结构

普通操作系统(Windows、Linux)中,文件系统一般会把磁盘空间划分为512Byte/每组的“磁盘组”,它是文件系统进行读写的最小单位,文件系统的块(Block)通常是磁盘块的整数倍,即每次读写的数据量必须是磁盘块大小的整数倍。

分布式文件系统也采用了块的概念,文件被分成若干个块进行存储,块是数据读写的基本单元。HDFS默认的一个块的大小是64M。与普通文件不同的是,在分布式文件系统中,如果一个文件小于一个数据块的大小,它并不占用整个数据块的存储空间。

评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值