大数据-hadoop元数据管理

本文详细介绍了Hadoop大数据系统中的元数据管理,包括内存元数据、磁盘元数据镜像(fsimage)和操作日志文件(edits)。在每次客户端操作后,元数据更新首先记录在edits中,然后在满足特定条件时,通过SecondaryNameNode进行checkpoint,合并生成新的fsimage。此外,还讨论了处理NameNode宕机时如何利用SecondaryNameNode恢复元数据,以及通过HA机制确保服务高可用性。
摘要由CSDN通过智能技术生成

元数据三种形式

  • 内存元数据(meta data)
  • 磁盘元数据镜像文件(fsimage)
  • 数据操作日志文件(edits)

元数据存储机制

  • 内存中有一份完整的元数据(meta data)
  • 磁盘中有一份“准完整”的元数据镜像文件(fsimage),存在namenode工作目录中
  • meta data = fsimage + 操作日志文件(edits)
  • 当客户端对hdfs进行操作,操作记录首先被记入edits日志文件中,当客户端操作成功后,再更新到meta data

元数据存储流程

  1. 客户端操作hdfs
  2. hdfs将用户的操作日志保存在edits,每份edits有固定大小,达到大小后保存成文件tmp/dfs/name/current/edits_0000000000000000881-0000000000000000882
  3. 正在记录的未达到固定大小的edits文件,保存为文件edits_inprogress_0000000000000000892
  4. 按一定触发条件,会由SecondaryNameNode将所有edits和一个最新的fsimage(第一次需要)下载到SecondaryNameNode本地,并加载到内存进行merge,生成一个新的fsimage这个过程叫checkpoint
  5. SecondaryNameNode将新生成的fsimage覆盖到原来的镜像文件

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值