hadoop学习总结(一)

一、如何安装配置apache的一个开源hadoop集群

  1. 使用root账户登录

  2. 修改IP

  3. 修改host主机名

  4. 配置SSH免密码登录

  5. 关闭防火墙

  6. 安装JDK并配置jdk环境变量

  7. 解压hadoop安装包

  8. 配置hadoop的核心文件
    hadoop-env.sh,core-site.xml , mapred-site.xml , hdfs-site.xml ,yarn-site.xml ,slaves

  9. 配置hadoop环境变量

  10. 格式化 hadoop namenode-format

  11. 启动节点start-dfs.sh,start-yarn.sh


二、HDFS存储机制

HDFS(Hadoop Distributed File System)是GFS的开源实现。
特点如下:

  • 能够运行在廉价机器上,硬件出错常态,需要具备高容错性
  • 流式数据访问,而不是随机读写
  • 面向大规模数据集,能够进行批处理、能够横向扩展
  • 简单一致性模型,假定文件是一次写入、多次读取<
  • 10
    点赞
  • 30
    收藏
    觉得还不错? 一键收藏
  • 3
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 3
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值