安装hadoop

本文档详细介绍了在Linux系统中安装Hadoop的步骤,并提供了遇到SSH连接错误、缺少JDK工具、start-all.sh启动失败等问题的解决方法。包括修改SSH端口、安装openjdk-devel包以及手动启动HDFS和YARN的相关服务。同时,列举了Hadoop常用命令,如下载、上传文件到HDFS,创建目录,查看文件等。
摘要由CSDN通过智能技术生成

安装

LINUX 安装步骤参考 https://www.cnblogs.com/zingp/p/11223220.html
注:
1、start-dfs.sh 文件路径在hadoop解压目录下的/hadoop-3.3.1/sbin下

#hdfs
HDFS_DATANODE_USER=root
HDFS_DATANODE_SECURE_USER=hdfs 
HDFS_NAMENODE_USER=root 
HDFS_SECONDARYNAMENODE_USER=root
#yarn
YARN_RESOURCEMANAGER_USER=root
HADOOP_SECURE_DN_USER=yarn
YARN_NODEMANAGER_USER=root

2、启动时提示localhost: ssh: connect to host localhost port 22: Connection refused

  1. 安装SSH
  2. 如果是端口不可用,修改

/etc/hadoop/hadoop-env.sh

export HADOOP_SSH_OPTS="-p XXXX"

3、openjdk没有jstack、jstat、jps等命令解决办法

yum install java-1.8.0-openjdk-devel -y

4、start-all.sh命令启动失败时
sbin/下执行

yarn --daemon start nodemanager
hdfs --workers --daemon start
hdfs --daemon start datanode

hadoop相关指令

1、下载hdfs文件到本地

bin/hadoop fs -get /hdfs/source/path /localfs/destination/path
bin/hadoop fs -copyToLocal /hdfs/source/path /localfs/destination/path

区别:copyToLocal的源路径只能是一个本地的文件。而put的源路径可能是多个文件,也可能是标准输入。
当hadoop fs -put - hdfs://host:port/hadoop/hadoopfile时表示从标准输入接收数据,这个时候目标路径必须是一个文件。

2、指令

HDFS上创建目录

${HADOOP_HOME}/bin/hdfs dfs -mkdir /demo1

上传本地文件到HDFS上

${HADOOP_HOME}/bin/hdfs dfs -put ${HADOOP_HOME}/etc/hadoop/core-site.xml /demo1

上传本地文件到HDFS上

${HADOOP_HOME}/bin/hdfs dfs -cat /demo1/core-site.xml

从HDFS上下载文件到本地

${HADOOP_HOME}/bin/hdfs dfs -get /demo1/core-site.xml

查看文件

hadoop fs -ls
hadoop fs -du -h 
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值