利用Hadoop API使用Java开发程序学习-文件夹操作

4 篇文章 1 订阅

利用Hadoop API使用Java开发程序学习-文件夹操作

CSDN话题挑战赛第2期
参赛话题:大数据学习成长记录

学习目标:

  1. 熟悉Java开发

  2. 掌握Hadoop API操作创建文件夹和删除文件夹的方式

软件版本信息

工具名称说明
VMware-workstation-full-15.5.1-15018445.exe虚拟机安装包
MobaXterm_Portable_v20.3.zip解压使用,远程连接Centos系统远程访问使用,支持登录和上传文件
CentOS-7-x86_64-DVD-1511.isoCentos7系统ISO镜像,不需要解压,VMware安装时需要
jdk-8u171-linuxx64.tar.gzjdk安装包,上传到Centos系统中使用
hadoop-2.7.3.tar.gzhadoop的安装包,需要上传到虚拟机中
apache-flume-1.7.0-bin.tar.gz安装包,上传到Centos系统中使用
zeppelin-0.10.1-bin-all.tar.gz安装包,上传到Centos系统中使用
zookeeper-3.4.5.tar.gz安装包,上传到Centos系统中使用
apache-hive-2.3.9-bin.tar.gz安装包,上传到Centos系统中使用

前言/背景

Hadoop学习时,通常大家使用的都是shell命令操作hdfs系统,但实际到程序开发时,通过Java开发程序对hdfs文件系统操作的需求会更多,更能增加程序的稳定性、提高运行效率,方便管理。因此学习利用Hadoop API接口,开发Java程序在hdfs上创建和删除目录。

IDEA-community开发Java

掌握通过IDEA开发Java程序

1,创建新的Maven项目
主流关系型数据库Oracle、MySQL、PG、SQLserver等,非关系型数据库Redis,MongoDB等部署、数据类型,SQL学习,故障案例处理,高可用的学习技能分享。
根据提示完成项目创建

2,配置pom.xml文件

<?xml version="1.0" encoding="UTF-8"?>
<project xmlns="http://maven.apache.org/POM/4.0.0"
         xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance"
         xsi:schemaLocation="http://maven.apache.org/POM/4.0.0 http://maven.apache.org/xsd/maven-4.0.0.xsd">
    <modelVersion>4.0.0</modelVersion>

    <groupId>cn.com.lh</groupId>
    <artifactId>GUNBigdata</artifactId>
    <version>1.0-SNAPSHOT</version>

    <properties>
        <maven.compiler.source>8</maven.compiler.source>
        <maven.compiler.target>8</maven.compiler.target>
    </properties>

    <!-- 项目依赖 -->
    <dependencies>

        <dependency>
            <groupId>org.apache.hadoop</groupId>
            <artifactId>hadoop-common</artifactId>
            <version>2.7.3</version>
        </dependency>
        <dependency>
            <groupId>org.apache.hadoop</groupId>
            <artifactId>hadoop-hdfs</artifactId>
            <version>2.7.3</version>
        </dependency>
        <dependency>
            <groupId>junit</groupId>
            <artifactId>junit</artifactId>
            <version>4.12</version>
        </dependency>

        <dependency>
            <groupId>commons-logging</groupId>
            <artifactId>commons-logging</artifactId>
            <version>1.2</version>
        </dependency>

    </dependencies>


    <build>
        <plugins>
            <plugin>
                <groupId>org.apache.maven.plugins</groupId>
                <artifactId>maven-compiler-plugin</artifactId>
                <version>3.0</version>
                <configuration>
                    <source>1.8</source>
                    <target>1.8</target>
                    <encoding>UTF-8</encoding>
                    <!--    <verbal>true</verbal>-->
                </configuration>
            </plugin>

            <plugin>
                <groupId>org.apache.maven.plugins</groupId>
                <artifactId>maven-shade-plugin</artifactId>
                <version>2.4.3</version>
                <executions>
                    <execution>
                        <phase>package</phase>
                        <goals>
                            <goal>shade</goal>
                        </goals>
                        <configuration>
                            <minimizeJar>true</minimizeJar>
                        </configuration>
                    </execution>
                </executions>
            </plugin>
        </plugins>
    </build>
</project>

3,开发在hdfs上创建目录代码

package hdfs;

import org.apache.hadoop.conf.Configuration;
import org.apache.hadoop.fs.FileSystem;
import org.apache.hadoop.fs.Path;

import java.io.IOException;
import java.net.URI;
import java.net.URISyntaxException;

/**
 * @Classname bigdata204hdfsdemo002
 * @Description hdfs创建文件夹
 * @Date 2022/9/21 8:54
 * @Created by Tiger_Li
 */
public class bigdata204hdfsdemo002 {

    /**
     * shell : hdfs dfs -mkdir /Java/bigdata2040921
     * 思路:
     * 1. 创建Configuration对象,并制定HDFS的namenode
     * 2. 创建FileSystem对象fs
     * 3. fs创建目录
     * 4. 关闭对象
     */
    public static void main(String[] args) throws URISyntaxException, IOException, InterruptedException {
//        1. 导入的configuration版本要与集群的一致, 配置hdfs地址
        Configuration conf = new Configuration();
        URI uri = new URI("hdfs://node1:9000");
//        2. 创建fs对象
        FileSystem fs = FileSystem.get(uri, conf, "root");
//        3. 创建文件夹
        boolean rs = fs.mkdirs(new Path("/Java/bigdata204"));
        if (rs){
            System.out.println("HDFS上成功创建/Java/bigdata204");
            return;
        } else {
            System.out.println("创建失败");}
//        4. 关闭文件对象
        fs.close();
    }


}

注意填写的hdfs namenode地址要是active状态,不能为standby状态的。

4,开发在hdfs上删除目录代码

package hdfs;

import org.apache.hadoop.conf.Configuration;
import org.apache.hadoop.fs.FileSystem;
import org.apache.hadoop.fs.Path;

import java.io.IOException;

/**
 * @Classname bigdata204hdfsdeletedir
 * @Description 删除hdfs上的文件夹
 * @Date 2022/9/21 9:29
 * @Created by Tiger_Li
 */
public class bigdata204hdfsdeletedir {

    /**
     * hadoop fs -rm -r /Java/bigdata204
     * 思路
     * 1. 创建Configuration对象,并制定HDFS的namenode
     * 2. 创建FileSystem对象fs
     * 3. fs删除目录
     * 4. 关闭对象
     */

    public static void main(String[] args) throws IOException {
        Configuration conf = new Configuration();
        conf.set("fs.defaultFS","hdfs://node1:9000");
        FileSystem fs = FileSystem.get(conf);
        boolean rs = fs.deleteOnExit(new Path("/Java/bigdata204"));
        if (rs ){
            System.out.println("文件夹删除成功");
            return;
        } else {
            System.out.println("文件夹删除失败");
        }
        fs.close();
    }

}

运行代码前检测集群hdfs
在这里插入图片描述

运行删除hdfs文件目录后
在这里插入图片描述
在这里插入图片描述

运行创建hdfs文件目录
在这里插入图片描述
在这里插入图片描述

个人经验总结

用Java开发IDEA时,导入依赖时,要注意hadoop版本与集群的hadoop版本一直,由于一直是多hadoop版本开发,idea中会有多个版本的导入提示,导入hadoop版本不一致,会引发各种问题,尤其需要注意。

寄语

希望能坚持学习,坚持进步。

  • 2
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
### 回答1: 使用Hadoop Java API创建文件夹的步骤如下: 1. 获取Hadoop文件系统对象 FileSystem fs = FileSystem.get(new Configuration()); 2. 创建文件夹 Path folderPath = new Path("/path/to/folder"); fs.mkdirs(folderPath); 其中,/path/to/folder是要创建的文件夹路径。 3. 关闭文件系统对象 fs.close(); 以上就是使用Hadoop Java API创建文件夹的步骤。 ### 回答2: Hadoop是一个分布式系统,其中包含了一个分布式文件系统,称为Hadoop Distributed File System(HDFS)。Hadoop提供了Java API操作HDFS中的文件和目录。在Hadoop中创建文件夹的过程非常简单,只需要使用FileSystem类的mkdirs()方法即可完成。 mkdirs()方法的语法如下: public boolean mkdirs(Path f) throws IOException 其中,Path f表示要创建的文件夹路径。该方法返回一个布尔值,表示是否成功创建文件夹。 下面是创建文件夹Java代码示例: 1.首先,创建一个Configuration对象,用于Hadoop配置 Configuration conf = new Configuration(); 2.然后,使用FileSystem静态方法获取一个文件系统对象 FileSystem fs = FileSystem.get(conf); 注:这里使用的是getDefaultFileSystem()方法获取一个默认的文件系统对象,也可以使用get(URI uri, Configuration conf)方法根据指定的URI和配置对象获取文件系统对象。 3.接下来,定义要创建的文件夹路径 Path folderPath = new Path("/myfolder"); 注:这里使用的是绝对路径,也可以使用相对路径,如“myfolder”。 4.最后,调用mkdirs()方法创建文件夹 boolean result = fs.mkdirs(folderPath); 完整的Java代码如下: import org.apache.hadoop.conf.Configuration; import org.apache.hadoop.fs.FileSystem; import org.apache.hadoop.fs.Path; import java.io.IOException; public class CreateFolder { public static void main(String[] args) throws IOException { Configuration conf = new Configuration(); FileSystem fs = FileSystem.getDefaultFileSystem(conf); Path folderPath = new Path("/myfolder"); boolean result = fs.mkdirs(folderPath); if (result) { System.out.println("文件夹创建成功!"); } else { System.out.println("文件夹创建失败!"); } } } 当运行该程序时,如果文件夹创建成功,则会输出“文件夹创建成功!”信息,否则输出“文件夹创建失败!”信息。 ### 回答3: Hadoop是一个分布式的数据存储和处理框架,其中的Java API提供了创建文件夹文件的方法。下面是具体的步骤: 1. 导入相关的Hadoop依赖库: ``` java import org.apache.hadoop.conf.Configuration; import org.apache.hadoop.fs.FileSystem; import org.apache.hadoop.fs.Path; ``` 2. 创建一个Configuration对象,并设置相关的Hadoop配置信息: ``` java Configuration conf = new Configuration(); conf.setBoolean("dfs.support.append", true); conf.set("fs.defaultFS", "hdfs://localhost:9000"); ``` 其中,dfs.support.append用来开启文件追加功能,fs.defaultFS指定了HDFS的地址。 3. 获取一个FileSystem实例: ``` java FileSystem fs = FileSystem.get(conf); ``` 4. 使用mkdirs()方法创建目录: ``` java Path dir = new Path("/testDir"); if (!fs.exists(dir)) { fs.mkdirs(dir); } ``` 其中,/testDir是要创建的目录路径。 5. 关闭FileSystem实例: ``` java fs.close(); ``` 以上就是使用Hadoop Java API创建文件夹的完整步骤。在创建文件时,也可以使用类似的方法。需要注意的是,在Hadoop中,文件和目录都被视为Path对象。因此,我们需要使用Path类来指定要创建的文件或目录的路径。同时,我们也需要注意,在HDFS中创建文件或目录时,如果路径中的某些目录不存在,则会自动创建这些目录。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值