spark开发环境搭建(基于idea 和maven) 以及 maven打包jar包的两种方式 转

本文详细介绍了如何在IntelliJ IDEA中搭建基于Maven的Spark开发环境,包括Scala插件安装、JDK和Scala SDK配置、创建Maven项目,以及编写Spark代码并打包运行。此外,还提供了导入Spark依赖和打包成可执行jar包的步骤。
摘要由CSDN通过智能技术生成

spark开发环境搭建(基于idea 和maven)

转载

文章出自:http://blog.csdn.net/u012373815/article/details/53266301

使用idea构建maven 管理的spark项目 ,默认已经装好了idea 和Scala

那么使用idea 新建maven 管理的spark 项目有以下几步:

  • scala插件的安装
  • 全局JDK和Library的设置
  • 配置全局的Scala SDK
  • 新建maven项目
  • 属于你的”Hello World!”
  • 导入spark依赖
  • 编写sprak代码
  • 打包在spark上运行

1.scala插件的安装

首先在欢迎界面点击Configure,选择plugins如下图所示:

因为的安装过了所以事uninstall 没有安装的话是 install ,安装成功后,点击OK退出。

注意:插件安装完了之后,记得重启一下IntelliJ IDEA使得插件能够生效。

 

2.全局JDK和Library的设置

为了不用每次都去配置JDK,这里先进行一次全局配置。首先在欢迎界面点击Configure,然后在Project Defaults的下拉菜单中选择Project Structure,如下图所示:

在打开的Default Project Structure界面的左侧边栏选择Project,在右侧打开的页面中创建一个新的JDK选项(一定要本机已经安装过JDK了),如下图所示步骤在下拉菜单中点击JDK后,在打开的对话框中选择你所安装JDK的位置,注意是JDK安装的根目录,就是JAVA_HOME中设置的目录。

 

3.配置全局的Scala SDK

在欢迎页面的右下角点击Configure,然后在Project Defaults的下拉菜单中选择Project Structure,在打开的页面左侧选择Global Libraries,然后在中间一栏中有一个绿色的加号标志 +,点击后在下拉菜单中选择 Scala SDK

然后在打开的对话框中选择系统本身所安装的Scala(即System对应的版本),点击OK确定,这时候会在中间一栏位置处出现Scala的SDK,在其上右键点击后选择Copy to Project Libraries…,这个操作是为了将Scala SDK添加到项目的默认Library中去。整个流程如下面的动图所示。

 

 

 

 

4.新建maven项目

在欢迎界面点击Create New Project,在打开的页面左侧边栏中,选择Maven,然后在右侧的Project SDK一项中,查看是否是正确的JDK配置项正常来说这一栏会自动填充的,因为我们之前在1.3中已经配置过了全局的Project JDK了,如果这里没有正常显示JDK的话,可以点击右侧的New…按钮,然后指定JDK安装路径的根目录即可),然后点击Next,来到Maven项目最重要三个参数的设置页面,这三个参数分别为:GroupId, ArtifactId和Version. 步骤如下图所示:

 

5.属于你的”Hello World!”

在上一步中,我们已经创建了一个Maven工程

    1. 为了让你的首次体验Scala更清爽一些,将一些暂时无关的文件和文件夹都勇敢的删除掉吧,主要有 main\java, main\resources 和 test 这三个;

     2. 将Scala的框架添加到这个项目中,方法是在左侧栏中的项目名称上右键菜单中点击Add Framework Support…,然后在打开的对话框左侧边栏中,勾选Scala前面的复选框,然后点击确定即可(前提是上文中所述步骤都已正确走通,否则你很有可能看不到Scala这个选项的);

    3. 在main文件夹中建立一个名为 scala 的文件夹,并右键点击 scala 文件夹,选择 Make Directory as,然后选择Sources Root ,这里主要意思是将 scala 文件夹标记为一个源文件的根目录,然后在其内的所有代码中的 package ,其路径就从这个根目录下开始算起。

   4. 在已经标记好为源文件根目录的 scala 文件夹 上,右键选择 New,然后选择 Scala Class,随后设置好程序的名称,并且记得将其设置为一个 Object(类似于Java中含有静态成员的静态类),正常的话,将会打开这个 Object 代码界面,并且可以看到IntelliJ IDEA自动添加了一些最基本的信息;

   5. 在创建的 Object 中输入如下语句:

def main(args: Array[String]):Unit = {println("Hello World!")}

在程序界面的任意位置,右键单击后选择 Run '你的程序名称',静待程序的编译和运行,然后在下方自动打开的窗口中,你就可以看到振奋人心的 Hello World!了。

流程动图如下: 

 

<
### 回答1: Spark开发环境搭建基于IDEAMaven,可以按照以下步骤进行: 1. 安装Java JDK和Maven,并配置环境变量。 2. 下载并安装IDEA,打开IDEA,选择File -> New -> Project,选择Maven,输入项目名称和路径,点击Next。 3. 选择Maven的groupId、artifactId和version,点击Next。 4. 选择项目的存储位置和项目类型,点击Next。 5. 配置项目依赖Spark、Hadoop、Scala等,点击Finish。 6. 在IDEA中创建Spark应用程序,编写代码,进行调试和运行。 Maven打包jar包两种方式: 1. 使用Maven命令行打包:在项目根目录下执行命令“mvn package”,Maven会自动编译、打包生成jar包。 2. 在IDEA中使用Maven插件打包:在IDEA中打开Maven Projects面板,选择项目,右键选择“package”,Maven会自动编译、打包生成jar包。 ### 回答2: spark开发环境搭建(基于ideamaven) Spark是目前最流行的大数据处理框架之一,它可以在分布式环境下高效地处理海量数据。本文将介绍如何在IDEAMaven的基础上搭建Spark开发环境。 1. 下载和安装Java SDK和Scala 首先需要从官网下载并安装Java SDK和Scala,这样才能正常使用Spark。 2. 下载和安装IDEA 然后下载,安装并启动IDEA(建议使用最新版本),准备创建一个新的Maven项目。 3. 创建Maven项目IDEA中点击File -> New -> Project,在创建项目的窗口中选择Maven,然后填写项目名称、GroupId、ArtifactId等信息,创建一个Maven项目。 4. 引入Spark依赖Maven的pom.xml文件中引入Spark依赖: ```xml <dependencies> <dependency> <groupId>org.apache.spark</groupId> <artifactId>spark-core_2.11</artifactId> <version>2.4.5</version> </dependency> </dependencies> ``` 这里选择了Spark Core的依赖,如果需要使用其他的Spark组件,在引入依赖时也需要添加相应的组件。 5. 测试代码的编写 在src/main/scala目录下新建一个Scala文件,编写测试代码并运行,如果没有报错,证明环境搭建成功。 Maven打包jar包两种方式 在完成了Spark开发任务后,需要将代码打包jar包以便于在集群上运行。下面介绍两种方式来将Maven项目打包jar包。 1. 通过Maven命令行打包Maven的根目录下打开命令行,使用以下命令进行打包: ``` mvn package ``` 执行完上述命令后,在target目录下会生成一个jar包,可以将这个jar包上传到集群上进行运行。 2. 在IDEA中进行打包IDEA中,可以直接使用Maven插件打包,步骤如下: Step 1: 打开Maven Projects界面,在Lifecycle中,双击package. Step 2: 等待成功之后,就会在target目录下生成jar包。 使用这种方式打包会更加方便,因为可以直接在开发环境中打包并运行测试。但是,在实际部署时还是需要将jar包上传到集群上运行。 ### 回答3: 随着大数据技术的发展,越来越多的企业开始采用Spark进行数据分析和处理。在使用Spark进行开发工作前,首先需要进行开发环境的搭建。本文将介绍如何在IDEAMaven的基础上搭建Spark开发环境,并探讨Maven打包jar包两种方式。 一、Spark开发环境搭建 1. 安装Java和Scala 首先需要安装Java和Scala。目前最新的Java版本为Java 8,而Spark最好使用Scala语言进行开发。我们可以下载Java和Scala,也可以使用brew直接进行安装。 2. 下载安装IDEA IDEA是一个Java语言开发的集成开发环境。我们可以到官方网站下载安装。 3. 下载安装Spark 通过Spark的官方网站下载安装Spark。 4. 配置环境变量 将Spark的bin目录和Java的bin目录添加到PATH环境变量中。 5. 使用IDEA创建Spark项目IDEA中创建一个Maven项目,并指定Spark相关的依赖。 6. 运行Spark应用 通过IDEA的运行配置,可以轻松地启动Spark应用程序。 二、Maven打包jar包两种方式开发过程中,我们通常需要打包jar包进行部署。下面介绍Maven打包jar包两种方式。 1. 常规方式 通过Maven的命令行界面,可以轻松地通过命令进行打包打包命令如下: mvn package 2. 通过插件方式打包 通过Maven插件的方式还可以进行打包打包命令如下: mvn clean compile assembly:single 通过以上方法,我们可以轻松地搭建好Spark开发环境,并使用Maven进行打包,便于部署应用程序。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值