Spark中的多线程并发处理

最新推荐文章于 2024-08-25 23:50:29 发布

weixin_30732825

最新推荐文章于 2024-08-25 23:50:29 发布

阅读量6.4k

点赞数 1

文章标签：大数据 java scala

原文链接：http://www.cnblogs.com/yyy-blog/p/10856477.html

版权

Spark允许并行处理任务，但不直接支持同一应用内完全独立的并发作业。SparkSession是线程安全的，可用于执行多个操作。文章通过顺序执行、优化和Java实现的示例探讨了这一主题。

摘要由CSDN通过智能技术生成

Spark中的多任务处理

Spark的一个非常常见的用例是并行运行许多作业。构建作业DAG后，Spark将这些任务分配到多个Executor上并行处理。
但这并不能帮助我们在同一个Spark应用程序中同时运行两个完全独立的作业，例如同时从多个数据源读取数据并将它们写到对应的存储，或同时处理多个文件等。

每个spark应用程序都需要一个SparkSession(Context)来配置和执行操作。 SparkSession对象是线程安全的，可以根据需要传递给你的Spark应用程序。

顺序执行的例子

import org.apache.spark.sql.SparkSession

object FancyApp {
  def def appMain(args: Array[String]) = {
    // configure spark
    val spark = SparkSession
        .builder
        .appName("parjobs"

最低0.47元/天解锁文章

weixin_30732825

关注

1
点赞
踩
17

收藏

觉得还不错? 一键收藏
0
评论
Spark中的多线程并发处理

Spark中的多任务处理Spark的一个非常常见的用例是并行运行许多作业。构建作业DAG后，Spark将这些任务分配到多个Executor上并行处理。但这并不能帮助我们在同一个Spark应用程序中同时运行两个完全独立的作业，例如同时从多个数据源读取数据并将它们写到对应的存储，或同时处理多个文件等。每个spark应用程序都需要一个SparkSession(Context)来配置和执行操作。...
复制链接

扫一扫