Spark中的Accumlators(累加器)【官网学习摘录笔记】

最新推荐文章于 2024-02-23 20:05:17 发布

段渣渣

最新推荐文章于 2024-02-23 20:05:17 发布

阅读量584

点赞数

分类专栏：官网学习 Spark学习文章标签： Accumlators Spark

本文链接：https://blog.csdn.net/xiaoduan_/article/details/80840746

版权

Spark学习同时被 2 个专栏收录

12 篇文章 0 订阅

订阅专栏

官网学习

3 篇文章 0 订阅

订阅专栏

版权声明：未经允许，随意转载，请附上本文链接谢谢（づ￣3￣）づ╭❤～
https://blog.csdn.net/xiaoduan_/article/details/80840746

Spark中的Accumlators(累加器)

Accumulators（累加器）是一个仅可以执行 “added”（添加）的变量来通过一个关联和交换操作，因此可以高效地执行支持并行。累加器可以用于实现 counter（计数，类似在 MapReduce 中那样）或者 sums（求和）。原生 Spark 支持数值型的累加器，并且程序员可以添加新的支持类型。

作为一个用户，您可以创建 accumulators（累加器）并且重命名. 如下图所示, 一个命名的 accumulator 累加器（在这个例子中是 counter）将显示在 web UI 中，用于修改该累加器的阶段。 Spark 在 “Tasks” 任务表中显示由任务修改的每个累加器的值.在 UI 中跟踪累加器可以有助于了解运行阶段的进度

可以通过调用 SparkContext.longAccumulator() 或 SparkContext.doubleAccumulator() 方法创建数值类型的 accumulator（累加器）以分别累加 Long 或 Double 类型的值。集群上正在运行的任务就可以使用 add 方法来累计数值。然而，它们不能够读取它的值。只有 driver program（驱动程序）才可以使用 value 方法读取累加器的值。

下面的代码展示了一个 accumulator（累加器）被用于对一个数组中的元素求和:

scala> val accum = sc.longAccumulator("My Accumulator")
accum: org.apache.spark.util.LongAccumulator = LongAccumulator(id: 0, name: Some(My Accumulator), value: 0)

scala> sc.parallelize(Array(1, 2, 3, 4)).foreach(x => accum.add(x))
...
10/09/29 18:41:08 INFO SparkContext: Tasks finished in 0.317106 s

scala> accum.value
res2: Long = 10

段渣渣

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
Spark中的Accumlators(累加器)【官网学习摘录笔记】

版权声明：未经允许，随意转载，请附上本文链接谢谢（づ￣3￣）づ╭❤～ Spark中的Accumlators(累加器)Accumulators（累加器）是一个仅可以执行 “added”（添加）的变量来通过一个关联和交换操作，因此可以高效地执行支持并行。累加器可以用于实现 counter（计数，类似在 MapReduce 中那样）或者 sums（求和）。原生 Spark 支持数值型的累加器，...
复制链接

扫一扫

专栏目录