Spark累加器LongAccumulator

1.Accumulator是由Driver端总体进行维护的,读取当前值也是在Driver端,各个Task在其所在的Executor上也维护了Accumulator变量,但只是局部性累加操作,运行完成后会到Driver端去合并累加结果。Accumulator有两个性质:

1、只会累加,合并即累加;

2、不改变Spark作业懒执行的特点,即没有action操作触发job的情况下累加器的值有可能是初始值。

object AccumulatorTest {

  def main(args: Array[String]): Unit = {
    val conf: SparkConf = new SparkConf().setAppName("test003").setMaster("local")
    val sc = new SparkContext(conf)
    sc.setLogLevel("ERROR")

    println("***********************************")
    // 使用scala集合完成累加
    var count1:Int = 0;
    var data = Seq(1,2,3,4)
    data.map(x=> count1 +=x)
    println("scala集合进行累加:" + count1)
    println("***********************************")

// 使用RDD累加,但是count2打印结果为0
// 使用foreach传递的是函数,driver在把变量发送到work时,work中Executor都有一份count2变量副本,
// 最后执行计算时每个Executor的count2会加上自己的x,与dirver短中定义的count2没有关系,所以打印结果是0,
    var count2:Int = 0
    val dataRDD: RDD[Int] = sc.parallelize(data)
    dataRDD.foreach(x=> count2 +=x)
    println(count2)

    println("**************使用累加器*********************")
    val acc: LongAccumulator = sc.longAccumulator("accumulatorTest")
    dataRDD.foreach(x=>acc.add(x))
    println("计算元素累积和:" + acc.value)
    println("统计元素个数:" + acc.count)
    println("统计元素平均值:" + acc.avg)
    println("统计元素总和:" + acc.sum)
  }
}

相关推荐

  1. Spark累加器LongAccumulator

    2024-01-25 11:56:03       34 阅读
  2. spark累加器

    2024-01-25 11:56:03       17 阅读
  3. Spark如何用累加器Accumulator收集日志

    2024-01-25 11:56:03       31 阅读
  4. Spark面试整理-解释Spark中的广播变量和累加器

    2024-01-25 11:56:03       18 阅读

最近更新

  1. Stable Diffusion与AI艺术:探索人工智能的创造力

    2024-01-25 11:56:03       0 阅读
  2. vue3 ts 不使用 if switch 来决定使用什么函数

    2024-01-25 11:56:03       0 阅读
  3. 拖动未来:WebKit 完美融合拖放API的交互艺术

    2024-01-25 11:56:03       1 阅读
  4. helm安装解决无授权问题

    2024-01-25 11:56:03       1 阅读
  5. php获取,昨,今,后天.... 本周,月,年...日期时间戳

    2024-01-25 11:56:03       1 阅读
  6. 大话C语言:第28篇 内存分配与释放

    2024-01-25 11:56:03       1 阅读
  7. MySQL 中删除重复的数据并只保留一条

    2024-01-25 11:56:03       1 阅读
  8. spring boot 3.2.x 使用CDS加速启动

    2024-01-25 11:56:03       2 阅读
  9. 37.深度学习中的梯度下降法及其实现

    2024-01-25 11:56:03       2 阅读
  10. Spring Boot与Spring MVC的区别和联系

    2024-01-25 11:56:03       2 阅读

热门阅读

  1. 【笔记】Helm-4 最佳实践-依赖

    2024-01-25 11:56:03       36 阅读
  2. harmonyOS app 开发环境配置流程

    2024-01-25 11:56:03       33 阅读
  3. 安卓MediaRecorder(4)视频采集编码写入详细源码分析

    2024-01-25 11:56:03       48 阅读
  4. Jenkins相关

    2024-01-25 11:56:03       39 阅读
  5. android:excludeFromRecents

    2024-01-25 11:56:03       28 阅读
  6. c# 策略模式

    2024-01-25 11:56:03       40 阅读