SparkStreamingStateful

/*
  * @Title: SparkStreamingStatefulDemo
  * @ProjectName spark-scala
  * @Description: TODO
  * @author Mr.lu
  * @date 2018/11/19:10:25
  */
/**
  * 实时处理数据   有状态计算 需要还原点
  */

import org.apache.spark._
import org.apache.spark.streaming._ // not necessary since Spark 1.3
object SparkStreamingStatefulDemo {

  def functionToCreateContext(): StreamingContext = {
    //streaming至少两个线程
    val conf = new SparkConf().setMaster("local[*]").setAppName("streaming")
    //时间用于分割数据:Seconds(5)---5秒
    val ssc = new StreamingContext(conf, Seconds(5))
    //模拟从tcp端口读取数据
    //设置还原点目录
    ssc.checkpoint("D:\\test\\checkpoint")
    val ds = ssc.socketTextStream("localhost", 999)

    //current:rdd的1放在里面   Option:可以没数据(第一次的时候没有数据)
    def update(current: Seq[Int], old: Option[Int]) = {
      val newValue = current.sum
      //第一次key出现时,没有状态,需要初始化
      val oldValue = old.getOrElse(0)

      //Some:Option下面的子类---hash--->map
      Some(newValue + oldValue)
    }

    ds.map(word => (word, 1))
      //update _:将方法转成函数 方法名 _
      .updateStateByKey(update _)
      .print()
    ssc
  }

  def main(args: Array[String]): Unit = {
    //    //streaming至少两个线程
    //    val conf=new SparkConf().setMaster("local[*]").setAppName("streaming")
    //    //时间用于分割数据:Seconds(5)---5秒
    //    val ssc=new StreamingContext(conf,Seconds(5))
    val ssc = StreamingContext.getOrCreate("D:\\test\\checkpoint", functionToCreateContext _)



    //启动streaming context,防止没有数据关闭
    //如果没有接受导数据,也不会立刻关闭,会尝试一段时间强制关闭
    ssc.start()
    ssc.awaitTermination()
  }
}
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 2
    评论
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

脸ル粉嘟嘟

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值