利用sparkStreaming接受kafka中的数据实现单词计数----采用receivers 08版本

//object SparkStreamingKafkaReceiverCheckpoint {
//
//  System.setProperty("hadoop.home.dir", "d://software/hadoop-2.9.2")
//  def updateFunc(a:Seq[Int], b:Option[Int]) :Option[Int] ={
//    Some(a.sum+b.getOrElse(0))
//  }
//  def main(args: Array[String]): Unit = {
//    val checkpointPath = "./kafka-receiver"
//
//    val ssc = StreamingContext.getOrCreate(checkpointPath, () => {
//      createFunc(checkpointPath)
//    })
//    ssc.start()
//    ssc.awaitTermination()
//  }
//  def createFunc(checkpointPath:String): StreamingContext = {
//
//    //todo:1、创建sparkConf
//    val sparkConf: SparkConf = new SparkConf()
//      .setAppName("SparkStreamingKafka_Receiver_checkpoint")
//      .setMaster("local[4]")
//      //todo:开启wal预写日志
//      .set("spark.streaming.receiver.writeAheadLog.enable","true")
//    //todo:2、创建sparkContext
//    val sc = new SparkContext(sparkConf)
//
//    sc.setLogLevel("WARN")
//
//    //todo:3、创建StreamingContext
//    val ssc = new StreamingContext(sc,Seconds(5))
//    ssc.checkpoint(checkpointPath)
//    //todo:4、指定zkServer
//    val zkServer="hadoop-senior.test.com:2181"
//
//    //todo:5、指定groupId
//    val groupId="spark-kafka-receiver01"
//
//    //todo:6、指定topics 这个可以利用一个消费者组来消费多个topic,
//    //(topic_name -> numPartitions)  指定topic消费的线程数
//    val topics=Map("kafka_spark"->1)
//
//    //todo:7、并行运行更多的接收器读取kafak topic中的数据,这里设置3个
//    val resultDStream = (1 to 3).map(x => {
//      //todo:8、通过使用KafkaUtils的createStream接受kafka topic中的数据,生成DStream
//      val kafkaDataDStream = KafkaUtils.createStream(ssc, zkServer, groupId, topics).map(x => x._2)
//      kafkaDataDStream
//    }
//    )
//    //todo:利用StreamContext将所有的DStream组合在一起
//    val kafkaDStream = ssc.union(resultDStream)
//
//    //todo:8、获取kafka中topic的内容
//
//    //todo:9、切分每一行。每个单词记为1
//    val wordAndOne = kafkaDStream.flatMap(_.split(" ")).map((_,1))
//
//    //todo:10、相同单词出现的次数累加
//    val result = wordAndOne.updateStateByKey(updateFunc)
//
//    //todo:打印
//    result.print()
//    ssc
//
//  }
//
//}
 

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值