SparkStreaming架构介绍+IDEA的简单使用

1、概念

在介绍spark的时候我们就介绍过他的一些架构,是基于sparkcore且可以附加各种工具的,sparkstreaming就是其中的工具之一,其概念和spark的RDDs比较类似,他是使用离散化流作为抽象表示出一个DStream的概念,这个DStream就是随时间推移而得到的数据的一个离散化序列。
在这里插入图片描述
如图所示,随着时间的推移,会有不同的数据产生,而DStream就会根据设定,每隔一段时间就读取一次数据,这是有一个时间周期的,然后在一个周期内DStream将数据送至Driver中变成一个RDD,最后送到执行器中变成一个executor。

2、架构及工作流程

在这里插入图片描述

3、IDEA的简单应用

3.1环境搭建

我们使用上次教过的项目文件就可以,没有的可以自己新建一个maven项目,具体配置攻略:
https://blog.csdn.net/qq_40343117/article/details/101158794

然后我们打开pom.xml文件加入一段关于streaming的代码。

    <dependency>
        <groupId>org.apache.spark</groupId>
        <artifactId>spark-streaming_2.11</artifactId>
        <version>${spark.version}</version>
    </dependency>

在这里插入图片描述

3.2项目实操

新建一个scala项目,开始操作:

实现问题:读取虚拟机h01的9999端口的消息

完整代码:

package Streaming

import org.apache.spark.streaming.dstream.{DStream, ReceiverInputDStream}
import org.apache.spark.{SparkConf, SparkContext}
import org.apache.spark.streaming.{Duration, Seconds, StreamingContext}


object Streaming01_WWordCount{
  def main(args: Array[String]): Unit = {
    val conf = new SparkConf().setAppName("Streaming").setMaster("local[*]")
    val streamingContext = new StreamingContext(conf,Seconds(5))
    val socketDstream:ReceiverInputDStream[String] = streamingContext.socketTextStream("h01",9999)
    val wordDtream:DStream[String] = socketDstream.flatMap(line => {
      line.split(" ")
    })
    val mapDstream:DStream[(String,Int)] = wordDtream.map((_,1))
    val wordToSumDstream:DStream[(String,Int)] = mapDstream.reduceByKey(_+_)
    wordToSumDstream.print()
    streamingContext.start()
    streamingContext.awaitTermination()
  }
}

代码分布解析:

  • 1.配置对象
//  spark配置对象
    val conf = new SparkConf().setAppName("Streaming").setMaster("local[*]")
    //    实时数据分析环境对象
    //    采集周期:指定时间为周期采集数据,原来是duration,他自己封装了seconds/minutes。。。。。
    val streamingContext = new StreamingContext(conf,Seconds(5))
  • 2.采集数据
 //    从指定端口采集数据
 //    String意思是一行一行的数据
    val socketDstream:ReceiverInputDStream[String] = streamingContext.socketTextStream("h01",9999)
  • 3.数据处理
 //    将采集的数据进行拆分(扁平化处理)
    val wordDtream:DStream[String] = socketDstream.flatMap(line => {
      line.split(" ")
    })
    //    将数据进行结构转变,方便统计分析
    val mapDstream:DStream[(String,Int)] = wordDtream.map((_,1))
    //    将结构化数据进行聚合处理
    val wordToSumDstream:DStream[(String,Int)] = mapDstream.reduceByKey(_+_)
  • 4.数据结果
 //    结果打印
    wordToSumDstream.print()
//    流式处理必备!!!
//    不能停止采集数据,所以不能使用stop
//    不让main方法跳出,要和采集器绑定,只有采集器停止,才停止
//    启动采集器
    streamingContext.start()
//  Driver等待采集器运行
    streamingContext.awaitTermination()
运行结果展示

我们首先在虚拟机输入nc -lk 9999连接至9999端口,注意这里的虚拟机和端口号要与代码对应
在这里插入图片描述在IDEA中运行代码
在这里插入图片描述
等待一会之后会出现这个显示时间的东西,然后我们在虚拟机中向端口按代码规定的格式输入信息(按空格分隔)
在这里插入图片描述
成功读取到了信息,注意启动完了代码再向端口发送消息才可以。

  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
大学生参加学科竞赛有着诸多好处,不仅有助于个人综合素质的提升,还能为未来职业发展奠定良好基础。以下是一些分析: 首先,学科竞赛是提高专业知识和技能水平的有效途径。通过参与竞赛,学生不仅能够深入学习相关专业知识,还能够接触到最新的科研成果和技术发展趋势。这有助于拓展学生的学科视野,使其对专业领域有更深刻的理解。在竞赛过程中,学生通常需要解决实际问题,这锻炼了他们独立思考和解决问题的能力。 其次,学科竞赛培养了学生的团队合作精神。许多竞赛项目需要团队协作来完成,这促使学生学会有效地与他人合作、协调分工。在团队合作中,学生们能够学到如何有效沟通、共同制定目标和分工合作,这对于日后进入职场具有重要意义。 此外,学科竞赛是提高学生综合能力的一种途径。竞赛项目通常会涉及到理论知识、实际操作和创新思维等多个方面,要求参赛者具备全面的素质。在竞赛过程中,学生不仅需要展现自己的专业知识,还需要具备创新意识和解决问题的能力。这种全面的综合能力培养对于未来从事各类职业都具有积极作用。 此外,学科竞赛可以为学生提供展示自我、树立信心的机会。通过比赛的舞台,学生有机会展现自己在专业领域的优势,得到他人的认可和赞誉。这对于培养学生的自信心和自我价值感非常重要,有助于他们更加积极主动地投入学习和未来的职业生涯。 最后,学科竞赛对于个人职业发展具有积极的助推作用。在竞赛中脱颖而出的学生通常能够引起企业、研究机构等用人单位的关注。获得竞赛奖项不仅可以作为个人履历的亮点,还可以为进入理想的工作岗位提供有力的支持。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值