Spark的测量系统MetricsSystem

204 篇文章 478 订阅 ¥49.90 ¥99.00

1.美图

在这里插入图片描述

2.MetricsSystem介绍

监控是一个大系统完成后最重要的一部分。MetricsSystem 比较好理解,一般是为了衡量系统的各种指标的度量系统。算是一个key-value形态的东西。举个比较简单的例子,我怎么把当前JVM相关信息展示出去呢?做法自然很多,通过MetricsSystem就可以做的更标准化些,具体方式如下:

Source 。数据来源。比如对应的有org.apache.spark.metrics.source.JvmSource
Sink。 数据发送到哪去。有被动和主动。一般主动的是通过定时器来完成输出,譬如CSVSink,被动的如MetricsServlet等需要被用户主动调用。
桥接Source 和Sink的则是MetricRegistry了。

Spark 并没有实现底层Metrics的功能,而是使用了一个第三方库:http://metrics.codahale.com 。感兴趣大家可以看看,有个更完整的认识。

3。如何配置MetricsSystem

MetricsSystem的配置有两种,第一种是 metrics.properties 配置文件的形态。第二种是通过spark conf完成,参数以spark.metrics.conf.开头 。

我这里简单介绍下第二种方式。

比如我想查看JVM的信息,包括GC和Memory的使用情况,则我通过类似

conf.set("spark.metrics.conf.drive
  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
Spark生态系统是一个开源的大数据处理框架,它提供了一系列的工具和库,用于处理和分析大规模数据集。以下是Spark生态系统的一些核心组件和相关工具: 1. Apache SparkSpark是一个快速、通用的大数据处理引擎,它支持分布式数据处理和分析。Spark提供了高级API(如Spark SQL、Spark Streaming、MLlib和GraphX)和低级API(如RDD)来处理结构化和非结构化数据。 2. Spark SQL:Spark SQL是Spark的模块之一,它提供了用于处理结构化数据的API。它支持SQL查询、DataFrame和DataSet API,并且可以与Hive集成,从而可以使用Hive的元数据和查询语言。 3. Spark Streaming:Spark Streaming是Spark的流处理模块,它可以实时处理数据流。它支持各种数据源(如Kafka、Flume和HDFS)和数据处理操作(如窗口操作和状态管理),使得实时数据处理变得简单而高效。 4. MLlib:MLlib是Spark的机器学习库,它提供了一系列常见的机器学习算法和工具。MLlib支持分类、回归、聚类、推荐和协同过滤等任务,并且可以与Spark的其他组件无缝集成。 5. GraphX:GraphX是Spark的图处理库,它提供了用于图计算和分析的API。GraphX支持图的创建、转换和操作,以及一些常见的图算法(如PageRank和连通性组件)。 6. SparkR:SparkR是Spark的R语言接口,它允许使用R语言进行数据处理和分析。SparkR提供了与Spark SQL和DataFrame API的集成,使得R用户可以利用Spark的分布式计算能力。 7. PySpark:PySparkSpark的Python语言接口,它允许使用Python进行数据处理和分析。PySpark提供了与Spark SQL、DataFrame和MLlib的集成,使得Python用户可以方便地使用Spark进行大数据处理。 8. Spark Packages:Spark Packages是一个开放的社区生态系统,它提供了各种第三方库和工具的集成。通过Spark Packages,用户可以方便地扩展Spark的功能,例如添加新的数据源、算法或可视化工具。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

九师兄

你的鼓励是我做大写作的动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值