第135课: Spark面试经典系列之数据倾斜:数据倾斜是多么痛?!

第135课:  Spark面试经典系列之数据倾斜:数据倾斜是多么痛?!
1 spark性能真正的杀手

2 数据倾斜是多么痛?!


性能调优层面:

出现jvm oom怎么办?出现数据倾斜怎么办?出现框架问题怎么办?决定spark水平高低的是,怎么进行调优?


数据倾斜不解决的话,性能调优就是一个笑话
1 数据倾斜的直接后果就是程序根本运行不起来了! OOM 速度慢
2 数据倾斜代表spark工程师的水平,数据倾斜的解决意味着对spark运行机制了如指掌



数据倾斜解决以后,性能调优就是硬件加cpu 加内存,根本之道。


数据倾斜:业务热点的二八原则 80% 20%
key值




搞定数据倾斜:
对shuffle了如指掌 
对业务了如指掌 
对硬件cpu了如指掌
对OOM的根本原因了如指掌 OOM一般都是由于数据倾斜所致!GC有很大压力


kafka 直接基于linux 的内核管理,

  • 2
    点赞
  • 4
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

段智华

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值