Spark on yarn 资源调优

Spark作业在运行的时候应该分配足够多的资源, 在一定范围内, 增加资源和性能提升是成正比的。
提交到Yarn上时, 相关配置:
--driver-memory Driver的内存 --executor-memory Executor的内存 --executor-cores Executor的cpu core数量 --num-executors Executor的数量 --queue 运行在Yarn的哪个队列上

尽量将作业使用的资源调整到最大 task并行度 = num-executors * executor-cores 加大executor-memory, 可以cache更多数据, 降低IO, 避免频繁的GC

转载于:https://my.oschina.net/dreamness/blog/3094233

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值