Job 失败了怎么办？- 每天5分钟玩转 Docker 容器技术（133）

最新推荐文章于 2024-05-07 11:40:50 发布

诸葛钢铁云

最新推荐文章于 2024-05-07 11:40:50 发布

阅读量280

点赞数

分类专栏： K8S 文章标签： docker

原文链接：https://mp.weixin.qq.com/s?__biz=MzIwMTM5MjUwMg==&mid=2653588371&idx=1&sn=5ae6a812c369f71f6168102f6de3dbab&chksm=8d30838aba470a9c39c1f4485356170eb1a09ea211304f128146876873e843d26734e812b85e&scene=21#wechat_redirect

版权

K8S 专栏收录该内容

121 篇文章 7 订阅

订阅专栏

Job 失败了怎么办？- 每天5分钟玩转 Docker 容器技术（133）

原创 CloudMan CloudMan 2018-02-23

第133篇

Job 失败了怎么办？

上一节讨论了 Job 执行成功的情况，如果失败了会怎么样呢？

修改 myjob.yml，故意引入一个错误：

先删除之前的 Job：

如果将 restartPolicy 设置为 OnFailure 会怎么样？下面我们实践一下，修改 myjob.yml 后重新启动。

运行新的 Job 并查看状态：

当前 SUCCESSFUL 的 Pod 数量为 0，查看 Pod 的状态：

可以看到有多个 Pod，状态均不正常。kubectl describe pod 查看某个 Pod 的启动日志：

日志显示没有可执行程序，符合我们的预期。

下面解释一个现象：为什么 kubectl get pod 会看到这么多个失败的 Pod？

原因是：当第一个 Pod 启动时，容器失败退出，根据 restartPolicy: Never，此失败容器不会被重启，但 Job DESIRED 的 Pod 是 1，目前 SUCCESSFUL 为 0，不满足，所以 Job controller 会启动新的 Pod，直到 SUCCESSFUL 为 1。对于我们这个例子，SUCCESSFUL 永远也到不了 1，所以 Job controller 会一直创建新的 Pod。为了终止这个行为，只能删除 Job。

如果将 restartPolicy 设置为 OnFailure 会怎么样？下面我们实践一下，修改 myjob.yml 后重新启动。

Job 的 SUCCESSFUL Pod 数量还是为 0，看看 Pod 的情况：

这里只有一个 Pod，不过 RESTARTS 为 3，而且不断增加，说明 OnFailure 生效，容器失败后会自动重启。

下一节我们讨论提高 Job 执行效率的方法。

书籍：

1.《每天5分钟玩转Docker容器技术》https://item.jd.com/16936307278.html（点击“阅读原文”直达）

2.《每天5分钟玩转OpenStack》
https://item.jd.com/12086376.html

诸葛钢铁云

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。