随笔档案

最新评论

1. Re:floating IP 原理分析 - 每天5分钟玩转 OpenStack（107）
好文，可惜缺少 qg口的分析
--mlshenhua
2. Re:Kubernetes 集群日志管理 - 每天5分钟玩转 Docker 容器技术（180）
大佬，每天玩转kubenetes这本书的里面的地址用不了，请问有其它好用的地址不？这个raw.githubusercontent.com域名好像是今年就访问不了，没访问成功过。大佬你书中很多yaml...
--马昌伟
3. Re:理解 Glance - 每天5分钟玩转 OpenStack（20）
@追梦鱼图片失效了。可以在公众号cloudman6中看...
--CloudMan
4. Re:理解 Glance - 每天5分钟玩转 OpenStack（20）
为什么博文中图片不显示呢各位大佬
--追梦鱼
5. Re:外部世界如何访问容器？ - 每天5分钟玩转 Docker 容器技术（37）
内网如何访问？
--ccc#

Job 失败了怎么办？- 每天5分钟玩转 Docker 容器技术（133）

上一节讨论了 Job 执行成功的情况，如果失败了会怎么样呢？

修改 myjob.yml，故意引入一个错误：

先删除之前的 Job：

如果将 restartPolicy 设置为 OnFailure 会怎么样？下面我们实践一下，修改 myjob.yml 后重新启动。

运行新的 Job 并查看状态：

当前 SUCCESSFUL 的 Pod 数量为 0，查看 Pod 的状态：

可以看到有多个 Pod，状态均不正常。kubectl describe pod 查看某个 Pod 的启动日志：

日志显示没有可执行程序，符合我们的预期。

下面解释一个现象：为什么 kubectl get pod 会看到这么多个失败的 Pod？

原因是：当第一个 Pod 启动时，容器失败退出，根据 restartPolicy: Never，此失败容器不会被重启，但 Job DESIRED 的 Pod 是 1，目前 SUCCESSFUL 为 0，不满足，所以 Job controller 会启动新的 Pod，直到 SUCCESSFUL 为 1。对于我们这个例子，SUCCESSFUL 永远也到不了 1，所以 Job controller 会一直创建新的 Pod。为了终止这个行为，只能删除 Job。