Deployment 滚动更新的时候,老的 Pod 停止有事需要非常长时间甚至停不下来有什么可能?
資深大佬 : zhoudaiyu 2
K8s 1.13 ,deployment 更新,新 Pod 就绪已经 10 分钟了,老的 Pod 还没有被杀死,状态是卡在 Terminating,container 已经停止了,这是 Pod 也没有报错,时候过几分钟 Pod 就被杀死了,有时候还是卡住,这时只能加上 graceful-period=0 和 force 两个参数强制杀死 Pod,我们设置的 gracefulPeriodSecond 是 20s,也就是说发起杀 container 的信号后 20s 即便没有停,Pod 也应该自动被杀死了才对。由于这种问题是偶发的,我们也不太好查,也不知道去哪查。大家有啥思路吗?
大佬有話說 (9)