在K8S中,节点故障pod驱逐pod过程,时间怎么定义的?

本文涉及的产品
容器服务 Serverless 版 ACK Serverless,952元额度 多规格
容器服务 Serverless 版 ACK Serverless,317元额度 多规格
简介: 在K8S中,节点故障pod驱逐pod过程,时间怎么定义的?

在Kubernetes(K8S)中,节点故障导致Pod驱逐的过程是一个涉及多个组件和参数协同工作的复杂流程。这个过程的时间定义主要通过一系列参数来配置和确定。以下是该过程的详细解释以及时间定义的说明:

一、节点故障检测
  1. 节点控制器(Node Controller)检查间隔:
  • node-monitor-period:这是节点控制器检查每个节点健康状态的间隔时间。默认值为5秒。即每5秒,节点控制器会尝试与集群中的每个节点进行通信,以确认其状态。
  1. 节点故障判断时间窗口:
  • node-monitor-grace-period:这是节点控制器在判断节点为故障之前等待的时间窗口。默认值为40秒。如果在40秒内节点控制器没有收到节点的响应或确认消息,则节点控制器会将该节点标记为“NotReady”状态。
二、Pod驱逐过程
  1. Pod保留时间:
  • pod-eviction-timeout:当节点被标记为故障后,kubelet允许Pod在此故障节点上保留的时间。默认值为300秒(即5分钟)。这意味着,从节点被标记为故障开始,kubelet会等待5分钟,然后再开始驱逐该节点上的Pod。
  1. 驱逐过程:
  • 一旦超过pod-eviction-timeout设置的时间,kubelet会开始将故障节点上的Pod驱逐到其他健康的节点上。这个过程包括终止Pod中的容器、清理相关资源等。
三、时间定义总结
  • 总时间:从节点故障开始到Pod被完全驱逐到其他节点,整个过程的时间大致为node-monitor-grace-period + pod-eviction-timeout,即40秒 + 300秒 = 340秒(约5分40秒)。但需要注意的是,这个时间是从节点被标记为故障状态开始计算的,而节点被标记为故障状态之前还有node-monitor-period的等待时间(5秒)。
  • 调整参数:在实际操作中,这些参数(如node-monitor-period、node-monitor-grace-period和pod-eviction-timeout)可以根据需要进行调整,以优化集群的故障恢复能力和资源利用率。
四、注意事项
  • Pod状态变化:在驱逐过程中,Pod的状态不会立即改变。在pod-eviction-timeout时间内,原本是Running的Pod状态将保持不变。当超过这个时间后,这些Pod的状态会变为Nodelost(对于DaemonSet)或Unknown(对于Deployment)。
  • 优雅终止:在驱逐Pod之前,Kubernetes会尝试优雅地终止Pod中的容器,以确保应用程序有足够的时间完成正在进行的任务并释放资源。这通过发送SIGTERM信号给容器中的进程来实现,并等待一段配置的时间(terminationGracePeriodSeconds)让进程自行终止。

综上所述,我们可以清楚地了解到Kubernetes中节点故障导致Pod驱逐的过程及其时间定义。这些参数和流程确保了集群在节点故障时能够迅速恢复服务,并保持高可用性。

相关实践学习
通过Ingress进行灰度发布
本场景您将运行一个简单的应用,部署一个新的应用用于新的发布,并通过Ingress能力实现灰度发布。
容器应用与集群管理
欢迎来到《容器应用与集群管理》课程,本课程是“云原生容器Clouder认证“系列中的第二阶段。课程将向您介绍与容器集群相关的概念和技术,这些概念和技术可以帮助您了解阿里云容器服务ACK/ACK Serverless的使用。同时,本课程也会向您介绍可以采取的工具、方法和可操作步骤,以帮助您了解如何基于容器服务ACK Serverless构建和管理企业级应用。 学习完本课程后,您将能够: 掌握容器集群、容器编排的基本概念 掌握Kubernetes的基础概念及核心思想 掌握阿里云容器服务ACK/ACK Serverless概念及使用方法 基于容器服务ACK Serverless搭建和管理企业级网站应用
相关文章
|
22天前
|
Kubernetes API 调度
k8s中节点无法启动Pod
【10月更文挑战第3天】
61 6
|
22天前
|
存储 Kubernetes Perl
K8S中Pod启动异常
【10月更文挑战第3天】
48 2
|
24天前
|
JSON Kubernetes API
在K8S中,什么是静态Pod?
在K8S中,什么是静态Pod?
|
5天前
|
JSON Kubernetes 容灾
ACK One应用分发上线:高效管理多集群应用
ACK One应用分发上线,主要介绍了新能力的使用场景
|
6天前
|
Kubernetes 持续交付 开发工具
ACK One GitOps:ApplicationSet UI简化多集群GitOps应用管理
ACK One GitOps新发布了多集群应用控制台,支持管理Argo CD ApplicationSet,提升大规模应用和集群的多集群GitOps应用分发管理体验。
|
29天前
|
Kubernetes Cloud Native 云计算
云原生之旅:Kubernetes 集群的搭建与实践
【8月更文挑战第67天】在云原生技术日益成为IT行业焦点的今天,掌握Kubernetes已成为每个软件工程师必备的技能。本文将通过浅显易懂的语言和实际代码示例,引导你从零开始搭建一个Kubernetes集群,并探索其核心概念。无论你是初学者还是希望巩固知识的开发者,这篇文章都将为你打开一扇通往云原生世界的大门。
99 17
|
21天前
|
Kubernetes 应用服务中间件 nginx
搭建Kubernetes v1.31.1服务器集群,采用Calico网络技术
在阿里云服务器上部署k8s集群,一、3台k8s服务器,1个Master节点,2个工作节点,采用Calico网络技术。二、部署nginx服务到k8s集群,并验证nginx服务运行状态。
237 1
|
26天前
|
Kubernetes Cloud Native 微服务
微服务实践之使用 kube-vip 搭建高可用 Kubernetes 集群
微服务实践之使用 kube-vip 搭建高可用 Kubernetes 集群
78 1
|
26天前
|
负载均衡 应用服务中间件 nginx
基于Ubuntu-22.04安装K8s-v1.28.2实验(二)使用kube-vip实现集群VIP访问
基于Ubuntu-22.04安装K8s-v1.28.2实验(二)使用kube-vip实现集群VIP访问
42 1
|
1月前
|
Kubernetes Cloud Native Ubuntu
云原生之旅:Kubernetes集群搭建与应用部署
【8月更文挑战第65天】本文将带你进入云原生的世界,通过一步步指导如何在本地环境中搭建Kubernetes集群,并部署一个简单的应用。我们将使用Minikube和Docker作为工具,探索云原生技术的魅力所在。无论你是初学者还是有经验的开发者,这篇文章都将为你提供有价值的信息和实践技巧。

推荐镜像

更多