阿里云K8S服务-数据盘扩容方案

本文涉及的产品
容器镜像服务 ACR,镜像仓库100个 不限时长
简介: 目前容器服务Kubernetes集群在创建的时候,可以让客户选择是否挂载Worker节点的数据盘,并配置其容量; 本文为您介绍在后续使用过程中扩容数据盘的方法。

介绍

目前容器服务Kubernetes集群在创建的时候,可以让客户选择是否挂载Worker节点的数据盘,并配置其容量;这里的数据盘会保存docker容器、镜像、kubelet等相关数据;

这里的数据盘与客户应用使用的云盘区别:

这里的数据盘:是用来保存docker、kubelet等容器系统服务数据的;
应用挂载云盘:是您的应用来保存数据的,可以通过pv、pvc挂载;

云盘扩容方案:https://yq.aliyun.com/articles/629008

disk_expend_1

如上图,创建集群的时候为worker节点添加数据盘,会默认挂载在worker的/dev/vdb设备;

# ls /dev | grep vdb
vdb
vdb1

# df -h | grep vdb
/dev/vdb1        58G  1.1G   54G    2% /var/lib/docker

# mount | grep vdb
/dev/vdb1 on /var/lib/container type ext4 (rw,relatime,data=ordered)
/dev/vdb1 on /var/lib/kubelet type ext4 (rw,relatime,data=ordered)
/dev/vdb1 on /var/lib/docker type ext4 (rw,relatime,data=ordered)
/dev/vdb1 on /var/lib/docker/plugins type ext4 (rw,relatime,data=ordered)
/dev/vdb1 on /var/lib/container/docker/plugins type ext4 (rw,relatime,data=ordered)
/dev/vdb1 on /var/lib/docker/overlay2 type ext4 (rw,relatime,data=ordered)
/dev/vdb1 on /var/lib/container/docker/overlay2 type ext4 (rw,relatime,data=ordered)

以下各个步骤介绍如何在Kubernetes环境下为数据盘(/dev/vdb)扩容;

假设需要升级的数据盘在节点Worker1上:

1. 暂停节点服务

登陆worker1,停止docker、kubelet服务:

# service kubelet stop
# service docker stop

关闭docker、kubelet开启启动:

# systemctl disable kubelet
# systemctl disable docker

2. 打快照(已备升级失败时恢复)

从容器集群列表找到worker1节点:

1) 从节点列表点击节点进入ecs控制台:
2) 点击本实例磁盘页面,点击对应数据盘的“创建快照”按钮;
3) 点击左侧栏的“本实例快照”,可以看到快照的创建进度;

disk_expend_3

创建快照完成,进行下一步;

3. 扩容磁盘

在ecs控制台找到要扩容数据盘,设置扩容后容量,点击扩容。扩容成功后,控制台磁盘列表里即显示扩容后的容量。
disk_expend_2

重启节点:ecs控制台上找到worker1,重启节点;

4. 扩容文件系统

登陆worker1节点:

4.1. Umount挂载目录:

把所有挂载/dev/vdb1设备的目录进行umount:

查看有哪些挂载目录:

# mount | grep vdb
/dev/vdb1 on /var/lib/container type ext4 (rw,relatime,data=ordered)
/dev/vdb1 on /var/lib/kubelet type ext4 (rw,relatime,data=ordered)
/dev/vdb1 on /var/lib/docker type ext4 (rw,relatime,data=ordered)

执行卸载目录:

# umount /var/lib/kubelet/
# umount /var/lib/docker
# umount /var/lib/container/

检查卸载完成:

# mount | grep vdb

4.2. 重置磁盘:

执行以下命令,为磁盘重新分配分区大小:

# fdisk /dev/vdb
(依次输入以下选项:都是默认值)
:d回车 n回车 p回车 1回车 回车 回车 wq回车

具体说明参考:https://help.aliyun.com/document_detail/25452.html

执行完成检查是否分区扩容成功,/dev/vdb1的大小为83885056(大约80G,最后一行)。

# fdisk -l /dev/vdb

磁盘 /dev/vdb:85.9 GB, 85899345920 字节,167772160 个扇区
Units = 扇区 of 1 * 512 = 512 bytes
扇区大小(逻辑/物理):512 字节 / 512 字节
I/O 大小(最小/最佳):512 字节 / 512 字节
磁盘标签类型:dos
磁盘标识符:0x0bd82aa9

   设备 Boot      Start         End      Blocks   Id  System
/dev/vdb1            2048   167772159    83885056   83  Linux

4.3. 扩容文件系统:

再次检查vdb是否被挂载(由于配置了自动挂载)

# mount | grep vdb
/dev/vdb1 on /var/lib/container type ext4 (rw,relatime,data=ordered)

执行Umount:
# umount /var/lib/container

执行以下文件系统扩容命令:

## 检查文件系统,如果被挂载会报错;
# e2fsck -f /dev/vdb1
e2fsck 1.42.9 (28-Dec-2013)
第一步: 检查inode,块,和大小
第二步: 检查目录结构
第3步: 检查目录连接性
Pass 4: Checking reference counts
第5步: 检查簇概要信息
/dev/vdb1: 32120/7864320 files (0.1% non-contiguous), 797997/15728384 blocks

## 变更文件系统大小;
# resize2fs /dev/vdb1
resize2fs 1.42.9 (28-Dec-2013)
Resizing the filesystem on /dev/vdb1 to 20971264 (4k) blocks.
The filesystem on /dev/vdb1 is now 20971264 blocks long.

5. 重启节点

Enable开机启动服务:

# systemctl enable kubelet
# systemctl enable docker

执行reboot 或者 到控制台重启woker1节点;

6. 验证扩容

节点重启后登陆worker1节点:

## vdb 数据盘已经变成78G(配置的80G);
# df -h | grep vdb
/dev/vdb1        78G  1.1G   73G    2% /var/lib/docker

检查磁盘数据是否完整:

# docker images 比较扩容前后的镜像数据;

检查kubelet、docker服务运行是否正常;

相关实践学习
通过Ingress进行灰度发布
本场景您将运行一个简单的应用,部署一个新的应用用于新的发布,并通过Ingress能力实现灰度发布。
容器应用与集群管理
欢迎来到《容器应用与集群管理》课程,本课程是“云原生容器Clouder认证“系列中的第二阶段。课程将向您介绍与容器集群相关的概念和技术,这些概念和技术可以帮助您了解阿里云容器服务ACK/ACK Serverless的使用。同时,本课程也会向您介绍可以采取的工具、方法和可操作步骤,以帮助您了解如何基于容器服务ACK Serverless构建和管理企业级应用。 学习完本课程后,您将能够: 掌握容器集群、容器编排的基本概念 掌握Kubernetes的基础概念及核心思想 掌握阿里云容器服务ACK/ACK Serverless概念及使用方法 基于容器服务ACK Serverless搭建和管理企业级网站应用
目录
相关文章
|
2天前
|
Prometheus Kubernetes 监控
OpenAI故障复盘 - 阿里云容器服务与可观测产品如何保障大规模K8s集群稳定性
聚焦近日OpenAI的大规模K8s集群故障,介绍阿里云容器服务与可观测团队在大规模K8s场景下我们的建设与沉淀。以及分享对类似故障问题的应对方案:包括在K8s和Prometheus的高可用架构设计方面、事前事后的稳定性保障体系方面。
|
17天前
|
人工智能 运维 监控
阿里云ACK容器服务生产级可观测体系建设实践
本文整理自2024云栖大会冯诗淳(花名:行疾)的演讲,介绍了阿里云容器服务团队在生产级可观测体系建设方面的实践。冯诗淳详细阐述了容器化架构带来的挑战及解决方案,强调了可观测性对于构建稳健运维体系的重要性。文中提到,阿里云作为亚洲唯一蝉联全球领导者的容器管理平台,其可观测能力在多项关键评测中表现优异,支持AI、容器网络、存储等多个场景的高级容器可观测能力。此外,还介绍了阿里云容器服务在多云管理、成本优化等方面的最新进展,以及即将推出的ACK AI助手2.0,旨在通过智能引擎和专家诊断经验,简化异常数据查找,缩短故障响应时间。
阿里云ACK容器服务生产级可观测体系建设实践
|
17天前
|
Kubernetes 算法 调度
阿里云 ACK FinOps成本优化最佳实践
本文源自2024云栖大会梁成昊演讲,讨论了成本优化策略的选择与实施。文章首先介绍了成本优化的基本思路,包括优化购买方式、调整资源配置等基础策略,以及使用弹性、资源混部等高级策略。接着,文章详细探讨了集群优化和应用优化的具体方法,如使用抢占式实例降低成本、通过资源画像识别并优化资源配置,以及利用智能应用弹性策略提高资源利用效率。
|
17天前
|
弹性计算 调度 数据中心
阿里云 ACK One 注册集群云上弹性:扩展业务新利器
随着企业数字化转型深入,传统IDC数据中心因物理容量限制,难以实现动态扩容,缺乏弹性能力。阿里云ACK One注册集群凭借其高度灵活性和丰富资源选择,成为解决此问题的最佳方案。通过与阿里云资源的整合,ACK One不仅实现了计算资源的按需扩展,提高了资源利用率,还通过按需付费模式降低了成本,使企业能够更高效地应对业务增长和高峰需求。
|
17天前
|
运维 Kubernetes Serverless
阿里云Argo X K8s玩转工作流引擎,实现大规模并行计算
本文基于2024云栖大会田双坤的演讲,介绍了Kubernetes作为云原生操作系统的角色及其在各类任务中的应用,重点探讨了Argo Workflows在Kubernetes上编排并行任务的能力。面对自建Argo Workflows的挑战,如稳定性、成本和安全性等问题,阿里巴巴云推出了全托管的Serverless Argo工作流,提供全托管、免运维、可观测和易集成的特点,显著提升了任务编排的效率和稳定性。适用于数据处理、科学计算、自动驾驶仿真等多个领域。
|
17天前
|
Kubernetes 容灾 调度
阿里云 ACK 高可用稳定性最佳实践
本文整理自2024云栖大会刘佳旭的演讲,主题为《ACK高可用稳定性最佳实践》。文章探讨了云原生高可用架构的重要性,通过Kubernetes的高可用案例分析,介绍了ACK在单集群高可用架构设计、产品能力和最佳实践方面的方法,包括控制面和数据面的高可用策略、工作负载高可用配置、企业版容器镜像服务高可用配置等内容,旨在帮助企业构建更加可靠和高效的应用运行环境。
|
17天前
|
存储 Kubernetes 关系型数据库
阿里云ACK备份中心,K8s集群业务应用数据的一站式灾备方案
本文源自2024云栖大会苏雅诗的演讲,探讨了K8s集群业务为何需要灾备及其重要性。文中强调了集群与业务高可用配置对稳定性的重要性,并指出人为误操作等风险,建议实施周期性和特定情况下的灾备措施。针对容器化业务,提出了灾备的新特性与需求,包括工作负载为核心、云资源信息的备份,以及有状态应用的数据保护。介绍了ACK推出的备份中心解决方案,支持命名空间、标签、资源类型等维度的备份,并具备存储卷数据保护功能,能够满足GitOps流程企业的特定需求。此外,还详细描述了备份中心的使用流程、控制台展示、灾备难点及解决方案等内容,展示了备份中心如何有效应对K8s集群资源和存储卷数据的灾备挑战。
|
5天前
|
Kubernetes 网络协议 应用服务中间件
Kubernetes Ingress:灵活的集群外部网络访问的利器
《Kubernetes Ingress:集群外部访问的利器-打造灵活的集群网络》介绍了如何通过Ingress实现Kubernetes集群的外部访问。前提条件是已拥有Kubernetes集群并安装了kubectl工具。文章详细讲解了Ingress的基本组成(Ingress Controller和资源对象),选择合适的版本,以及具体的安装步骤,如下载配置文件、部署Nginx Ingress Controller等。此外,还提供了常见问题的解决方案,例如镜像下载失败的应对措施。最后,通过部署示例应用展示了Ingress的实际使用方法。
21 2
|
1月前
|
Kubernetes 监控 Cloud Native
Kubernetes集群的高可用性与伸缩性实践
Kubernetes集群的高可用性与伸缩性实践
75 1
|
2月前
|
JSON Kubernetes 容灾
ACK One应用分发上线:高效管理多集群应用
ACK One应用分发上线,主要介绍了新能力的使用场景

相关产品

  • 容器服务Kubernetes版