Linux系统诊断小技巧(14):启停问题之如何修复initrd损坏

简介: initrd丢失、损坏或者没有正常工作,是导致系统启动失败比较常见的原因。 如何解决这类问题呢?重新做initrd即可。那么,具体怎么操作呢?我们讨论下。这里我们主要是围绕阿里云的实例问题展开。

题外话

我们先讲什么是initrd和需要的工具。

initrd的二意性

initrd在Linux内核社区有两种意义。一是内核的一种启动机制。二是指实现这种机制的一种方法。作为方法的initrd,已经逐步被initramfs取代

三大利器

关于工具的重要性我们就不絮叨了。解决启停问题,一定要有三大利器的辅助:快照、VNC和录屏工具。

关于这些工具,请参考Linux系统诊断小技巧(13):启停问题之如何修复grub损坏对应小节。

bind挂载

修复启停时经常需要做chroot操作,即我们要在一个新的根文件系统内操作。但是,只执行chroot是不够的。我们还需要挂载/dev、/proc和/sys目录。这样才能使用在chroot后继续使用系统数据。

关于bind挂载,同样请参考Linux系统诊断小技巧(13):启停问题之如何修复grub损坏对应小节。

回到话题

initrd丢失、损坏或者没有正常工作,是导致系统启动失败比较常见的原因。

如何解决这类问题呢?重新做initrd即可。那么,具体怎么操作呢?我们讨论下。这里我们主要是围绕阿里云的实例问题展开。

现场复现

initrd丢失相对容易模拟。重启、及时VNC登录,在grub提供可用内核清单界面,按字母e就能修改启动项配置。我们修改initrd文件名称即可。

修改文件名称
877BFF8096B2C828AB8F0E87ED6A0F1E

按照终端提示,启动系统,得到结果如下(但是这个界面很快会被内核堆栈信息覆盖,灵活使用录屏工具是需要的)
BCB608B3D1F9433AB6B672209C863D1A

initrd缺少驱动

我们可以分别测试缺少主板驱动、磁盘驱动、显卡驱动等多种情形。简单计,这里我们只测试initrd只包括主板驱动的情形。

创建这样的initramfs,可以使用下面的命令:

kernel_verion_str=$(uname -r) # chroot情形的话,需要手工设定
dracut -d virtio_pci /boot/initramfs-${kernel_version_str}-issues.img ${kernel_version_str}

如果不是chroot环境,可以直接使用下面的命令

dracut -d virtio_pci /boot/initramfs-$(uname -r)-issues.img $(uname -r)

命令执行示例如下:
FD5007C86939B99F82558B16E026DD08

验证下我们作出了initrd文件:
1C4E4EE47D83D4745F26968B8C8C208C

复现现场,现在:
D3C495B418B1EBF0CA016160CFCE5DCD

磨刀不误砍柴工

常见的Linux系统都有救援模式,而且(大多)都是有多个内核可用。所以,一个内核的initrd出现问题,并不妨碍我们启动系统,拿到shell。但是,的确存在需要在其他系统上重新做initrd的情形。比如,我们运气不好,碰到的实例,其上的系统只有一个内核。这样现有系统是启动不起来了。系统启动不起来,则拿不到shell,拿不到shell,则读写不了系统盘。

所以,在运气不好的情况下,我们的问题就变成了两个:

  1. 通过什么方式来处理系统盘。
  2. 怎么重新生成initrd

解决第一个问题的方法比较多,这里我们提供一个使用快照的方式。

如何使用快照?

请参考Linux系统诊断小技巧(13):启停问题之如何修复grub损坏有关章节。

重新制作initrd的其他准备步骤

在正常实例上重新制作initrd需要

# 1. 把新创建磁盘作为数据盘挂载到正常实例上。这需要在控制台操作。
# 2. 挂载目标根文件系统。
mount /dev/vdb1 /mnt
# 3. 把/dev、/proc和/sys挂载到新挂载文件系统。这样我们就能够使用内核导出的系统数据了。
for d in dev proc sys;do mount --bind /$d /mnt/$d
4. chroot到目标根文件系统,使之成为当前跟文件系统。
chroot /mnt

有关上面步骤的执行示例,请参考Linux系统诊断小技巧(13):启停问题之如何修复grub损坏有关章节。

重新制作initrd

各个主流发行版都提供了制作initrd文件的易用工具,我们不赘述。这里我们以CentOS 7系统为例。重要的是要把需要启动系统所需的驱动不要忘记了。

对于阿里云当前的实例,主要是主板驱动(virtio_pci)和系统盘驱动(virtio_blk):

# 1. 如果要制作initrd文件的版本号不同于当前运行的内核(比如chroot条件下),
# 则需要手工设定内核版本号;否则,直接使用uname -r的结果即可
kernel_verion_str=...
# 2. 备份老的文件
cp -p /boot/initramfs-${kernel_version_str}.img /boot/initramfs-${kernel_version_str}.img.origin
# 3. 验证备份完毕
ls /boot/initramfs-${kernel_version_str}.img*
# 4. 删除老的initrd文件
rm -f /boot/initramfs-${kernel_version_str}.img
# 5. 重新生成initrd
dracut --add-drivers "virio_pci virtio_blk" /boot/initramfs-${kernel_version_str}.img ${kernel_version_str} 

执行示例如下

E288068055C2F7363A559B14F3D91944

这样我们就重新制作了initrd文件。

终焉

祝探索愉快。

相关文章
|
8天前
|
Linux
在 Linux 系统中,“cd”命令用于切换当前工作目录
在 Linux 系统中,“cd”命令用于切换当前工作目录。本文详细介绍了“cd”命令的基本用法和常见技巧,包括使用“.”、“..”、“~”、绝对路径和相对路径,以及快速切换到上一次工作目录等。此外,还探讨了高级技巧,如使用通配符、结合其他命令、在脚本中使用,以及实际应用案例,帮助读者提高工作效率。
34 3
|
8天前
|
监控 安全 Linux
在 Linux 系统中,网络管理是重要任务。本文介绍了常用的网络命令及其适用场景
在 Linux 系统中,网络管理是重要任务。本文介绍了常用的网络命令及其适用场景,包括 ping(测试连通性)、traceroute(跟踪路由路径)、netstat(显示网络连接信息)、nmap(网络扫描)、ifconfig 和 ip(网络接口配置)。掌握这些命令有助于高效诊断和解决网络问题,保障网络稳定运行。
26 2
|
18天前
|
Linux 应用服务中间件 Shell
linux系统服务二!
本文详细介绍了Linux系统的启动流程,包括CentOS 7的具体启动步骤,从BIOS自检到加载内核、启动systemd程序等。同时,文章还对比了CentOS 6和CentOS 7的启动流程,分析了启动过程中的耗时情况。接着,文章讲解了Linux的运行级别及其管理命令,systemd的基本概念、优势及常用命令,并提供了自定义systemd启动文件的示例。最后,文章介绍了单用户模式和救援模式的使用方法,包括如何找回忘记的密码和修复启动故障。
39 5
linux系统服务二!
|
2天前
|
Ubuntu Linux 网络安全
linux系统ubuntu中在命令行中打开图形界面的文件夹
在Ubuntu系统中,通过命令行打开图形界面的文件夹是一个高效且实用的操作。无论是使用Nautilus、Dolphin还是Thunar,都可以根据具体桌面环境选择合适的文件管理器。通过上述命令和方法,可以简化日常工作,提高效率。同时,解决权限问题和图形界面问题也能确保操作的顺利进行。掌握这些技巧,可以使Linux操作更加便捷和灵活。
10 3
|
8天前
|
安全 网络协议 Linux
本文详细介绍了 Linux 系统中 ping 命令的使用方法和技巧,涵盖基本用法、高级用法、实际应用案例及注意事项。
本文详细介绍了 Linux 系统中 ping 命令的使用方法和技巧,涵盖基本用法、高级用法、实际应用案例及注意事项。通过掌握 ping 命令,读者可以轻松测试网络连通性、诊断网络问题并提升网络管理能力。
30 3
|
11天前
|
安全 Linux 数据安全/隐私保护
在 Linux 系统中,查找文件所有者是系统管理和安全审计的重要技能。
在 Linux 系统中,查找文件所有者是系统管理和安全审计的重要技能。本文介绍了使用 `ls -l` 和 `stat` 命令查找文件所有者的基本方法,以及通过文件路径、通配符和结合其他命令的高级技巧。还提供了实际案例分析和注意事项,帮助读者更好地掌握这一操作。
30 6
|
11天前
|
Linux
在 Linux 系统中,`find` 命令是一个强大的文件查找工具
在 Linux 系统中,`find` 命令是一个强大的文件查找工具。本文详细介绍了 `find` 命令的基本语法、常用选项和具体应用示例,帮助用户快速掌握如何根据文件名、类型、大小、修改时间等条件查找文件,并展示了如何结合逻辑运算符、正则表达式和排除特定目录等高级用法。
40 6
|
12天前
|
机器学习/深度学习 自然语言处理 Linux
Linux 中的机器学习:Whisper——自动语音识别系统
本文介绍了先进的自动语音识别系统 Whisper 在 Linux 环境中的应用。Whisper 基于深度学习和神经网络技术,支持多语言识别,具有高准确性和实时处理能力。文章详细讲解了在 Linux 中安装、配置和使用 Whisper 的步骤,以及其在语音助手、语音识别软件等领域的应用场景。
43 5
|
12天前
|
监控 Linux Perl
Linux 命令小技巧:显示文件指定行的内容
在 Linux 系统中,处理文本文件是一项常见任务。本文介绍了如何使用 head、tail、sed 和 awk 等命令快速显示文件中的指定行内容,帮助你高效处理文本文件。通过实际应用场景和案例分析,展示了这些命令在代码审查、日志分析和文本处理中的具体用途。同时,还提供了注意事项和技巧,帮助你更好地掌握这些命令。
28 4
|
12天前
|
缓存 运维 监控
【运维必备知识】Linux系统平均负载与top、uptime命令详解
系统平均负载是衡量Linux服务器性能的关键指标之一。通过使用 `top`和 `uptime`命令,可以实时监控系统的负载情况,帮助运维人员及时发现并解决潜在问题。理解这些工具的输出和意义是确保系统稳定运行的基础。希望本文对Linux系统平均负载及相关命令的详细解析能帮助您更好地进行系统运维和性能优化。
35 3
下一篇
无影云桌面