[命令] e2fsck 命令的使用 (紧急修复 EXT 格式的文件系统)

正文:

步骤一:进入救援模式

(注意:当进入 RHEL 的救援模式时,如果遇到了有 ”Skip to shell“ 的选项,则选择此选项)

步骤二:开启软件级 RAID 或者 LVM

2.1 开启软件级 RAID

sh-4.2# mdadm --assemble --scan

2.2 开启 LVM

sh-4.2# lvm vgchange -ay

步骤三:修复 XFS 格式的文件系统

3.1 如果是修复逻辑卷

sh-4.2# e2fsck -fvy /dev/mapper/<volume group>-<logical volume>

(注意:在进行此操作前建议先备份数据)

3.2 如果是修复硬盘

sh-4.2# e2fsck -fvy /dev/<disk device>

(注意:在进行此操作前建议先备份数据)

3.3 如果是修复硬盘分区

sh-4.2# e2fsck -fvy /dev/<disk device partition>

(注意:在进行此操作前建议先备份数据)

3.4 如果是修复挂在的设备

sh-4.2# e2fsck -fvy /dev/<md device>

(注意:在进行此操作前建议先备份数据)

步骤四:退出救援模式

sh-4.2# exit

补充:

如果是修复 EXT 格式的文件系统的话,将步骤三种的以下命令:

sh-4.2# e2fsck -fvy /dev/mapper/<volume group>-<logical volume>
sh-4.2# e2fsck -fvy /dev/<disk device>
sh-4.2# e2fsck -fvy /dev/<disk device partition>
sh-4.2# e2fsck -fvy /dev/<md device>

修改成:

sh-4.2# xfs_repair /dev/mapper/<volume group>-<logical volume>
sh-4.2# xfs_repair /dev/<disk device>
sh-4.2# xfs_repair /dev/<disk device partition>
sh-4.2# xfs_repair /dev/<md device>


注意:
1) 在进行此操作前建议先备份数据
2) 如果直接使用 xfs_reqaire 命令无效,可以加上 -L 参数,但是使用 -L 参数前一定要提前备份数据:

sh-4.2# xfs_repair -L /dev/mapper/<volume group>-<logical volume>
sh-4.2# xfs_repair -L /dev/<disk device>
sh-4.2# xfs_repair -L /dev/<disk device partition>
sh-4.2# xfs_repair -L /dev/<md device>

参考文献:

https://access.redhat.com/solutions/9541
https://docs.redhat.com/en/documentation/red_hat_enterprise_linux/10/html/managing_file_systems/checking-and-repairing-a-file-system_
https://docs.redhat.com/zh-cn/documentation/red_hat_enterprise_linux/8/html/managing_file_systems/checking-an-xfs-file-system-with-xfs-repair_checking-and-repairing-a-file-system

[命令] xfs_repair 命令的使用 (紧急修复 XFS 格式的文件系统)

正文:

步骤一:进入救援模式

(注意:当进入 RHEL 的救援模式时,如果遇到了有 ”Skip to shell“ 的选项,则选择此选项)

步骤二:开启软件级 RAID 或者 LVM

2.1 开启软件级 RAID

sh-4.2# mdadm --assemble --scan

2.2 开启 LVM

sh-4.2# lvm vgchange -ay

步骤三:修复 XFS 格式的文件系统

3.1 如果是修复逻辑卷

sh-4.2# xfs_repair /dev/mapper/<volume group>-<logical volume>


注意:
1) 在进行此操作前建议先备份数据
2) 如果直接使用 xfs_reqaire 命令无效,可以加上 -L 参数,但是使用 -L 参数前一定要提前备份数据:

sh-4.2# xfs_repair -L /dev/mapper/<volume group>-<logical volume>

3.2 如果是修复硬盘

sh-4.2# xfs_repair /dev/<disk device>


注意:
1) 在进行此操作前建议先备份数据
2) 如果直接使用 xfs_reqaire 命令无效,可以加上 -L 参数,但是使用 -L 参数前一定要提前备份数据:

sh-4.2# xfs_repair -L /dev/<disk device>

3.3 如果是修复硬盘分区

sh-4.2# xfs_repair /dev/<disk device partition>


注意:
1) 在进行此操作前建议先备份数据
2) 如果直接使用 xfs_reqaire 命令无效,可以加上 -L 参数,但是使用 -L 参数前一定要提前备份数据:

sh-4.2# xfs_repair -L /dev/<disk device partition>

3.4 如果是修复挂在的设备

sh-4.2# xfs_repair /dev/<md device>


注意:
1) 在进行此操作前建议先备份数据
2) 如果直接使用 xfs_reqaire 命令无效,可以加上 -L 参数,但是使用 -L 参数前一定要提前备份数据:

sh-4.2# xfs_repair -L /dev/<md device>

步骤四:退出救援模式

sh-4.2# exit

补充:

如果是修复 EXT 格式的文件系统的话,将步骤三种的以下命令:

sh-4.2# xfs_repair /dev/mapper/<volume group>-<logical volume>
sh-4.2# xfs_repair /dev/<disk device>
sh-4.2# xfs_repair /dev/<disk device partition>
sh-4.2# xfs_repair /dev/<md device>

修改成:

sh-4.2# e2fsck -fvy /dev/mapper/<volume group>-<logical volume>
sh-4.2# e2fsck -fvy /dev/<disk device>
sh-4.2# e2fsck -fvy /dev/<disk device partition>
sh-4.2# e2fsck -fvy /dev/<md device>

参考文献:

https://access.redhat.com/solutions/9541
https://docs.redhat.com/en/documentation/red_hat_enterprise_linux/10/html/managing_file_systems/checking-and-repairing-a-file-system_
https://docs.redhat.com/zh-cn/documentation/red_hat_enterprise_linux/8/html/managing_file_systems/checking-an-xfs-file-system-with-xfs-repair_checking-and-repairing-a-file-system

[内容] Linux console 口输出信息简介

正文:

内容一:Linux console 口输出信息的案例

......
[233901.562021] systemd[1]: Failed to start Journal Service.
[234212.762021] systemd[1]: Failed to start Journal Service.
[234477.728002] systemd[1]: Failed to start Journal Service.
[234599.842019] systemd[1]: Failed to start Journal Service.
[235000.845000] systemd[1]: Failed to start Journal Service.
......

内容二:Linux console 口输出信息的性质

Linux console 口的输出信息不存储在系统日志里,而是在 Linux 内存,重启后则清除

内容三:Linux console 口输出信息的内容

3.1 输出信息的时间部分

其中 [235000.845000] 是自上次开机以后系统运行的秒数

3.2 输出信息的内容部分

systemd[1]: Failed to start Journal Service. 是输出信息的内容

补充:

[排错] 解决 Linux 启动时某些服务没有开机自启 (日志里报错: “deleted to break ordering cycle starting”)

报错代码

某些服务没有开机自启例如 NetworkManager.service

原因分析

在系统日志里可以类似 …… Job network.target/start deleted to break ordering cycle starting with …… 报错例如:

# cat /var/log/messages
Jan 1 10:09:24 server systemd[1]: network-online.target: Found ordering cycle on network.target/start
Jan 1 10:09:24 server systemd[1]: network-online.target: Found dependency on NetworkManager.service/start
Jan 1 10:09:24 server systemd[1]: network-online.target: Found dependency on basic.target/start
Jan 1 10:09:24 server systemd[1]: network-online.target: Found dependency on slices.target/start
Jan 1 10:09:24 server systemd[1]: network-online.target: Found dependency on mysql.slice/start
Jan 1 10:09:24 server systemd[1]: network-online.target: Found dependency on remote-fs.target/start
Jan 1 10:09:24 server systemd[1]: network-online.target: Found dependency on remote-fs-pre.target/start
Jan 1 10:09:24 server systemd[1]: network-online.target: Found dependency on iscsi.service/start
Jan 1 10:09:24 server systemd[1]: network-online.target: Found dependency on network-online.target/start
Jan 1 10:09:24 server systemd[1]: network-online.target: Job network.target/start deleted to break ordering cycle starting with network-online.target/start
Jan 1 10:09:24 server systemd[1]: NetworkManager-wait-online.service: Found ordering cycle on NetworkManager.service/start
Jan 1 10:09:24 server systemd[1]: NetworkManager-wait-online.service: Found dependency on basic.target/start
Jan 1 10:09:24 server systemd[1]: NetworkManager-wait-online.service: Found dependency on slices.target/start
Jan 1 10:09:24 server systemd[1]: NetworkManager-wait-online.service: Found dependency on mysql.slice/start
Jan 1 10:09:24 server systemd[1]: NetworkManager-wait-online.service: Found dependency on remote-fs.target/start
Jan 1 10:09:24 server systemd[1]: NetworkManager-wait-online.service: Found dependency on remote-fs-pre.target/start
Jan 1 10:09:24 server systemd[1]: NetworkManager-wait-online.service: Found dependency on iscsi.service/start
Jan 1 10:09:24 server systemd[1]: NetworkManager-wait-online.service: Found dependency on network-online.target/start
Jan 1 10:09:24 server systemd[1]: NetworkManager-wait-online.service: Found dependency on NetworkManager-wait-online.service/start
Jan 1 10:09:24 server systemd[1]: NetworkManager-wait-online.service: Job NetworkManager.service/start deleted to break ordering cycle starting with NetworkManager-wait-online.service/start

从案例中日志里的内容可以判断:
1) network.target/NetworkManager.service 启动
2) NetworkManager.service 作为基础服务依赖 basic.target
3) basic.target 依赖所有 slice 包括 mysql.slice
4) mysql.slice 依赖 iscsi.service/remote-fs.target/remote-fs-pre.target
5) iscsi.service/remote-fs.target/remote-fs-pre.target 依赖 network.target/NetworkManager.service
6) 系统为了防止启动时陷入死循环,systemd 报错 Job NetworkManager.service/start deleted to break ordering cycle 并放弃启动 NetworkManager.service

解决方法

取消不太重要的服务的依赖要求

# vi /etc/systemd/system/mysql.slice

将以下内容:

......
Before=slices.target
Wants=-.slice
After=-.slice remote-fs.target
......

修改为:

......
Before=slices.target
Wants=-.slice
After=-.slice #remote-fs.target
......


补充:
1) 这里以取消使用 /etc/systemd/system/mysql.slice 文件的服务的依赖要求为例
2) 这里以注释掉 After=-.slice remote-fs.target 中的 remote-fs.target 为例

[排错] 解决 Linux 开机时报错 “kernel panic – no syncing: Attempted to kill init ……”

报错代码

/init: error while loading shared libraries: libsystemd-shared-239.so: cannot open shared object file: No such file or directory
kernel panic - no syncing: Attempted to kill init! exitcode=0x00007f00

解决方法

步骤一:进入拯救模式

步骤二:确认第三方软件库

2.1 搜集第三方软件库信息

# ldconfig -p > /tmp/ldconfig.out

2.2 确认有没有第三方软件库

# for l in $(awk '{ print $1 }' /tmp/ldconfig.out); do matches=$(awk "\$1 == \"$l\" { print }" /tmp/ldconfig.out); if [ $(echo "$matches" | wc -l) -ge 2 ]; then echo "$matches"; echo; fi; done

(补充:如果没有第三方软件库的话这里不会有任何输出)

步骤三:检查 /etc/ld.so.conf 文件或者 /etc/ld.so.conf.d/ 目录里的文件去除第三方库

(步骤略)

步骤四:刷新库缓存

# ldconfig

步骤五:为启动失败的系统创建创建 initramfs 文件

# dracut -f /boot/initramfs-(uname -r).img $(uname -r)

(补充:这里以将正在运行的内核版本生成一个新的 initramfs 为例)

(注意:此时原来启动系统时使用的那个 initramfs 文件会被覆盖)

步骤六:重启系统

# reboot

参考文献

https://access.redhat.com/solutions/7096246