RH RHCE 10.0 实训 系统管理与故障排除

RED HAT ENTERPRISE LINUX · SYSTEM OPERATIONS

Red Hat 认证系统运维工程师 RHCE 10.0 实训课程

从系统管理到故障排除,建立可验证的 Linux 运维能力。

8天集中训练,依次学习 RH124、RH134 与 RH342:先掌握企业 Linux 日常配置,再处理启动、存储、网络、软件包、安全和内核等真实故障场景。

8天 集中实训
6小时/天 课程周期
3个模块 RH124 · RH134 · RH342
5项案例 综合故障排除实验
Course Overview

让每一次配置与排障都有依据

课程从企业 Linux 基础操作起步,逐步进入身份与权限、服务、网络、软件包和文件系统管理,再扩展到存储、安全、启动控制与容器运行。高级阶段以 RH342 为核心,通过有步骤的信息收集、分析与恢复,训练跨子系统的故障处理能力。

你将反复练习“观察现象、定位原因、实施修复、验证结果”的工作流程,并在五项综合实验中把分散的知识串成完整的处理过程。

适合人群
Linux 系统管理员、运维工程师及希望系统提升企业 Linux 故障排除能力的技术人员。
学习方式
知识讲解、命令演练、场景排障与综合实验相结合。
课程结构
RH124 系统管理一 → RH134 系统管理二 → RH342 诊断与故障排除。
实训重点
服务可用性、配置持久化、故障证据收集与恢复验证。
Learning Path

三段训练,逐步深入企业 Linux 运维

先建立操作与配置能力,再形成管理复杂系统的能力,最后用系统化方法诊断与解决故障。

01 / RH124

系统管理基础

命令、文件、用户权限、服务、SSH、日志、网络、软件和现有文件系统。

CLI Users systemd DNF
02 / RH134

进阶系统管理

Shell 效率、任务调度、性能、SELinux、LVM、NFS、启动、防火墙和容器。

SELinux Storage Boot Containers
03 / RH342

诊断与故障排除

以证据驱动排障,覆盖启动、硬件、存储、RPM、网络、应用、安全与内核。

sosreport LVM Networking Kernel
RH124
Red Hat System Administration I

红帽系统管理一

从企业 Linux 入门,到独立完成一台服务器上的基本管理任务。

Linux 与命令行基础

  • 认识 Linux 的用途、发行版与红帽企业 Linux。
  • 登录系统,在 shell 中运行简单命令。
  • 复制、删除和组织文件与目录。
  • 使用本地帮助系统解决操作问题。
  • 通过命令行输出或编辑器创建、查看和编辑文本文件。

身份、权限与运行状态

  • 创建、管理和删除本地用户与组,设置密码策略。
  • 配置文件系统权限,理解不同设置的安全影响。
  • 评估、监控和控制 Linux 进程。
  • 使用 systemd 控制并监控服务与守护进程。

连接、软件与系统支持

  • 配置和保护 OpenSSH 远程命令行服务。
  • 查找、解读和存储系统事件日志。
  • 配置网络接口和基础网络设置。
  • 归档文件并在系统之间传输。
  • 使用 DNF 软件包存储库安装、更新和管理软件。
  • 检查并使用现有 Linux 文件系统;借助 Web 管理界面分析服务器问题并获取支持。
阶段收获 能够完成基础配置、访问控制、服务维护、远程管理和常见问题定位。
RH134
Red Hat System Administration II

红帽系统管理二

强化安全、存储、性能和系统生命周期管理,处理更复杂的运维任务。

效率、调度与性能

  • 使用 Bash 高级功能、Shell 脚本与 Linux 实用程序提升操作效率。
  • 将任务调度到指定时间执行。
  • 通过调优参数和进程调度优先级改善系统性能。
  • 使用 SELinux 管理服务器安全。

本地与网络存储

  • 创建和管理存储设备、文件系统与交换空间。
  • 创建和管理包含文件系统或交换空间的逻辑卷。
  • 使用 NFS 协议访问网络附加存储。
  • 验证挂载、卷状态与存储配置。

启动、安全与部署

  • 控制启动过程,定位并修复启动问题。
  • 使用系统防火墙与 SELinux 规则控制服务连接。
  • 在服务器和虚拟机上安装红帽企业 Linux。
  • 在单台服务器上运行、管理轻量型容器服务。
阶段收获 能够管理存储堆栈、安全边界与系统启动,并部署基础容器服务。
RH342
Enterprise Linux Diagnostics & Troubleshooting

企业 Linux 诊断与故障排除

建立信息收集、假设验证、修复和复测的排障方法,覆盖关键系统子模块。

建立排障方法

  • 理解故障排除的一般策略,收集可用信息并确定处理步骤。
  • 使用红帽提供的资源与 sosreport 收集故障信息。
  • 使用系统监控、远程日志、配置管理和审计工具追踪变化。

启动、硬件与虚拟化

  • 排除 BIOS、UEFI、Boot loader 与运行失败的服务导致的启动问题。
  • 恢复 root 密码,查看并收集系统硬件信息。
  • 管理内核模块,识别虚拟化相关问题。

存储与软件包

  • 分析 Linux 存储栈和文件系统故障,恢复 LVM。
  • 检查 LUKS 与 iSCSI 相关问题。
  • 解决 RPM 依赖关系、恢复 RPM 数据库、检查软件包状态并借助更新排障。

网络与应用

  • 测试网络连通性,分析常见网络故障。
  • 检查和管理网络流量,解决流量异常造成的问题。
  • 处理共享库依赖、应用内存泄漏与应用程序无法执行等问题。

安全与内核

  • 修复 SELinux 问题,处理 Kerberos、LDAP 身份验证故障。
  • 定位常见安全子系统问题。
  • 使用内核崩溃转储机制收集主机信息。
  • 使用 SystemTap 分析内核问题并处理常见故障。

问题解决闭环

  • 在每一类故障中记录现象、证据、原因与处理动作。
  • 验证服务状态、网络连接与系统恢复结果。
  • 将处置过程沉淀为可复用的故障排除方法。
阶段收获 能够针对不同系统子模块开展结构化排查,并完成修复或形成可交接的诊断记录。
Comprehensive Labs

五项综合故障排除实验

从应用、身份、Web 服务与网络性能的真实症状出发,结合日志和系统状态,完成定位、处理与验证。

LAB 01 解决自定义应用程序无法工作
LAB 02 解决用户登录问题
LAB 03 解决身份验证问题
LAB 04 解决 Web 服务器故障
LAB 05 解决网络延迟问题
Learning Outcomes

课程结束后,形成六项可实践的能力

日常系统管理

管理命令行、文件、用户、权限、进程、服务与软件包。

网络与安全配置

配置 SSH、网络接口、防火墙和 SELinux 策略。

存储与系统维护

管理文件系统、LVM、NFS、启动流程及基础容器服务。

故障证据收集

结合日志、sosreport、监控与审计信息构建诊断线索。

跨系统问题定位

处理启动、存储、RPM、网络、应用、安全与内核问题。

综合恢复验证

在场景实验中完成故障修复、结果复测与处理过程记录。

Start Training

把系统能力用在真实运维问题上

了解课程安排、实训环境与企业内训方案。