根据生产事件而非教科书编写的 Linux 书籍
凌晨 3 点有人给您传呼。服务器已关闭。仪表板没有显示任何有用的信息。您了解 Linux — 但故障发生在您以前从未关注过的层中。
这本书就是为了那一刻而写的。
Linux 基础:实用指南涵盖了十二个内核子系统 – 这些子系统在生产中会失败,并且在没有正确的思维模型的情况下需要几个小时才能诊断。每一章都以一个真实的事件开始,包含可以立即运行的命令,并以具体的清单结束。
章节封面
- 启动 — GRUB2 恢复、initramfs 内部结构、为什么 yum 更新内核可以使服务器静默
- 进程模型 — fork()、僵尸累积、D 状态进程、fork() 在 384GB 可用 RAM 下失败
- 内存 – 页面缓存、OOM 杀手评分、THP 延迟峰值以及免费出现的问题
- 文件系统和文件描述符 – VFS、已删除但打开的文件、inode 耗尽、epoll、inotify 限制
- 内核网络堆栈 — NIC 接收路径、TCP 状态机、conntrack 表耗尽、Netfilter 挂钩
- 存储 I/O – fsync() 持久性堆栈、blk-mq 调度程序、NVMe 队列深度
- systemd — After= 与 Requires=、Type=notify、日志速率限制、套接字激活
- Linux 安全模型 – 五种功能集、用户命名空间、SELinux、seccomp-bpf
- 可观测性 – perf_events、eBPF、bpftrace、火焰图解释
- 来自第一原则的容器 – 命名空间、cgroup v2 记账、overlayfs、PID 1
- 生产调优参考 – 每个重要的 sysctl,以及特定于工作负载的配置文件
真实案例研究
- 14 个数据库服务器在修补后无法启动 – 完整 /boot 上的零字节 initramfs
- 负载均衡器连续 3 天下降了 3.1% 的流量 – conntrack 表处于 2002 年的默认值
- 在没有更改硬件的情况下,PostgreSQL 的吞吐量提高了 947% – NVMe 队列深度修复
- Java 服务 100% CPU,其中 88% 对分析器不可见 – 内核空间中的 THP 扫描器
- 容器在 287MB 堆和 64GB 可用 RAM 处被 OOM 终止 – 页面缓存计入 cgroup 限制
还包括
- 按症状诊断命令、sysctl 快速参考和 33 术语 X 射线术语表
- 🧠 心智模型 · ⚠️ 常见错误 · 🔍 深刻见解 · 🛠 每章都有制作技巧
- 内核版本:Linux 6.1 以及 RHEL 9.2 发行说明
如果您在生产环境中运行 Linux,并且曾经在本应花费五分钟的故障上花费了三十多分钟的时间,那么这就是您在故障发生之前需要的地图。
其他信息
- 收录者
- Downloading
- 发布日期
- 8月21日
- 类别
- 计算机与技术
- 软件名称
- Linux 基础
- 探索
- Ebooks
- 语言
- 英语
- 上传者
- Maxine Legros
- 格式
- True ePub
- 页码
- 172
- 作者
- Eslam Wahba
- 版本
- 2026
- 出版商
- Amazon KDP
下载版本
| 版本 | 兼容平台 | 语言 | 大小 | 更新时间 | 下载 |
|---|---|---|---|---|---|
| LB 8356 | 英文 | 1.3MB | 2026-03-16 |
温馨提示:本资源来源于互联网,仅供参考学习使用。若该资源侵犯了您的权益,请联系我们处理。


评分及评论
暂无评分
来评个分数吧