- 博客(166)
- 资源 (1)
- 收藏
- 关注
原创 看不懂Oops 里的 pc/lr?AArch64 寄存器、异常级与Linux 调用约定讲透
看不懂 Oops 里的 pc/lr?AArch64 寄存器、异常级与 Linux 调用约定讲透 内核 Oops 里一行 ,GDB 单步却对不上 C 源码;用户态 看到 不知参数在哪;写驱动内联汇编被 搞晕——根因常是 **AArch64 寄存器布局、异常级 EL、AAPCS64 调用约定与 syscall 路径** 没建立地图。本文从 **X0–X30/SP/PC、LR、NZCV → EL0–EL3 → AAPCS64 → SVC 系统调用 → 内联 asm 约束 → arch/arm64/kernel/e
2026-09-13 08:26:25
1
原创 登录就能干活?从Shell、进程、文件系统到/proc 排障入口讲透
登录就能干活?从 Shell、进程、文件系统到 /proc 排障入口讲透 SSH 登上生产机,磁盘满、服务起不来、网络 ping 通 curl 挂——若只会 ,每次故障都像摸黑。Linux 运维的基本盘不是背命令表,而是 **用户空间如何组织:Shell 解析命令 → 进程与信号 → FHS 与挂载 → systemd 拉服务 → 网络与日志 → /proc /sys 观测**。本文按这条线讲透 **装完系统后第一次排障该看哪**,锚点覆盖 、、、/、、;glibc 与 busybox 用户态差异点到为止,
2026-09-13 08:23:28
25
原创 deadline 错过一次就翻车?硬实时/软实时、延迟预算与可调度性一条线讲透
deadline 错过一次就翻车?硬实时/软实时、延迟预算与可调度性一条线讲透 产线 PLC 周期 1 ms,某次采样晚了 3 ms 就撞机;车载域控标「硬实时」却跑在默认 Linux 上,cyclictest Max 偶尔跳到 10 ms;RTOS 任务优先级拍脑袋,联调时低优先级反而饿死高优先级——根因往往不是「再买一个更快的 CPU」,而是 **硬/软/ firm 实时语义没分清、延迟预算没拆、可调度性没验**。本文从 **实时定义与 deadline 语义 → WCET 与延迟来源 → 速率单调/E
2026-09-13 08:20:34
1
原创 Guest很慢却不是缺 CPU?从 vCPU 超卖、CPU pinning、巨页到IO线程调优
Guest 很慢却不是缺 CPU?从 vCPU 超卖、CPU pinning、巨页到 IO 线程调优 里 Guest 的 vCPU 利用率只有 30%,业务却像「缺 CPU」一样卡顿;宿主机 CPU 明明还有余量, 却长期偏高;绑核后延迟反而变大;开了 和 hugepage,磁盘 P99 仍被 IO 线程拖成长尾——这类现象很少是「再塞两个 vCPU 就能好」,而出在 **瓶颈分类错了**:CPU 超卖与调度抖动、内存翻译与 TLB、virtio/vhost 数据面、以及 **pinning / NUMA
2026-09-13 08:17:34
7
原创 容器要强隔离又要像docker run?Kata/gVisor/Firecracker 沙箱运行时怎么选
容器要强隔离又要像 docker run?Kata/gVisor/Firecracker 沙箱运行时怎么选 多租户平台跑用户提交的镜像: 一放开就等于宿主机 root;内核 CVE 在容器场景是 **宿主机全局风险**;合规要求「等价 VM 隔离」但运维只肯接 **CRI/OCI、kubectl、现有镜像仓库**——传统 runc 容器在 **隔离** 与 **密度/启动速度** 之间缺中间层。本文沿 **共享内核风险 → 轻量 VM 容器思路 → Kata / gVisor / Firecracker 架
2026-09-13 08:14:33
14
原创 VM 和容器差在哪一层?从Hypervisor、特权级到隔离边界一条线讲透
VM 和容器差在哪一层?从 Hypervisor、特权级到隔离边界一条线讲透 面试里常说「容器是轻量 VM」——可容器里 能 insmod、宿主机和 Guest 共用 时隔离语义完全不同;云厂商开 VM 报 、BIOS 里没开 VT-x、嵌套虚拟化失败——这些也不是「装个 VirtualBox 就好」,而是 **CPU 特权级 / Hypervisor 类型 / 硬件辅助扩展** 在某一环没对齐。本文从 **虚拟化动机 → Type1/Type2 Hypervisor → CPU/内存/IO 虚拟化鸟瞰 →
2026-09-13 08:12:39
19
原创 单机 docker run 管不住了?从编排需求、期望状态到调度/自愈闭环讲透
单机 docker run 管不住了?从编排需求、期望状态到调度/自愈闭环讲透 生产上 堆了几十个容器,某台宿主机磁盘满、某进程 OOM 被 kill 后没人补位;滚动发版要手工 ,漏一台就是灰度事故;Compose 文件在单机好用,换三台机器 IP 硬编码、负载均衡靠 nginx 手工改 upstream——这些不是「运维不够细心」,而是 **单机容器运行时只解决「把进程装进 namespace」**,不解决 **跨节点放置、期望状态持久化、故障替换、服务发现与滚动策略**。本文沿 **声明式期望状态 →
2026-09-13 08:10:57
25
原创 CrashLoopBackOff 从哪来?Pod、Pause 沙箱、kubelet syncPod 到容器运行时讲透
CrashLoopBackOff 从哪来?Pod、Pause 沙箱、kubelet syncPod 到容器运行时讲透 显示 ; 卡半小时;业务容器起来了但 ; 只能看到主容器、Sidecar 日志要加 ——这些现象都落在 **Pod 作为原子调度单元 → pause/infra 沙箱 → kubelet syncPod → CRI(containerd/CRI-O)** 这条链上。本文按 的 与 CRI 契约,把 Phase/Condition、探针、QoS、Volume 挂载与排障串成闭环。 阅读地图 1
2026-09-13 08:09:11
35
原创 Pod Pending 找不到凶手?kube-apiserver、etcd、scheduler、controller-manager分工讲透
Pod Pending 找不到凶手?kube-apiserver、etcd、scheduler、controller-manager 分工讲透 长期 ; 有 Ready 节点但调度不上;apiserver 间歇 503;etcd 报警 ——控制平面五个组件(apiserver、etcd、scheduler、controller-manager、cloud-controller-manager)加 Node 侧 kubelet/kube-proxy,任意一环证书过期、选主失败或资源耗尽都会表现为「Worklo
2026-09-13 08:07:37
126
原创 kubectl apply 了却不生效?声明式API、etcd与控制器对账一条线讲透
kubectl apply 了却不生效?声明式 API、etcd 与控制器对账一条线讲透 返回 , 里 仍是 ;改完 过一会儿又被改回去;同一 YAML 两人 apply 后字段互相覆盖——这些不是「K8s 抽风」,而是 **声明式 API 把期望状态写进 etcd → 控制器/Informer 异步对账 → 各组件写回 status** 这条链上某一环没按你想的方式工作。本文按 真实路径,从 API Object、REST 存储、apply/SSA、RBAC 到 Deployment 控制器 reconc
2026-09-13 08:06:10
2
原创 cyclictest 毛刺从哪来?从ftrace、latencytop、perf到IRQ/调度延迟定位
cyclictest 毛刺从哪来?从 ftrace、latencytop、perf 到 IRQ/调度延迟定位 空载 **cyclictest Max 18 µs**,一上产线负载就 **800 µs~数 ms**; 直方图拖出长尾; 却只看到无关符号——这类「测得出、说不清」的毛刺,根因往往不在「再开一次 PREEMPT_RT」,而在 **未把延迟拆成 IRQ / 关抢占 / 调度 / timer / 干扰核** 几段分别钉死。实时性能分析的核心不是堆工具名,而是:**先量化(cyclictest/osla
2026-09-12 08:22:06
76
原创 MCU上FreeRTOS 够用还是上PREEMPT_RT?嵌入式实时从中断到调度对照讲透
MCU 上 FreeRTOS 够用还是上 PREEMPT_RT?嵌入式实时从中断到调度对照讲透 电流环偶发超 80 μs、网关采集线程 P99 抖到 5 ms、换了「实时 Linux」后 cyclictest Max 仍上千微秒——三类现场都在问同一句话:**MCU 上 FreeRTOS/Zephyr 够用,还是该上带 PREEMPT_RT 的嵌入式 Linux?** 很多人只比「谁更实时」,却跳过中断上下文长度、Tickless 对抖动的影响、优先级继承是否真正打开、Linux 侧 threaded IR
2026-09-12 08:20:43
42
原创 CPU 100% 却找不到凶手?从ps/top、/proc、信号到systemd cgroup 排透
CPU 100% 却找不到凶手?从 ps/top、/proc、信号到 systemd cgroup 排透 告警里写「CPU 100%」, 第一屏却全是 idle,或者某个 只有个位数的进程把整机拖死——这类故障几乎都不是「再看一眼 top 就行」。真正的凶手可能藏在 **短生命周期子进程**、**不可中断 D 状态**、**软中断/kworker**、**systemd slice 配额**,或 **OOM killer 刚杀完又被重启拉起**。运维侧要把 读成「进程真相」、把 读成「时间窗采样」、把信号与
2026-09-12 08:19:30
4
原创 Guest 逃到Host?从隔离边界、IOMMU/VFIO 到SEV/TDX 与加固清单讲透
Guest 逃到 Host?从隔离边界、IOMMU/VFIO 到 SEV/TDX 与加固清单讲透 「Guest 里打了个洞,Host 进程就变成 root」「SR-IOV 透传后 DMA 扫穿整机内存」「嵌套虚拟化一开,攻击面翻倍」「开了 SEV 却还在用默认 QEMU 设备模拟」——虚拟化安全事故很少出在「有没有开 KVM」,而出在 **隔离边界画在哪一层、设备 DMA 有没有被 IOMMU 管住、用户态模拟器(QEMU)权限是否被收束、机密计算是否真的把 Host 踢出信任域**。本文沿一条可验证主线:
2026-09-12 08:17:54
18
原创 Dom0挂了整机就挂?Xen Hypervisor、Dom0/DomU 与xl/xenstore 讲透
Dom0 挂了整机就挂?Xen Hypervisor、Dom0/DomU 与 xl/xenstore 讲透 里 Dom0 状态变成 、整机所有 DomU 一起失联; 卡住、 起不来导致 HVM 黑屏;网卡后端 在 xenstore 里 却永远连不上——这类故障几乎都不在 Guest 镜像本身,而出在 **Xen Hypervisor 调度域、Dom0 特权面、xenstore 配置树、xl/libxl 工具栈、event channel / grant table 半虚拟 I/O、以及 HVM 侧 qemu
2026-09-12 08:16:36
129
原创 为什么 Guest 跑特权指令就 VM-Exit?全虚拟化、半虚拟化与硬件辅助一条线讲透
为什么 Guest 跑特权指令就 VM-Exit?全虚拟化、半虚拟化与硬件辅助一条线讲透 同一份镜像:在一台机器上近裸机,在另一台上 刷屏、磁盘像插了软盘;换成「未改内核的 Windows」又突然只能走全模拟设备;再上 Xen 老集群,有人谈 PV、有人谈 HVM,名词对不上路径。根因往往不是「虚机开没开」,而是 **Guest 是否知情、敏感操作走 trap-and-emulate / 二进制翻译 / 硬件辅助 / 半虚拟化(PV)哪一条**,以及 CPU、内存、IO 三条线上落点是否一致。本文把四条技术
2026-09-12 08:15:10
68
原创 容器里拿到root 就等于宿主机沦陷?Capability、seccomp、AppArmor与user ns 讲透
容器里拿到 root 就等于宿主机沦陷?Capability、seccomp、AppArmor 与 user ns 讲透 进容器 显示 ,很多人第一反应是「完了,宿主机也完了」——然后又有人说「没事,有 Namespace」。两边都偏了:**容器内 uid 0 在默认 rootful 部署下,往往就是宿主机 uid 0 的同一套凭证**;Namespace 只改「看见什么」,不自动砍特权。真正把「容器 root」从「宿主机 root」撕开的,是 **Capability 降权、seccomp 系统调用白名单
2026-09-12 08:13:22
133
原创 容器一删数据没了?Volume、bindmount 与graphdriver 一条线讲透
容器一删数据没了?Volume、bind mount 与 graphdriver 一条线讲透 之后数据库目录空了;明明写了 ,容器重建却回滚到镜像里的空目录; 显示根分区还有空间,Docker 却报 ——根因多半不在应用,而在 **可写层(graphdriver/snapshotter)与 Volume / bind / tmpfs 三条持久化路径被搞混**。本文按 Moby volume、 graphdriver、历史 、containerd snapshotter 的真实路径与命令,把「写进容器的字节到
2026-09-12 08:11:42
189
原创 镜像为什么越来越大?从Dockerfile、layer 到content-addressable store 讲透
镜像为什么越来越大?从 Dockerfile、layer 到 content-addressable store 讲透 里同一服务从几百 MB 涨到几 GB;改一行业务代码却整层缓存失效; 之后 尺寸几乎不动;生产扫出密钥却说「层里早就删了」——根因多半不在业务二进制本身,而在 **Dockerfile 指令如何落成 OCI layer、BuildKit 如何算缓存键、content-addressable store 如何按 digest 存 blob、overlay 只读层为何删不掉下层字节**。本文沿
2026-09-12 08:09:55
117
原创 docker run 起不来?从dockerd、containerd 到runc 一条线讲透
docker run 起不来?从 dockerd、containerd 到 runc 一条线讲透 ; 空的但 一堆还在; 看得到、 却报 not found;升级后 报 ——这些不是「Docker 玄学」,而是 **CLI → dockerd(Moby)→ containerd → containerd-shim-runc-v2 → runc → 内核 namespaces/cgroup** 这条链某一环断了。本文按真实上游路径(moby/moby、containerd/containerd、opencon
2026-09-12 08:08:37
110
原创 容器 ping 不通、`-p` 端口进不去?Docker bridge、veth、docker0 与 iptables/nft DNAT 一条线讲透
容器 ping 不通、 端口进不去?Docker bridge、veth、docker0 与 iptables/nft DNAT 一条线讲透 同 bridge 上两个容器互 ping 失败;宿主机 无响应但容器内服务是好的;K8s 换了 CNI 后又出现「只有 ClusterIP 通、NodePort 不通」——大半不是应用挂了,而是 **netns + veth pair + linux bridge(docker0)+ iptables/nft DNAT/MASQUERADE** 这条链某环断了。本文按
2026-09-11 08:15:03
7
原创 容器不是轻量VM:从 Namespace 隔离视角到Cgroup 限额、rootfs/pivot_root 与 runc启动链
容器不是轻量 VM:从 Namespace 隔离视角到 Cgroup 限额、rootfs/pivot_root 与 runc 启动链 一秒起来,有人就说「容器是轻量级虚拟机」——直到主机 被容器里的 root 扫遍、 误伤宿主机、或 设了仍把邻居 OOM。根因不是 Docker 魔法,而是 **同一颗内核上的 Namespace 隔离视角 + Cgroup 资源账本 + 独立 rootfs(pivot_root)+ OCI/runc 装配顺序**。本文按内核 、、 与 runc 真实路径,把「看见什么 /
2026-09-11 08:13:44
63
原创 容器层为什么改不掉?OverlayFS 从lower/upper/work 到whiteout 与排障
容器层为什么改不掉?OverlayFS 从 lower/upper/work 到 whiteout 与排障 镜像里明明有 ,容器内改完一重启又变回去; 掉基础镜像里的文件,下层目录里其实还在;磁盘突然报 , 却显示根分区还很空——根因多半在 **OverlayFS 的 lower/upper/work、whiteout/opaque、metacopy** 与 Docker 分层存储,而不是应用自己「改不进文件」。本文按内核 真实路径,从联合挂载语义讲到容器 layer 与排障,读完能在本机用 复现整条链路。
2026-09-11 08:12:23
51
原创 进程隔离看得见却进不去?Linux Namespace 从 clone/unshare 到/proc/PID/ns 排障
进程隔离看得见却进不去?Linux Namespace 从 clone/unshare 到 /proc/PID/ns 排障 能看见 、、 这些软链, 却报 ;容器里 只有自己,宿主机却能看到全部进程; 在容器内只有 ,宿主机网卡一个都没有——这些不是「魔法」,是 **Namespace 把全局内核对象换成了按进程可见的视图**。本文从 、、、/ 一直讲到 runc 建仓与排障,路径对齐 Linux 内核真实源码,读完能在本机用 // 验证。 阅读地图 1. **第一层:隔离模型与入口**——解决「Names
2026-09-11 08:11:03
120
原创 AI 操作系统设计文档:国内外主流 OS 对比、优缺点综合与AI 原生架构方案
AI 操作系统设计文档:国内外主流 OS 对比、优缺点综合与 AI 原生架构方案 「再做一个 Linux 发行版」已经不够:桌面要懂用户意图,云边要调度模型与算力,端侧要在隐私约束下完成推理。要设计真正的 **AI 操作系统(AI-OS)**,不能凭空画饼,必须先看清 Windows、macOS、Linux、Android/iOS、ChromeOS,以及鸿蒙、openEuler、统信 UOS、openKylin 等国内外主流系统各自赢在哪里、输在哪里,再 **吸收优点、显式规避缺点**,把 AI 从「应用插
2026-09-11 01:30:18
133
原创 Yocto 完整解析:原理、从零搭建环境与配方/配置文件怎么改
Yocto 完整解析:原理、从零搭建环境与配方/配置文件怎么改 第一次接触 Yocto,常见卡点不是「不会敲 bitbake」,而是分不清 **Yocto / OpenEmbedded / BitBake / Poky** 各自管什么;、、、、 改哪一层才生效;以及构建失败时该看 还是 。本文以 **Yocto Project 5.0(Scarthgap)/ Poky** 为主线,从原理到从零环境、再到编辑配置与配方,按层讲透一条可动手验证的闭环。版本差异处会标明「以当前 release 文档为准」。 阅读
2026-09-11 01:23:26
228
原创 ATF / TEE / REE 与 EL 完整篇:TrustZone 边界→软件栈→ 异常级→ 切换路径(一条主线讲透)
ATF / TEE / REE 与 EL 完整篇:TrustZone 边界 → 软件栈 → 异常级 → 切换路径(一条主线讲透) 板子上开了 TrustZone, 却找不到 ;CA 调 返回 ;SMC 在 EL3 直接 panic——根因往往不在应用层,而在 **硬件 S/NS 边界、TF-A BL31 调度、GIC 分组、内核 optee 驱动与 OP-TEE 版本** 没对齐。本文沿一条主线讲透:**TrustZone 把什么隔开 → ATF/TEE/REE 各干什么 → EL 与世界如何正交 → CA
2026-09-11 01:18:46
137
原创 PCI与PCIe 完整篇:硬件拓扑→ 报文协议→配置/BAR → Linux 驱动(一条主线讲透)
PCI 与 PCIe 完整篇:硬件拓扑 → 报文协议 → 配置/BAR → Linux 驱动(一条主线讲透) 板卡 能看到设备,BAR 却全是 0;链路训练卡在 Detect、RC 下挂 EP 永远枚举不到;驱动 probe 里 成功但 全 0xff——这类问题往往不在驱动写法,而在 PCI/PCIe 硬件分层、配置空间语义、资源分配顺序没对齐。PCI 是并行共享总线;PCIe 是点对点串行协议栈,但软件仍通过同一套配置空间与 BAR 抽象设备。本文沿一条主线:硬件拓扑 → TLP 报文 → 配置/BAR
2026-09-11 01:17:41
55
原创 ATF/ TEE / REE 与ARM 异常级别EL 安全体系完整篇:TrustZone硬件到 SMC 进OP-TEE的全链路
ATF / TEE / REE 与 ARM 异常级别 EL 安全体系完整篇:TrustZone 硬件到 SMC 进 OP-TEE 的全链路 板子上开了 TrustZone, 却找不到 ;CA 调 返回 ;SMC 在 EL3 直接 panic——根因往往不在应用层,而在 **NS/S 世界划分、TZASC 内存隔离、TF-A BL31 调度、GIC Group 路由** 没对齐。本文从 SoC 硬件安全组件讲起,经 TF-A 启动链、EL0–EL3 特权模型,追到 Linux → SMC → BL31 → O
2026-09-11 00:48:40
287
原创 PCI与PCIe 硬件原理、配置空间/BAR 与 Linux 驱动完整篇:从 LTSSM、TLP 到 ECAM 与probe
PCI 与 PCIe 硬件原理、配置空间/BAR 与 Linux 驱动完整篇:从 LTSSM、TLP 到 ECAM 与 probe 板卡 能看到设备,BAR 却全是 0;链路训练卡在 Detect、RC 下挂 EP 永远枚举不到;驱动 probe 里 成功但读寄存器全 0xff——这类问题往往不在驱动写法,而在 PCI/PCIe 硬件分层、配置空间语义、资源分配顺序没对齐。PCI 是并行共享总线;PCIe 是点对点串行协议栈,但软件仍通过同一套配置空间与 BAR 抽象设备。本文从总线演进、拓扑与 LTSSM
2026-09-11 00:47:49
67
原创 实时通信:共享内存、消息队列与确定性数据路径
实时通信:共享内存、消息队列与确定性数据路径 实时任务之间交换数据,若走错误路径(阻塞分配、无界队列、锁优先级反转),再快的 CPU 也抖。本文聚焦常见 IPC 在实时场景的取舍。 源码锚点 路径 / 手册 作用 ------------- ------ 共享映射 POSIX 消息队列 用户态快速锁 futex API 调用链 重点知识 优先共享内存 + 预分配 启动时分配环形缓冲,运行中避免 。用序列号/位图处理覆盖策略。 消息队列 可设消息数与长度上限,避免无界增长。注意信号通知与优先级。 反模式 在
2026-09-10 01:26:00
8
原创 实时 Linux:PREEMPT_RT、延迟来源与观测
实时 Linux:PREEMPT_RT、延迟来源与观测 软实时/硬实时需求里,主线内核默认抢占往往不够。**PREEMPT_RT** 把自旋锁等路径改成可抢占,降低最坏延迟,但要配合隔离核、关机外干扰与实测。 源码锚点 路径 / 手册 作用 ------------- ------ 调度说明 调度实现 等 设调度策略 调用链 重点知识 延迟从哪来 中断下半部、关抢占临界区、同核干扰、电源管理休眠、SMI(x86)、显卡锁。RT 内核降低部分最坏情况,不能替代 dual-OS/AMP 硬实时方案。 观测 实践
2026-09-10 01:24:57
24
原创 Linux 网络配置:iproute2、DNS 与连通性排障
Linux 网络配置:iproute2、DNS 与连通性排障 「有地址不能上网」按层拆:**链路 → 地址 → 路由 → DNS → 防火墙 → 对端**。工具以 / 为主。 源码锚点 路径 / 手册 作用 ------------- ------ 地址/路由/链路 套接字 systemd-resolved DNS(可能被托管) 调用链 重点知识 静态与 DHCP NetworkManager、systemd-networkd、ifupdown 三选一为主,避免多网络管理器互踩。 常见坑 有 IPv6 无
2026-09-10 01:23:57
63
原创 Linux 磁盘管理:分区、文件系统、挂载与扩容
Linux 磁盘管理:分区、文件系统、挂载与扩容 磁盘满、只读挂载、扩容后系统看不见空间,步骤要固定:**分区 → 文件系统 → fstab/挂载 → 监控 inode 与只读原因**。 源码锚点 路径 / 手册 作用 ------------- ------ 分区 造/检文件系统 挂载命名空间视图 持久挂载 块设备拓扑 调用链 重点知识 fstab 用 UUID/PARTUUID,避免设备名漂移: 扩容思路 虚拟盘先在平台扩容 → / → /。XFS 通常不能在线缩减。 只读与只读根 寻 I/O erro
2026-09-10 01:22:55
38
原创 Linux 权限:模式位、ACL 与capability
Linux 权限:模式位、ACL 与 capability 「加了 sudo 仍失败」「服务能读文件用户不能」,要分清 **DAC 模式位、POSIX ACL、capability、安全模块** 哪一层在拒绝。 源码锚点 路径 / 手册 作用 ------------- ------ 基础 DAC ACL 细粒度特权 提权策略 调用链 重点知识 模式位与目录执行位 目录 表示可进入;无 时即使有 也无法 。共享目录常用 (sticky)防互删。 ACL 拷贝时注意 是否保留 ACL。 capability
2026-09-10 01:21:55
40
原创 Linux 性能监控:CPU、内存、IO 与常用工具
Linux 性能监控:CPU、内存、IO 与常用工具 负载高不一定是 CPU 忙,也可能是 **IO 等待、软中断、内存回收**。先建立「看什么指标」,再用工具验证。 源码锚点 路径 / 手册 作用 ------------- ------ 内核计数 / 交互观察 sysstat 采样分析 调用链 重点知识 一分钟定位 高 → IO; 高 → 中断/软中断。 看 ,不要只看 。 进程级 深一点 嵌入式无 perf 时,退回 与应用内埋点。 常见误判 负载 = 可运行+不可中断睡眠队列长度,不等于「CPU 百
2026-09-10 01:20:57
135
原创 Linux 防火墙:nftables 与iptables 兼容层
Linux 防火墙:nftables 与 iptables 兼容层 端口「本机 curl 通、外网不通」、Docker 改表导致规则错乱,需要先分清 **nftables 原生集合** 与 **iptables-nft 兼容**,再谈策略。 源码锚点 路径 / 手册 作用 ------------- ------ nftables 命令 兼容前端 常见落盘 集合概念 放行本机 SSH 示例(示意): 调用链 重点知识 查清当前用哪套 策略设计 默认策略与显式 accept 成对出现。 放前面,避免回包被丢。
2026-09-10 01:19:58
127
原创 Linux 日志管理:journald、rsyslog 与 logrotate
Linux 日志管理:journald、rsyslog 与 logrotate 「服务挂了但日志没有」、磁盘被日志写满、容器里找不到 journal,根因通常是 **存储后端、持久化目录、速率限制与轮转策略** 没对齐。 源码锚点 路径 / 手册 作用 ------------- ------ 查询 journal 持久化、大小上限 主配置 传统 syslog 文本日志轮转 调用链 重点知识 持久化 / 防止日志吃光盘。 常用查询 与 rsyslog 不少发行版 journald 仍转发到 rsyslog,
2026-09-10 01:18:57
151
原创 Linux 定时任务:crontab、anacron 与systemd timer
Linux 定时任务:crontab、anacron 与 systemd timer 定时任务「漏跑、跑两次、时区错乱」,常见于 **cron 与 systemd timer 混用、休眠机器、UTC/本地时混淆**。本文对照三类机制,给出选择与排障路径。 源码锚点 路径 / 手册 作用 ------------- ------ 用户任务表 / 系统 cron 目录 非 7×24 主机补跑 timer 单元 日历与单调时间表达式 timer 示例: 配套 写实际 。 调用链 重点知识 crontab 要点 默
2026-09-10 01:18:01
134
原创 Linux systemd 服务管理:从unit 文件到systemctl 启停与排障
Linux systemd 服务管理:从 unit 文件到 systemctl 启停与排障 服务「装了却起不来」、开机偶发失败、改完 unit 不生效,多数落在 **依赖顺序、Type 类型、环境变量与 drop-in 覆盖**。本文把 systemd 服务管理从 unit 结构讲到 排障,便于对照本机验证。 源码锚点 路径 / 手册 作用 ------------- ------ Service 单元字段语义 通用单元、依赖、条件 启停、状态、编辑 管理员单元与 drop-in 软件包默认单元 最小 se
2026-09-10 01:16:53
181
自己写的可用的协程系统
2019-06-13
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅