- 博客(984)
- 资源 (83)
- 收藏
- 关注
原创 eBPF 驱动的云原生网络变革:Cilium 的前世今生与全机套接字迭代技术演进
从全局来看,Cilium 已经从早期单纯的 CNI 网络插件,蜕变成为掌控云原生数据平面安全、路由与可观测性的基础设施核心。而 Jordan Rife 在 LSFMM+BPF Summit 上引发的关于“全机 Socket 迭代器”的探讨,正是 Cilium 与 Linux 内核深度融合、相互推动演进的缩影。随着单节点容器密度的持续攀升,如何在 BPF 层面兼顾跨命名空间管理的效率与内核锁语义的安全性,将成为推动下一代 Linux 内核网络子系统升级的核心驱动力之一。
2026-09-03 13:27:55
477
1
原创 解锁用户空间文件系统:FUSE 架构全景解析与 2026 峰会前沿洞察
<think>我们需要根据用户要求生成一个不超过150字的文章摘要。用户提供了长篇内容,但请求是“根据以下内容,生成≤150字的文章摘要”,这意味着我们需要从给定文本中提取核心信息,用中文写成摘要,长度不超过150字。注意:要确保摘要涵盖主要点,简洁。 内容提到FUSE基础架构与使用,以及2026 LSFMM/BPF峰会关于FUSE的最新动态。核心是FUSE允许用户空间文件系统,降低成本,并介绍了架构、用法、历史;第二部分是维护痛点、性能优化、fusex新API、跨平台问题等。但摘要需压缩到15
2026-09-03 06:46:35
297
原创 剥离历史包袱与极致资源调优:Linux 内核最新演进前沿
<think>我们需根据内容生成≤150字摘要。聚焦两大核心:FUSE内存优化与进程创建API重构。表达进展和方向。注意字数。</think>Linux内核社区近期聚焦两大方向:一是优化FUSE与io_uring结合的内存分配,解决缓冲区按最大规格预分配导致的浪费问题,提出单Ring多尺寸与多Ring方案;二是Li Chen提出“进程构建器”API,以pidfd系列调用替代传统fork/exec,实现零拷贝建进程。整体呈现剥离历史包袱、追求极致效率的演进趋势。
2026-09-02 12:34:34
410
原创 从 2026 LSFMM/BPF 峰会看 eBPF 生态演进:技术变革、工具全景与资源泄漏诊断实战
<think>我们根据要求,需要生成≤150字的文章摘要。内容涵盖eBPF技术崛起、峰会讨论、库生态、Rust、LLM、工具、内存泄漏实战等。需要精炼概括。输出摘要。</think>eBPF正变革Linux系统编程与可观测性。峰会聚焦BPF库生态:缺少标准包管理器,Rust或成契机,LLM将影响代码复用。现有工具链涵盖libbpf、bpftrace、Cilium等,并可用eBPF排查内存泄漏。未来eBPF门槛降低,成为故障诊断底层利器。
2026-09-02 06:43:35
336
原创 VFIO 架构演进与内核热更新(Live Update)融合实践
<think>我们需要根据用户要求,生成≤150字的文章摘要。内容是关于VFIOPCILiveUpdate机制的文章。需要提炼核心要点:背景问题、VFIO架构、LiveUpdate框架、融合机制、测试与展望。摘要需简洁,≤150字。注意中文字数。我们开始写。</think>VFIO设备直通过程中,内核升级(kexec)会导致业务中断。Linux引入VFIOPCILiveUpdate机制,结合KHO/LUO通用框架与VFIO架构,实现设备直通场景下的宿主机无感热升级。该机制通过状态序列
2026-09-01 11:45:25
750
原创 深入解析 eventfd:从底层原理到 LiveUpdate 热更新机制及其测试策略
<think>我们只需要根据用户要求生成≤150字的文章摘要。用户提供了长文,需要提取关键点。摘要要简洁,概括eventfd架构、LiveUpdate应用和测试验证。注意字数限制。</think>eventfd 是 Linux 高效事件通知机制,基于内核计数器实现零拷贝、极简上下文,原生适配 epoll,成为异步框架基石。在热更新中,通过 SCM_RIGHTS 传递 FD,配合冻结、提取、恢复流程,实现 eventfd 状态平滑迁移。结合单元、集成与高并发压测,确保升级零丢包、零感知
2026-09-01 06:33:17
362
原创 突破零停机演进:Linux 内核 Live Update Orchestrator (LUO) 架构设计与热升级演进
Live Update Orchestrator (LUO) 通过精细化的内存保留控制、严格的 uABI/Seals 安全继承,以及防重入的状态机设计,补齐了 Linux 内核无缝升级的重要拼图。未来随着 IOMMUFD 等模块与 LUO 的进一步深化集成,宿主机内核零停机热升级将成为云原生基础设施的标准能力。
2026-08-31 08:50:38
376
原创 Linux 内核编码规范之争:BUG_ON()、WARN_ON() 与 panic_on_warn 的两难抉择
在 Linux 内核开发中,如何处理“理论上绝不应该发生、但一旦发生就意味着严重错误”的异常条件,一直是社区争论不休的话题。从最初被滥用的BUG_ON(),到后来作为替代品推行的WARN_ON(),再到如今针对WARN_ON()的限制与反思,内核开发者们在“保持系统可用性”与“暴露严重隐患”之间展开了一场长达数年的博弈。
2026-08-31 07:13:43
642
原创 Linux 内核热更新的解药:LUO (Live Update Orchestrator) 架构全解析
LUO 补丁集为 Linux 内核的热更新补上了关键的一块拼图。通过Session 管理机制、FLB 共享状态引用计数、shmem 映射冻结以及与 KHO 框架的深度联动,LUO 建立起了一套安全、可回滚、支持复杂硬件与内存保留的内核级编排架构。这不仅意味着云计算 Hypervisor 升级时的虚拟机“无感切换”成为了可能,也为未来大规模大内存应用(如内存数据库)的极速升级重启奠定了坚实的技术基础。
2026-08-27 10:36:00
391
原创 重构 Kexec Handover:Linux 内核如何将 KHO 打造为无状态、可重入的跨重启交接基石
这套补丁集是 Linux 内核无缝更新技术演进中的关键一步。通过将 KHO 从繁重、僵硬的状态机中解放出来,使其具备了无状态、可重入以及高动态性的特点。这不仅极大地简化了内核驱动的开发难度,更为上层的提供了坚实、灵活的底层支撑,使云厂商和超大规模数据中心在进行内核热升级时,能够以更低的开销、更少的停机时间和更强的确定性完成系统迭代。
2026-08-27 08:43:46
307
原创 为什么给 Linux 添加新接口这么难?从“创建并打开目录”的内核争论谈起
Linux内核开发中,用户空间接口(ABI/API)的设计与修改被视为最高风险决策。内核铁律"永不破坏用户空间"要求接口必须永久兼容,即便原始设计存在缺陷。文章通过"创建目录"功能的设计争议,剖析了四大核心挑战:1)接口自发现机制的重要性,2)修改现有API与新增系统调用的权衡,3)跨UNIX系统的兼容性问题,4)安全机制(如Seccomp)对新接口的阻碍。这些争论体现了内核开发者对接口设计近乎苛刻的谨慎态度,因为每个决策都将成为不可更改的"化石"
2026-08-24 12:49:41
298
原创 破解 1GiB 巨页与 KHO 冲突:Linux 内核 Extended Scratch 机制与 Radix 树摘要算法深度解析
既然巨页不能在初始 Scratch 中分配,Early Boot 阶段去哪里找足够的物理内存?Patchset 引入了[ 原始 Preserved Radix Tree ] ──(单次遍历)──► [ Digest Radix Tree (1GiB 粒度) ](包含分散的 4KB, 2MB 保留页) (按 1GiB 物理块汇总的位图树)│▼[ 遍历 Digest 树找到空隙 ]│▼[ 标记为 Extended Scratch ]单次遍历与摘要(Digest)
2026-08-24 11:13:40
470
原创 深入理解 Linux 内核 BTF(BPF Type Format):从演进历史到内联函数追踪的未来
具有不同的标志,指定其为一个常量,随后是该常量的值。Alexei Starovoitov 询问位置节条目将按什么顺序存储,因为内核在设置追踪时必须对其进行搜索以找到正确的条目。起初,Maguire 认为按调用点的地址排序最好,但在研究了数据的使用方式后,他决定改为按。
2026-08-23 13:38:51
311
原创 彻底搞懂 KHO:Linux 跨内核热重载的落地阵痛与重构之路
KHO(Kexec HandOver)作为 Linux 内核实现无感升级的关键技术,其演进过程完美展示了 Linux 社区对底层代码质量、内存物理真实性以及系统可靠性的苛刻要求。从消除语义模糊、理顺参数变更,到修复 kdump 内存挤爆与高阶页 refcount 错乱,这一系列重构正在为 KHO 迈向大规模生产环境铺平道路。
2026-08-23 13:23:01
353
原创 将 RDMA 引入容器:Soft-RoCE (RXE) 网络命名空间支持深度解析
容器通过 Linux 内核的cgroup(资源限制)、chroot(文件系统隔离)以及namespace(视图隔离)来实现微服务环境。其中,网络命名空间(Net Namespace)为每个容器提供了独立的网络协议栈,包括独立的网络设备(如eth0veth)、IP 地址、路由表以及 Socket 端口池,实现容器间网络流量的严格隔离。通过引入与动态 Socket 绑定机制,该改进使得 Soft-RoCE (RXE) 彻底脱离了宿主机限制,使 RDMA 能够在隔离的容器环境中作为“一等公民”平滑运行。
2026-08-22 04:17:48
596
原创 GCCRS 突破与 Rust 入核:Linux 工具链的重大变革
从内核内部 Safe 抽象层的建立,到 GNU 编译工具链 GCCRS 的底层突破,Rust 在 Linux 生态中的演进已不再停留在“要不要用”的争论,而是全面进入了“如何构建更稳固的基础设施”阶段。随着 GCCRS 等关键项目的成熟,Linux 内核将迎来兼具内存安全与工具链高度灵活的全新时代。
2026-08-22 00:44:39
380
原创 深入理解 Linux 内核 RCU:从设计哲学的辉煌到 Hazard Pointer 的破局
本文分析了Linux内核中RCU同步机制的演进历程及其核心缺陷,并探讨了HazardPointer解决方案。RCU通过读-复制-更新实现了近乎零开销的读操作,但其GracePeriod机制导致写端对象清理存在显著延迟,在高频更新场景下易引发内存暴涨和实时性问题。HazardPointer通过让读端显式登记访问对象地址,实现精准内存回收,大幅降低延迟并提升内存利用率。两者各具优势:RCU适合读多写少场景,HazardPointer更适用于高频更新和内存敏感场景。HazardPointer的引入为内核提供了更完
2026-08-17 10:58:54
311
原创 内核热更新与高效内存管理:解析 KHO/LUO 机制及 RDMA 动态 DMA 扩展实践
本文探讨了Linux内核热更新技术在高可用云计算环境中的创新应用。首先系统分析了Kexec HandOver(KHO)和LiveUpdate Orchestrator(LUO)架构,重点阐述了其通过扁平设备树(FDT)传递状态和连续内存分配器(CMA)保障内存连续性的关键技术。随后创新性地将KHO/FDT元数据传递思想延伸至RDMA领域,提出两阶段DMA映射方案解决多会话共享连接的内存扩容瓶颈。研究表明,这种基于标准化元数据与受控连续内存的热重启范式,不仅支持内核跨版本升级,还能显著提升RDMA网络性能。该
2026-08-17 08:27:27
570
原创 Linux 交换(Swap)子系统:从诞生演进、架构拆解到 swap_ops 现代化重构
Linux Swap子系统演进与架构解析 摘要:本文系统阐述了Linux Swap子系统的技术架构与发展历程。Swap作为虚拟内存管理的核心组件,通过将不活跃内存页交换到磁盘来防范OOM并优化I/O性能。文章梳理了Swap从早期专用分区到支持文件、网络交换,再到适配SSD/zRAM的演进过程,重点分析了2026年LSFMM峰会上提出的swap_ops抽象层设计,比较了Baoquan He和Christoph Hellwig两种技术方案的异同。同时提供了Swap文件创建、内核参数调优等实战指南,指出Swap子
2026-08-16 01:50:34
456
原创 MACsec 全景解析:从技术演进、核心架构到 DPU 硬件卸载与 K8s 大规模调度实战
MACsec(媒体访问控制安全)是一种基于IEEE 802.1AE标准的二层网络安全协议,提供数据加密、完整性校验和防重放攻击功能。它直接作用于物理链路层,支持从10Gbps到400Gbps+的线速加解密。未来将应用于AI/HPC集群、抗量子密码和零信任架构。MACsec架构包含数据面和控制面协议,通过SecTAG和ICV实现安全封装。配置方式包括Linux内核软件和DPU/智能网卡硬件卸载。在分布式AI训练中,结合DPU硬件卸载和Kubernetes调度,MACsec可高效保障RDMA传输安全,实现亚微秒
2026-08-16 00:23:43
545
原创 打破硬件壁垒:面向 RDMA 数据中心传输的主机端可插拔拥塞控制架构
摘要:随着数据中心进入100G/400G时代,RDMA(如RoCEv2)已成为高性能计算的关键技术。传统无损RoCEv2依赖PFC和DCQCN实现零丢包,但存在PFC死锁、头阻塞等问题。Netdev0x1A会议提出将拥塞控制从网卡硬件迁移至主机端,构建可编程框架,通过管道级聚合控制和高精度RTT探测,摆脱对无损网络的依赖。实验显示,该方案在关闭PFC/ECN时仍能有效管理拥塞。未来有望建立通用Linux框架,实现更灵活的软件定义网络控制,为大规模分布式计算提供新方案。
2026-08-12 23:22:12
402
原创 破局 10 万 GPU 集群训练瓶颈:基于 MRC 传输协议与 SRv6 静态源路由的技术实践
本文解析了超大规模分布式AI预训练中的网络性能与稳定性挑战,提出新一代网络架构解决方案。传统RoCEv2协议存在流碰撞和应用层多路径失效问题,导致尾部延迟和故障重启代价高昂。联合团队设计了MRC多路径RDMA传输协议,通过逐包喷射、硬件级乱序直投和故障自愈机制,结合SRv6静态源路由和多平面两层Clos拓扑,实现了路径优化和故障容错。生产环境测试表明,该方案能有效应对链路故障和交换机失效,显著提升训练稳定性和效率。这一架构为下一代超大规模AI数据中心网络发展提供了重要参考。
2026-08-12 22:53:21
488
原创 从 netkit 零拷贝到用户空间 BPF 热补丁:2026 Linux 文件系统、内存管理与 BPF 峰会技术前沿
2026年Linux文件系统、内存管理与BPF峰会上,Daniel Borkmann分享了netkit子系统的突破性进展:通过"队列租赁"机制实现虚拟机零拷贝网络,接收端技术已成熟,发送端正解决硬件兼容性问题,且保持网络命名空间策略完整性。会议还探讨了更具前瞻性的BPF用户空间热补丁构想,旨在通过验证器保障安全动态更新,但面临用户态逻辑验证、指令改写等技术挑战。虽然实施难度大,这一构想展现了Linux社区在性能优化和安全更新领域的创新探索。netkit已从理论走向实践,而用户空间BPF热
2026-08-11 14:55:46
456
原创 突破单点限制:BPF 多跟踪点高效附加机制与新 ftrace 架构解析
摘要:Linux内核7.2版本引入重大突破,解决了BPF程序无法高效批量附加到多个跟踪点的痛点问题。Jiri Olsa通过新的ftrace API分组管理方案,实现了"配置统一分组,执行按需独立"的创新架构,包括:1)单分组ftrace_ops管理多个跟踪点;2)为每个函数生成独立跳板保持性能;3)配套锁池化优化。新方案使批量注册时间从秒级降至毫秒级,运行性能比kprobe快近一倍。虽然存在Verifier解引用限制和架构差异等局限性,但这标志着Linux动态追踪能力的重大提升,为云原生
2026-08-11 13:43:17
310
原创 突破内存墙:CXL 架构解析与 famfs 文件系统演进全景
摘要: CXL技术正推动数据中心内存架构革新,解决传统服务器面临的“内存墙”与“内存闲置”问题。CXL 3.0/3.1支持多节点共享内存,而famfs文件系统专为CXL共享内存设计,通过DAX机制实现零拷贝物理访存,优化大数据与AI应用的性能。然而,famfs合入Linux内核的进程因技术分歧受阻,最终在LSFMM+BPF 2026峰会上达成共识,通过通用化FUSE映射接口实现兼容,为未来高性能内存文件系统铺平道路。
2026-08-09 13:41:20
317
原创 深度解析 eBPF LSM:如何利用 eBPF 构建安全的 Linux 内核纵深防御体系
从早期的网络报文过滤到今天的eBPF LSM 纵深防御,eBPF 已经成为了现代 Linux 内核安全的绝对基石。通过将 dm-verity 签名校验、细粒度 LSM 拦截以及内核自保护机制有机结合,安全人员能够构建起兼具高性能、高灵活性与强抗篡改能力的内核安全屏障。随着社区对不可变 BPF 程序和隔离机制的不断完善,基于 eBPF 的内核安全生态必将迎来更加坚固的未来。
2026-08-09 12:57:46
421
原创 Linux 调度器新演进:深度拆解代理执行(Proxy Execution)与 sched_ext 的融合
Linux内核调度技术前沿聚焦可扩展调度器类(sched_ext)与代理执行(ProxyExecution)两大创新。代理执行通过"借出调度上下文"机制,以请求锁的高优先级任务身份执行持锁者代码,有效解决传统优先级继承无法处理的非数值优先级调度场景。最新进展显示,sched_ext通过子调度器层级化实现了多租户调度隔离,采用能力授权机制控制CPU访问权限;同时通过透明重定向和显式声明机制,成功与代理执行兼容,打破了二者长期互斥的局面。这两项技术的融合使Linux内核既能支持高度定制化的调
2026-08-08 14:05:01
367
原创 绕过主机:通过 Devmem TCP 运行 RDMA 应用
标准的 Linux 网络协议栈使用由sk_buff结构包裹的包缓冲区,这些结构指向系统的主机内存页。多年来,这种以主机为中心的抽象已经足够使用。然而,大规模分布式计算和机器学习的兴起,使主机 CPU 内存复制成为了严重的架构瓶颈。为了解决这一问题,内核最近引入了设备内存 TCP(Device Memory TCP,简称 devmem TCP)。它利用dmabuf架构,通过硬件报头分离(Header Splitting)技术,将接收到的数据包有效载荷(Payload)直接写入外设内存(如 GPU 显存)。
2026-08-08 13:03:33
773
原创 Linux 文件系统测试的破局者:从 LSFMMBPF 2026 议题看 kdevops 自动化框架
Linux文件系统测试挑战与kdevops解决方案 在2026年Linux存储与文件系统峰会上,开发者指出稳定内核中文件系统退化(regressions)问题加剧,原因包括代码规模膨胀、LLM生成的补丁涌入,以及特性重构(如Folios)。ext4维护者Ted Ts'o提议通过自动化测试(如fstests)和集中化结果分析应对这一挑战,但跨环境测试数据整合仍是难点。 kdevops框架作为解决方案脱颖而出,它通过Kconfig配置、Terraform编排和Ansible部署,简化了内核测试环境搭建。其核心优
2026-08-07 13:33:43
361
原创 eBPF 内核安全黑科技:深入解析 Tetragon 及其“去用户空间 Agent”演进之路
本文深入解析了基于eBPF的内核级安全监控工具Tetragon的架构原理与核心功能。通过内核侧规则引擎实现零延迟防御,Tetragon能够监控进程执行、文件访问等行为并实时阻断攻击。文章还探讨了2026年LFSMMBPF峰会上的前沿进展:通过UDP内核套接字技术实现"纯内核级日志直连",使安全监控工具摆脱对用户空间Agent的依赖,迈向"绝对不可杀死"的终极形态。这一技术突破将极大提升系统面对高级攻击时的防御韧性。
2026-08-07 13:15:30
464
原创 认识 Tetragon:基于 eBPF 的安全监控与强制执行工具
在深入了解思科的内核安全实践之前,我们先来认识一下文中提到的核心工具——。是由 Cilium 社区(现属于 CNCF 毕业项目)开发的一款开源的、基于的安全可观测性与运行时强制执行工具。:与传统安全工具将大量事件推送到用户空间进行分析不同,Tetragon 直接在 Linux 内核空间运行过滤与监控逻辑,性能开销极低。:它不仅能深入监控 Linux 进程生命周期、系统调用和网络活动,还能无缝结合 Kubernetes 的元数据(如 Pod、Namespace 等),实现精准到容器级别的安全审计。
2026-08-02 13:17:12
532
原创 告别脆弱与繁复:Linux 内核加密框架的现代化转型、API 重构与 AF_ALG 安全危机
在 2026 年 Linux 北美安全峰会(Linux Security Summit North America)上,Eric Biggers 发表了关于 Linux 内核加密框架存在的问题,以及在添加库 API(library APIs)以允许开发人员在不使用传统加密 API 的情况下使用加密功能方面取得的最新进展的演讲。他通过几个示例展示了原有 API 的脆弱性,并展示了新的库 API 如何为开发人员和内核维护者带来便利。Biggers 首先进行了自我介绍。
2026-08-02 12:55:46
395
原创 跨内核实时更新:如何实现 hugetlbfs 巨页的无缝保留与恢复?
本文探讨了Linux内核实时升级中的HugePages保留难题。随着6.19内核引入kexec切换和实时更新协调器,宿主机内核升级已能在不中断虚拟机的情况下进行,但基于hugetlbfs的大页内存仍无法保留。LSFMM&BPF峰会上提出的新架构通过三阶段方案解决该问题:冻结与固定内存页、序列化元数据、新内核重建恢复。设计面临巨页过度分配和CMA兼容性等挑战,目前采取预分配调整和禁用CMA等临时方案。首个补丁已提交,虽需重构部分底层架构,但该特性的实现将显著提升虚拟化环境下的内核热更新能力。
2026-08-01 08:53:48
300
原创 深入理解 Linux 内核 RCU 机制与 eBPF 无锁内存分配(kmalloc_nolock)
本文探讨Linux内核高并发场景下的两项关键技术:RCU机制与无锁内存分配。第一部分深入解析RCU(读-复制-更新)原理,包括其零开销读者设计、宽限期机制及核心API,通过原子指针交换和静止态检测实现高效同步。第二部分聚焦2026年LSFMM/BPF峰会前沿动态:1)Puranjay Mohan优化RCU宽限期处理,使内存释放提速33%-41%;2)提出kmalloc_nolock()解决eBPF在不可睡眠上下文的内存分配难题,结合RCU实现类型安全内存复用,但存在分配失败风险和API复杂性。两项技术共同推
2026-08-01 05:46:49
475
原创 深度解析 Linux 内核中的 iomap 子系统:历史、演进、核心机制与未来
本文深入解析Linux内核中的iomap子系统,这个关键但鲜为人知的中间层通过简化文件空间与存储空间的映射关系,极大优化了现代文件系统性能。文章首先回顾了从缓冲区头到iomap的演进历程,指出传统缓冲区头在管理大型文件时的内存碎片和性能问题。核心部分详细剖析了iomap结构体及其映射类型(如常规映射、内联存储、空洞文件等),并阐释了通过回调机制实现文件系统与存储设备的交互。文章还展示了iomap如何简化I/O操作实现,包括缓冲读写、直接I/O等场景,通过标准化接口显著减少文件系统样板代码。最后展望了ioma
2026-07-27 14:13:47
464
原创 Linux 文件系统核心概念与峰会热点:负目录危机剖析
2026年Linux存储峰会上,专家们针对负目录项(Negative Dentries)引发的内核性能危机展开激烈讨论。负目录项是Linux文件系统中记录不存在的文件的优化机制,但海量积累会导致软锁死、哈希链过长等问题。会议探讨了多种解决方案,包括调整目录项顺序、插入内核抢占、更换数据结构等,并围绕用户空间策略与默认值设置展开争论。核心矛盾在于如何平衡系统性能与稳定性,同时兼顾不同工作负载需求。会议最终未达成明确共识,但凸显了Linux文件系统优化中策略选择与默认值设定的重要性。
2026-07-27 13:32:18
352
原创 LLM 助力的 Linux 内核革新与 1GB 巨页演进
本文探讨了大型语言模型(LLM)在Linux内核开发中的应用现状与挑战。文章指出,内核开发者主要将LLM用作辅助工具,包括问题推演、原型设计、代码预审和文档撰写等场景,但强调"人类全责"原则。通过分析两个典型案例——改进1GB巨页分配的"超页块"方案和虚拟机内存追踪补丁,揭示了LLM辅助开发的两种命运:前者因过度依赖LLM生成低质量代码而遭社区批评,后者通过严格人工把关获得认可。文章特别剖析了hugetlbfs机制的技术原理,并指出成功的LLM应用需要资深开发者的架构
2026-07-26 06:07:46
459
原创 高性能网络技术演进与创新探索:RDMA、eBPF/XDP 深度解析及 LSF/MM/BPF 2023 专题演讲
文章摘要: 本文系统解析了RDMA与eBPF/XDP两项高性能网络技术的原理、演进及优劣势。RDMA通过内核旁路与零拷贝实现微秒级低延迟传输,但存在开发复杂、运维困难等挑战;eBPF/XDP则以内核安全可编程能力赋能包处理,但受限于硬件依赖与状态管理。在LSF/MM/BPF 2023会议上,Zhu Yanjun提出创新方案《XDP(eBPF) with RDMA(RXE)》,通过新增标志位与协议解析结构,将XDP深度集成至SoftRoCE驱动路径,实现对RDMA流量的精细化观测与管控。测试验证了该方案能精准
2026-07-26 05:33:49
620
原创 突破内核性能瓶颈:Linux BPF 局部存储与数据包元数据的优化探索
摘要:Linux内核网络子系统中,BPF局部存储API用于为数据包附加元数据,但在高并发场景下存在性能瓶颈。Amery Hung提出用rqspinlock替代原有锁机制,解决了死锁问题并提升了吞吐量,但释放内存时存在少量内存泄漏。Jakub Sitnicki探讨了sk_buff元数据存储方案,权衡了扩展指针、专用扩展和全局哈希表三种方案的优缺点。社区围绕内存开销和生命周期管理展开讨论,提出标志位优化等思路。未来需进一步明确内核对象需求,优化验证器并减少动态分配。核心在于平衡性能、安全性和内存开销。
2026-07-24 12:07:00
433
原创 Linux 7.2-rc1 发布:从底层内存重构到 AI 补丁洪流的内核变革
Linux 7.2-rc1发布:核心技术变革与AI补丁冲击 Linux 7.2合并窗口关闭,共接收13,412个提交,创下2,138位贡献者的纪录。核心改进包括: 内存管理:Swap子系统统一优化,静态元数据开销趋零;khugepaged支持mTHP(多尺寸透明大页),提升TLB命中率。 文件系统:NFS默认传输块升至4MB,提升大带宽性能;SMB支持压缩,NTFS3驱动加固。 安全:彻底移除高危函数strncpy(),改用安全替代方案;Landlock扩展网络控制。 虚拟化:KVM支持Intel/AMD硬
2026-07-24 11:35:39
542
【计算机体系结构】PCI Express基础协议解析:高速串行点对点通信架构与数据传输机制研究
2026-08-08
高速通信基于PCIe标准的电气特性分析:T2S03与T2S10收发器信号完整性设计研究
2026-08-08
【高速互连技术】基于PCIe 5.0的M.2与U.2接口升级:32 GT/s信号完整性及合规性测试方案设计
2026-08-08
高速通信基于PAM4与Flit FEC的PCIe 6.0物理层误码率分析:FBER与不可纠正帧错误率关联性建模及接收端压力测试评估方法研究
2026-08-08
【集成电路设计】基于PCIe的多功能设备架构优化:大型多函数器件配置与虚拟化资源分配系统设计
2026-08-08
【高速接口测试】PCIe电气表征规范与PVT测试矩阵:基于温度电压工艺角的信号完整性验证方法研究
2026-08-08
【计算机硬件】PCIe协议低功耗状态L1.1/L1.2技术解析:基于桌面与笔记本平台的电源管理应用研究
2026-08-08
【高速互连技术】PCIe 6.0重定时器信道扩展验证:基于仿真与实测的信号完整性分析及合规性测试方法研究
2026-08-08
T2S04 Future of PCIe Technology in Emerging Markets A Look at Our Industry.pptx
2026-08-08
【计算机体系结构】基于Arm多芯片架构的PCIe性能分析与优化:高性能计算场景下带宽延迟瓶颈研究
2026-08-08
T4S05 Cable and Connector Compliance with Integrated Return Loss.pdf
2026-08-08
【高速互联技术】PCIe Base 7.0接口报告扩展:增加设备类信息字段以支持NVM Express配置标准化
2026-08-07
【计算机硬件接口】PCI规范中的设备分类与功能标识编码体系:用于标准化外设识别与配置管理
2026-08-07
【硬件安全架构】基于ACS的访问控制服务改进:PCIe链路本地消息源验证豁免机制设计
2026-08-07
【计算机硬件标准】PCI代码与ID分配规范:设备分类编码及扩展能力标识技术文档
2026-08-07
【计算机硬件接口】PCI总线协议中的设备分类与扩展能力标识:用于标准化外设功能识别与系统配置管理
2026-08-07
IB Specification Vol 2-Release-2.1-FINAL-2026-07-31 watermarked.pdf
2026-08-17
IB Specification Vol 1-Release-2.1-Draft-2026-07-25.pdf
2026-08-17
【高速互连技术】基于PAM4的PCIe 6.0与7.0电气规范演进:64GT/s至128GT/s信号完整性及低延迟高可靠系统设计
2026-08-08
【高速互连技术】基于PCIe与光互联的模块化架构:数据中心高性能计算扩展系统设计
2026-08-08
【高速互连技术】基于PCIe协议的合规性测试体系:物理层与链路层关键参数验证系统设计
2026-08-08
【高速接口技术】PCIe M.2与U.2规范更新:支持32 GT/s速率的物理层设计及合规性测试方案
2026-08-08
【高速互连技术】基于MiniSAS-HD的PCIe外接电缆电气规范:支持32GT/s信号完整性与多速率兼容性设计
2026-08-08
【集成电路设计】IC引脚场噪声耦合机制分析:高速信号完整性中串扰源的建模与抑制方法研究
2026-08-08
【高速串行通信】基于LTSSM协议的状态机调试与定时分析:复杂边界条件下的PCIe链路训练故障排查方法研究
2026-08-08
【高速互连技术】PCIe 6.0协议优化机制解析:面向高效能计算的物理层与数据链路层协同设计
2026-08-08
【半导体测试测量】基于DDC与相位检测器的PLL带宽和峰值精确表征:高速串行链路时钟恢复系统性能评估方法
2026-08-08
【高速互连技术】PCIe 6.0重定时器设计规范:通道损耗预算与信号完整性优化系统架构方案
2026-08-08
【高速互连技术】PCIe 5.0与6.0连接器及线缆组件:高频信号完整性挑战与测试方法研究
2026-08-08
【高速接口测试】基于PCIe 32 GT/s的压力眼图数据驱动分析:多应力参数对眼高眼宽影响的量化研究
2026-08-08
【高速通信测试】基于步响应的PCIe接收端压力眼图校准方法研究:64GT/s条件下手动与替代通道校准技术对比分析
2026-08-08
【高速互连技术】PCIe CEM 5.0/6.0电气机械规范:支持64 GT/s信号速率与600W高功率连接器设计
2026-08-08
T1S03 & T1S09 PCIe 6.0 PHY Logical.pdf高速互连基于PAM-4与FLIT架构的PCIe 6.0物理层设计:低延迟高可靠性的下一代I/O总线技术实现
2026-08-08
T1S04 PCIe Compliance Electrical Deep Dive.pdf
2026-08-08
【高速互连技术】PCIe 6.0协议更新与未来演进:面向多路径无序I/O及安全管理的架构优化研究
2026-08-08
【计算机体系结构】基于PCI-SIG总线架构演进分析:从PCI到PCIe的高性能互连技术发展历程研究
2026-08-08
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅