当前位置: 首页 > article >正文

内核热补丁和function trace的兼容性浅析

本文代码基于linux内核4.19.195.之前的文章简要讲解了内核热补丁的原理也提到了热补丁是基于ftrace框架实现的。平时我们在用ftrace时最常用的功能当属function tracer了。这天一个有趣的问题突然浮现在我的脑海里如果我对同一个函数既打了热补丁又用function trace去跟踪这两个功能能同时生效吗直接上答案是可以的。验证的话也非常方便内核里的samples/livepatch/livepatch-sample.c编译出来的ko会hack函数cmdline_proc_show()也就是我们cat /proc/cmdline的输出函数。将这个ko插入后再通过debugfs去trace一下cmdline_proc_show()然后手动触发一下cat /proc/cmdline看下输出是否为hack后的内容以及ftrace框架是否有相关function trace的打印即可。那为什么可以呢一、从ftrace的架构说起要理解为什么这两个功能能共存我们得先看看ftrace的内部设计。ftrace框架的核心是一个钩子链机制。当内核编译时开启-pg或-mfentry选项后每个函数入口处会被插入一个call __fentry__指令x86_64架构。内核启动时这些调用会被动态替换成NOP指令以消除性能开销当某个trace功能被启用时再将其替换为call ftrace_callerftrace_caller其实就是ftrace的trampline。关键点在于ftrace_caller并非直接调用trace函数而是遍历所有注册到该函数的ftrace_ops结构体链表。每个ftrace_ops代表一个ftrace使用者它包含一个回调函数func和一些标志位。当函数被调用时ftrace框架会依次执行所有注册到该函数的ops的回调。二、livepatch和function trace的ops有何不同现在来看livepatch和function trace各自的ops注册方式Function Trace的ops普通的function tracer如function或function_graph注册的ops通常只设置FTRACE_OPS_FL_RECURSION_SAFE等标志。它的回调函数如function_trace_call只是读取寄存器信息并记录到ring buffer然后返回。它不会修改pt_regs中的指令指针(IP)原函数会继续正常执行。Livepatch的opsLivepatch注册的ops则大不相同。在klp_patch_func()函数中它会创建一个klp_ops结构并设置以下关键标志ops-fops.funcklp_ftrace_handler;ops-fops.flagsFTRACE_OPS_FL_DYNAMIC|FTRACE_OPS_FL_IPMODIFY|// 关键标志FTRACE_OPS_FL_SAVE_REGS;FTRACE_OPS_FL_IPMODIFY是这里的秘密武器。这个标志告诉ftrace框架我的回调函数可能会修改pt_regs-ip指令指针请允许我劫持这个函数的执行流程。在livepatch的回调函数klp_ftrace_handler()中它会根据当前任务的patch状态将regs-ip修改为新函数的地址。当ftrace trampoline执行RET指令时CPU会直接跳转到新函数而不是回到原函数的push rbp之后。这样原函数的整个函数体都被跳过了。三、为什么它们不会冲突现在可以回答核心问题了为什么两者能同时工作1. 调用链的层级关系当function trace和livepatch同时启用时ftrace框架会维护一个ops链表。假设function trace先注册livepatch后注册链表大概是这样的ftrace_ops_list:[function_trace_ops]-[klp_ops]当cmdline_proc_show()被调用时执行流程如下call ftrace_caller函数入口处的5字节指令进入ftrace trampoline保存寄存器遍历ops链表依次调用每个ops-func()先调用function trace的回调记录trace信息返回不修改IP再调用livepatch的klp_ftrace_handler()修改regs-ip为new_func地址trampoline恢复寄存器此时IP已被修改RET指令执行跳转到new_func而非原函数2. IPMODIFY的独占性约束需要注意的是FTRACE_OPS_FL_IPMODIFY标志有一个重要限制同一个函数上同时只能有一个ops设置这个标志。这意味着你不能对同一个函数打两个livepatch但可以通过func_stack机制叠加多个补丁你可以同时有function trace livepatch因为function trace不设置IPMODIFY如果另一个也使用IPMODIFY的工具如kretprobe先注册到了该函数livepatch的注册会返回-EEXIST失败。3. Livepatch的func_stack机制同一个函数可以被打多次补丁livepatch通过func_stack函数栈来管理这些补丁。当多次patch同一个函数时不会创建新的ftrace_ops而是将新的klp_func结构体加入到已有ops的func_stack链表中。klp_ftrace_handler()总是选择栈顶的函数作为实际执行的版本LIFO原则。这保证了最新的补丁生效同时也支持一致性模型consistency model下的平滑过渡。四、代码层面的验证让我们通过内核代码来验证上述流程。在kernel/livepatch/patch.c中klp_ftrace_handler的核心逻辑如下staticvoidklp_ftrace_handler(unsignedlongip,unsignedlongparent_ip,structftrace_ops*fops,structftrace_regs*fregs){structklp_ops*ops;structklp_func*func;opscontainer_of(fops,structklp_ops,fops);/* 获取当前应该执行的函数版本 */funclist_first_or_last_entry(ops-func_stack,...);if(func-nop)return;/* NOP补丁直接执行原函数 *//* 关键修改指令指针实现函数跳转 */klp_arch_set_pc(fregs,(unsignedlong)func-new_func);}而普通的function trace回调如function_trace_call则不会调用klp_arch_set_pc只是简单地记录数据。另外我们再看一下linux内核里对同一个ip有多个hack的回调时是如何处理的staticvoidftrace_ops_list_func(unsignedlongip,unsignedlongparent_ip,structftrace_ops*op,structpt_regs*regs){__ftrace_ops_list_func(ip,parent_ip,NULL,regs);}staticnokprobe_inlinevoid__ftrace_ops_list_func(unsignedlongip,unsignedlongparent_ip,structftrace_ops*ignored,structpt_regs*regs){structftrace_ops*op;intbit;bittrace_test_and_set_recursion(TRACE_LIST_START,TRACE_LIST_MAX);if(bit0)return;/* * Some of the ops may be dynamically allocated, * they must be freed after a synchronize_sched(). */preempt_disable_notrace();do_for_each_ftrace_op(op,ftrace_ops_list){//遍历这个链表ftrace_ops_list/* * Check the following for each ops before calling their func: * if RCU flag is set, then rcu_is_watching() must be true * if PER_CPU is set, then ftrace_function_local_disable() * must be false * Otherwise test if the ip matches the ops filter * * If any of the above fails then the op-func() is not executed. */if((!(op-flagsFTRACE_OPS_FL_RCU)||rcu_is_watching())ftrace_ops_test(op,ip,regs)){//如果其中的ftrace_ops能够在本IP插桩点执行if(FTRACE_WARN_ON(!op-func)){pr_warn(op%p %pS\n,op,op);gotoout;}op-func(ip,parent_ip,op,regs);//在当前ip满足hash的情况下逐个执行ftrace_ops-func()}}while_for_each_ftrace_op(op);out:preempt_enable_notrace();trace_clear_recursion(bit);}可以看到__ftrace_ops_list_func()会逐个执行hack的回调函数而不管这些回调函数是否会修改ftrace trampline返回时需要回到的IP。五、实验验证的再思考回到文章开头的实验插入livepatch后通过debugfs启用function trace然后cat /proc/cmdline。根据上面的分析实际执行路径是用户空间调用read()系统调用内核最终调用cmdline_proc_show()函数入口处触发ftracefunction trace先记录“嘿cmdline_proc_show被调用了”livepatch劫持执行流将IP改为patch_cmdline_proc_show执行补丁函数输出被修改的内容返回用户空间所以看到的trace日志里记录的函数名可能还是cmdline_proc_show但实际执行的已经是补丁函数了。六、总结内核热补丁和function trace能同时生效本质是因为ftrace框架设计良好的插件化架构共享基础设施都依赖-mfentry编译选项和动态代码补丁机制职责分离function trace是观察者只读livepatch是劫持者改写IP标志位区分通过FTRACE_OPS_FL_IPMODIFY标志管理对执行流的修改权限链表遍历多个ops可以共存按注册顺序依次执行这种设计体现了Linux内核中常见的单一职责原则——ftrace提供了一个通用的函数钩子机制不同的功能可以根据需要选择不同的权限级别是否修改IP而框架本身负责协调这些使用者之间的兼容性。不过也要注意边界情况如果function trace设置了FTRACE_OPS_FL_SAVE_REGS_IP之类的标志某些特殊tracer或者与kretprobe等也使用IPMODIFY的工具混用可能会遇到冲突。但在常规场景下它们确实是和平共处的。

相关文章:

内核热补丁和function trace的兼容性浅析

本文代码基于linux内核4.19.195. 之前的文章简要讲解了内核热补丁的原理,也提到了热补丁是基于ftrace框架实现的。平时我们在用ftrace时,最常用的功能当属function tracer了。这天一个有趣的问题突然浮现在我的脑海里: 如果我对同一个函数&am…...

如何保证代码质量?

一、编码阶段:从源头控制质量1. 统一代码规范(强制执行)核心目标:减少风格差异,提高可读性常见工具:ESLint:代码规范校验Prettier:自动格式化Stylelint:样式规范&#x1…...

3大突破!LxgwWenKai字体效率革命:从代码阅读到多场景适配全指南

3大突破!LxgwWenKai字体效率革命:从代码阅读到多场景适配全指南 【免费下载链接】LxgwWenKai LxgwWenKai: 这是一个开源的中文字体项目,提供了多种版本的字体文件,适用于不同的使用场景,包括屏幕阅读、轻便版、GB规范字…...

如何用ViGEmBus实现Windows内核级游戏手柄模拟:架构解析与实践指南

如何用ViGEmBus实现Windows内核级游戏手柄模拟:架构解析与实践指南 【免费下载链接】ViGEmBus Windows kernel-mode driver emulating well-known USB game controllers. 项目地址: https://gitcode.com/gh_mirrors/vi/ViGEmBus ViGEmBus是一款Windows内核模…...

Llama-3.2V-11B-cot多场景:科研论文插图理解、工程图纸解析、UI截图分析

Llama-3.2V-11B-cot多场景应用:科研论文插图理解、工程图纸解析、UI截图分析 1. 模型概述 Llama-3.2V-11B-cot是一款基于LLaVA-CoT论文实现的视觉语言模型,具备强大的图像理解和系统性推理能力。该模型采用MllamaForConditionalGeneration架构&#xf…...

卡证检测矫正模型效果展示:高清四角点定位+正视角矫正图实拍

卡证检测矫正模型效果展示:高清四角点定位正视角矫正图实拍 你有没有遇到过这样的烦恼?需要上传身份证、驾照或者护照照片时,手机随手一拍,结果照片歪歪扭扭,背景杂乱,关键信息还被手指挡住了。这时候要么…...

RexUniNLU案例集:制造业设备报修场景中,‘异响’‘漏油’‘停机’故障标签识别效果

RexUniNLU案例集:制造业设备报修场景中,‘异响’‘漏油’‘停机’故障标签识别效果 1. 引言:当设备“说话”时,我们如何听懂? 想象一下这个场景:在一条繁忙的生产线上,一台关键设备突然发出“…...

STM32一键下载电路设计与CH340应用

STM32一键下载电路设计与实现1. 项目概述1.1 功能需求STM32系列微控制器在开发过程中,通常需要通过串口进行程序下载。传统下载方式需要手动操作BOOT0和RESET引脚,过程繁琐且容易出错。本项目设计了一种基于CH340芯片的自动下载电路,通过软件…...

突破学术写作瓶颈:WPS-Zotero革新文献管理工作流

突破学术写作瓶颈:WPS-Zotero革新文献管理工作流 【免费下载链接】WPS-Zotero An add-on for WPS Writer to integrate with Zotero. 项目地址: https://gitcode.com/gh_mirrors/wp/WPS-Zotero 在学术写作的征途上,文献管理如同隐形的绊脚石&…...

USBToolBox高效管理实战指南:多设备USB映射自动化配置全流程

USBToolBox高效管理实战指南:多设备USB映射自动化配置全流程 【免费下载链接】tool the USBToolBox tool 项目地址: https://gitcode.com/gh_mirrors/too/tool 在现代多设备办公环境中,USB映射(将物理USB端口映射为系统可识别的逻辑设…...

工业质检新革命:无需标注数据,用ChatGPT式对话完成目标定位

工业质检新革命:无需标注数据,用ChatGPT式对话完成目标定位 1. 传统工业质检的痛点与挑战 在制造业的质检环节中,目标定位一直是个技术难题。传统方法通常需要: 大量标注数据训练专用模型针对每种产品定制算法频繁调整参数适应…...

网盘直链解析技术指南:突破下载限制的高效解决方案

网盘直链解析技术指南:突破下载限制的高效解决方案 【免费下载链接】Online-disk-direct-link-download-assistant 可以获取网盘文件真实下载地址。基于【网盘直链下载助手】修改(改自6.1.4版本) ,自用,去推广&#xf…...

深入解析SerialPort:从硬件流控制到实战串口通信

1. 串口通信基础:从水管到数据流 第一次接触串口通信时,我盯着电脑上的COM接口发呆了半小时。这玩意儿看起来就像老式打印机接口,但它却是连接硬件世界的魔法通道。串口通信就像用一根水管在两个水桶之间传递水,只不过我们传递的…...

深度解析ShardingCore:EF Core分库分表架构实战与性能优化指南

深度解析ShardingCore:EF Core分库分表架构实战与性能优化指南 【免费下载链接】sharding-core high performance lightweight solution for efcore sharding table and sharding database support read-write-separation .一款ef-core下高性能、轻量级针对分表分库…...

圣女司幼幽-造相Z-Turbo多模态生成:从文本到视频脚本的连贯创作

圣女司幼幽-造相Z-Turbo多模态生成:从文本到视频脚本的连贯创作 最近在尝试一些新的内容创作工具,发现了一个挺有意思的现象:很多工具要么只能做图,要么只能写文案,想把它们串起来做个完整的视频,中间总得…...

通义千问3-Reranker-0.6B部署教程:模型服务SLA保障(P95延迟<800ms)调优

通义千问3-Reranker-0.6B部署教程&#xff1a;模型服务SLA保障&#xff08;P95延迟<800ms&#xff09;调优 1. 为什么你需要关注这个模型&#xff1f; 如果你正在做搜索系统、智能客服或者文档问答&#xff0c;肯定遇到过这样的问题&#xff1a;用户输入一个问题&#xff…...

SGLang-v0.5.6优化技巧:合理配置GPU内存利用率

SGLang-v0.5.6优化技巧&#xff1a;合理配置GPU内存利用率 1. 引言 在大模型推理的实际部署中&#xff0c;GPU内存管理往往是决定服务稳定性和性能的关键因素。SGLang-v0.5.6作为专为高效推理设计的框架&#xff0c;提供了精细化的GPU内存控制机制。本文将深入解析如何通过合…...

FLUX.1-dev像素艺术模型效果对比:原生FLUX.1-dev vs Pixel Dream微调版差异

FLUX.1-dev像素艺术模型效果对比&#xff1a;原生FLUX.1-dev vs Pixel Dream微调版差异 1. 像素艺术生成技术概览 像素艺术作为一种独特的数字艺术形式&#xff0c;近年来在游戏开发、NFT创作和数字设计领域重新焕发活力。传统像素艺术创作需要艺术家手动绘制每个像素点&…...

SmallThinker-3B部署实录:在16GB内存笔记本上稳定运行长链推理服务

SmallThinker-3B部署实录&#xff1a;在16GB内存笔记本上稳定运行长链推理服务 1. 环境准备与快速部署 想要在普通笔记本上运行大模型推理服务&#xff1f;SmallThinker-3B-Preview让你用16GB内存就能实现这个目标。这个模型基于Qwen2.5-3b-Instruct微调而来&#xff0c;专门…...

Qwen3-TTS-1.7B惊艳案例:带背景音乐的语音合成抗干扰能力实测

Qwen3-TTS-1.7B惊艳案例&#xff1a;带背景音乐的语音合成抗干扰能力实测 1. 引言&#xff1a;当AI语音合成遇上背景音乐 想象一下这个场景&#xff1a;你正在制作一个短视频&#xff0c;需要给画面配上解说。你找到了一段完美的背景音乐&#xff0c;但当你尝试录制旁白时&am…...

ThinkPad X1 Tablet Gen3 vs Gen2键盘对比:为何Gen3更适合改装Type-C?

ThinkPad X1 Tablet Gen3键盘Type-C改装全解析&#xff1a;为何它成为DIY玩家的终极选择&#xff1f; 在移动办公设备轻量化与模块化设计成为主流的今天&#xff0c;ThinkPad X1 Tablet系列凭借其独特的二合一形态和标志性键盘手感&#xff0c;始终保持着特殊地位。特别是第三代…...

Blender多材质合并与Three.js统一渲染:从烘焙到GLB导出的完整指南

1. 多材质模型合并的核心痛点 在Blender中合并多个模型时&#xff0c;即使将它们合并为单一Mesh对象&#xff0c;导出为GLB格式后在Three.js中仍然会被拆分成多个Mesh。这个问题困扰过不少开发者&#xff0c;我自己在早期项目中也踩过这个坑。根本原因在于&#xff1a;Three.js…...

如何用TerminusDB构建语义数据仓库:从零开始的完整指南

如何用TerminusDB构建语义数据仓库&#xff1a;从零开始的完整指南 【免费下载链接】terminusdb TerminusDB is a distributed database with a collaboration model 项目地址: https://gitcode.com/gh_mirrors/te/terminusdb TerminusDB是一款分布式数据库&#xff0c;…...

英语从句全攻略:名词性、定语、副词性从句一网打尽(含易错点分析)

英语从句全攻略&#xff1a;名词性、定语、副词性从句一网打尽&#xff08;含易错点分析&#xff09; 当你读到一篇地道的英文文章时&#xff0c;是否曾被那些"套中套"的句子结构难住&#xff1f;从句就像英语语法中的俄罗斯套娃&#xff0c;层层嵌套却暗藏规律。作为…...

SenseVoice-Small模型在.NET生态中的集成实践

SenseVoice-Small模型在.NET生态中的集成实践 1. 项目背景与价值 语音识别技术正在快速融入各种应用场景&#xff0c;从智能客服到会议转录&#xff0c;从语音助手到内容创作&#xff0c;处处都能看到它的身影。对于.NET开发者来说&#xff0c;如何在熟悉的生态中集成高质量的…...

Pi0大模型环境配置详解:Python 3.11+PyTorch 2.7+lerobot依赖安装

Pi0大模型环境配置详解&#xff1a;Python 3.11PyTorch 2.7lerobot依赖安装 1. 项目概述 Pi0是一个创新的视觉-语言-动作流模型&#xff0c;专门设计用于通用机器人控制任务。这个项目最大的亮点是提供了一个直观的Web演示界面&#xff0c;让用户能够通过简单的操作体验先进的…...

OFA模型处理C语言文件读写操作生成的流程图描述

OFA模型处理C语言文件读写操作生成的流程图描述 最近在整理编程教学资料时&#xff0c;我遇到了一个挺有意思的需求&#xff1a;手头有一堆描述C语言文件读写操作的流程图&#xff0c;需要为每一张图配上清晰、准确的文字说明。这活儿听起来简单&#xff0c;做起来却挺费神&am…...

UG/NX Block UI Styler字符串控件避坑指南:常见问题与解决方案

UG/NX Block UI Styler字符串控件避坑指南&#xff1a;常见问题与解决方案 在UG/NX二次开发中&#xff0c;Block UI Styler作为可视化对话框设计工具&#xff0c;其字符串控件&#xff08;String Control&#xff09;是使用频率最高的交互元素之一。无论是参数输入、状态显示还…...

文墨共鸣大模型长期记忆(LSTM)优化对话体验:实现多轮深度交流

文墨共鸣大模型长期记忆&#xff08;LSTM&#xff09;优化对话体验&#xff1a;实现多轮深度交流 你有没有遇到过这样的情况&#xff1a;和一个智能助手聊天&#xff0c;聊到第三四轮的时候&#xff0c;它好像就忘了你最开始说了什么&#xff0c;回答开始跑偏&#xff0c;或者…...

把股票数据能力接进 AI:stock-sdk-mcp 的实践整理

起因 如果你经常用 Cursor、Claude 这类 AI 工具&#xff0c;应该已经能明显感觉到它们在通用问答和代码任务上越来越强了。但一旦问题变成金融数据查询&#xff0c;比如“看看贵州茅台今天的行情”“把最近 60 个交易日的日 K 线拉出来&#xff0c;再判断一下 MACD 和 RSI”&…...