linux内核:ftrace——追踪内核行为

文章目录

  • 1. 简介
  • 2. 使用
    • 2.1 加入ftrace
    • 2.2 ftrace 基础
      • 2.2.1 tracer
      • 2.2.2 filter(可选)
      • 2.2.3 读取trace
      • 2.2.4 ftrace_enabled
    • 2.3 使用function_graph查看do_sys_open的执行过程
    • 2.3 使用function查看do_sys_open的执行
    • 2.3 使用wakeup
    • 2.3 使用wakeup_rt
    • 2.4 event
  • 3. trace-cmd

1. 简介

ftrace是一套内核调试工具,从2.6版本之后集成到linux内核中。通过它可以轻松的追踪到内核发生的行为,也能调试分析延迟和性能问题。

在常见的linux发行版中,一般都使能了ftrace,它的操作目录在/sys/kernel/debug/tracing
在这里插入图片描述

使用mount | grep tracefs命令验证ftrace是否可用

2. 使用

2.1 加入ftrace

在编译内核时需要将trace相关加入编译:

Kernel hacking -->Tracer --->....

ftrace通过debugfs向用户提供访问接口,所以需要系统挂载debugfs到/sys/kernel/debug/
将如下内容添加到/etc/fstab:

debugfs  /sys/kernel/debug  debugfs  defaults  0  0

或者在运行时挂载:

mount  -t  debugfs  debugfs  /sys/kernel/debug

2.2 ftrace 基础

ftrace的使用步骤如下:

1.选择要使用的追踪器 current_tracer
2.设置一些追踪的参数过滤器等
3.开启追踪器 tracing_on
4.读追踪结果 trace

2.2.1 tracer

通过cat available_tracers可以查看当前可使用的追踪器:

[root@qemu_imx6ul:/tracing]# cat available_tracers
hwlat function_graph wakeup_dl wakeup_rt wakeup preemptirqsoff preemptoff irqsoff function nop
追踪器作用
function函数调用追踪器,可以看出哪个函数何时调用,可以通过过滤器指定要跟踪的函数
function_graph函数调用图表追踪器,可以看出哪个函数被哪个函数调用,何时返回
blkblock I/O追踪器,blktrace用户应用程序 使用的跟踪器
mmiotraceMMIO(Memory Mapped I/O)追踪器,用于Nouveau驱动程序等逆向工程
wakeup跟踪进程唤醒信息,进程调度延迟追踪器
wakeup_rt与wakeup相同,但以实时进程为对象
nop将 nop 写入 current_tracer 文件可以删除之前所使用的跟踪器,并清空之前收集到的跟踪信息,即刷新 trace 文件
wakeup_dl跟踪并记录唤醒SCHED_DEADLINE任务所需的最大延迟(如"wakeup”和"wakeup_rt”一样)
mmiotrace一种特殊的跟踪器,用于跟踪二进制模块。它跟踪模块对硬件的所有调用
hwlat硬件延迟跟踪器。它用于检测硬件是否产生任何延迟

通过写入current_tracer可以设置当前使用的追踪器

echo function_graph > current_tracer

2.2.2 filter(可选)

过滤器作用
set_ftrace_filter设置要跟踪的函数
set_ftrace_notrace反向过滤器,设置后输出除了函数以外内容
set_graph_function设置要跟踪的函数
set_graph_notrace反向过滤器,打开后进入对应函数会关闭跟踪

通过cat available_filter_functions可以查看可被过滤的函数列表(数量很多)

[root@qemu_imx6ul:/tracing]# cat available_filter_functions | wc -l
31103

使用方法:

echo sys_open > set_ftrace_filter
echo sys_close >> set_ftrace_filter
echo '*_open' '*do*' > set_ftrace_filter

2.2.3 读取trace

读取对象用途
trace直接读当前trace缓冲区的跟踪内容,trace满之后会被覆盖
trace_pipe作为管道被读取,有读清的机制
echo function > current_tracer
cat trace_pipe > /tmp/trace.out &
[1] 4153
echo 1 > tracing_on
usleep 1
echo 0 > tracing_on

2.2.4 ftrace_enabled

ftrace_enabled默认是使能的,不过需要时可以通过如下方式开关它

  sysctl kernel.ftrace_enabled=0sysctl kernel.ftrace_enabled=1orecho 0 > /proc/sys/kernel/ftrace_enabledecho 1 > /proc/sys/kernel/ftrace_enabled

2.3 使用function_graph查看do_sys_open的执行过程

#!/bin/bashdebugfs=`sed -ne 's/^debugfs \(.*\) debugfs.*/\1/p' /proc/mounts`
echo nop > $debugfs/tracing/current_tracer
echo 0 > $debugfs/tracing/tracing_onecho $$ > $debugfs/tracing/set_ftrace_pid
echo do_sys_open > $debugfs/tracing/set_graph_function
echo function_graph > $debugfs/tracing/current_tracer
echo 1 > $debugfs/tracing/tracing_onexec "$@"
[root@qemu_imx6ul:~/myfb-test]# cat /tracing/trace | head -40
# tracer: function_graph
#
# CPU  DURATION                  FUNCTION CALLS
# |     |   |                     |   |   |   |0)               |  do_sys_open() {0)               |    getname() {0)               |      getname_flags() {0) ! 979.000 us  |        kmem_cache_alloc();0)   ==========> |0)               |        gic_handle_irq() {0)               |          __handle_domain_irq() {0)               |            irq_enter() {0) + 25.334 us   |              rcu_irq_enter();0) + 20.333 us   |              preempt_count_add();0) # 1192.333 us |            }0) + 31.334 us   |            irq_find_mapping();0)               |            generic_handle_irq() {0)               |              handle_fasteoi_irq() {0)               |                _raw_spin_lock() {

如果命令执行时间很短,可以使用如下方式:
sh -c "echo $$ > set_ftrace_pid; echo 1 > tracing_on; kill xxx; echo 0 > tracing_on"

2.3 使用function查看do_sys_open的执行

#!/bin/bashdebugfs=`sed -ne 's/^debugfs \(.*\) debugfs.*/\1/p' /proc/mounts`
echo nop > $debugfs/tracing/current_tracer
echo 0 > $debugfs/tracing/tracing_on
echo $$ > $debugfs/tracing/set_ftrace_pidecho do_sys_open > $debugfs/tracing/set_ftrace_filter
echo function > $debugfs/tracing/current_tracer
echo 1 > $debugfs/tracing/tracing_onexec "$@"
[root@qemu_imx6ul:~/myfb-test]# cat /tracing/trace | head -40
# tracer: function
#
# entries-in-buffer/entries-written: 17/17   #P:1
#
#                              _-----=> irqs-off
#                             / _----=> need-resched
#                            | / _---=> hardirq/softirq
#                            || / _--=> preempt-depth
#                            ||| /     delay
#           TASK-PID   CPU#  ||||    TIMESTAMP  FUNCTION
#              | |       |   ||||       |         |myfb-test-239   [000] ...1  3462.834035: do_sys_open <-SyS_openmyfb-test-239   [000] ...1  3462.844034: do_sys_open <-SyS_openmyfb-test-239   [000] ...1  3462.851532: do_sys_open <-SyS_openmyfb-test-239   [000] ...1  3462.852319: do_sys_open <-SyS_openmyfb-test-239   [000] ...1  3462.853019: do_sys_open <-SyS_openmyfb-test-239   [000] ...1  3462.853713: do_sys_open <-SyS_open

2.3 使用wakeup

wakeup查看普通进程从被唤醒到真正执行的延时

[root@qemu_imx6ul:/tracing]# echo nop > current_tracer
[root@qemu_imx6ul:/tracing]# echo wakeup > current_tracer 
[root@qemu_imx6ul:/tracing]# echo 1 > tracing_on 
[root@qemu_imx6ul:/tracing]# cat trace | head -40
# tracer: wakeup
#
# wakeup latency trace v1.1.5 on 4.9.88-g8f6c88def
# --------------------------------------------------------------------
# latency: 9671 us, #4/4, CPU#0 | (M:preempt VP:0, KP:0, SP:0 HP:0 #P:1)
#    -----------------
#    | task: kworker/0:0H-5 (uid:0 nice:-20 policy:0 rt_prio:0)
#    -----------------
#
#                  _------=> CPU#            
#                 / _-----=> irqs-off        
#                | / _----=> need-resched    
#                || / _---=> hardirq/softirq 
#                ||| / _--=> preempt-depth   
#                |||| /     delay            
#  cmd     pid   ||||| time  |   caller      
#     \   /      |||||  \    |   /         mmcqd/1-104     0dn.5  620us#:    104:120:R   + [000]     5:100:R kworker/0:0Hmmcqd/1-104     0dn.5 3595us#: 0mmcqd/1-104     0d..3 8687us!: __schedulemmcqd/1-104     0d..3 8984us :    104:120:R ==> [000]     5:100:R kworker/0:0H

2.3 使用wakeup_rt

non-RT进程通常看平均延迟。RT进程的最大延迟非常有意义,反应了调度器的性能

2.4 event

event在ftrace中是一种低性能损耗,获取debug信息的一种信息输出机制。相对于printk,它有如下特点:

  • 无需重新编译内核
  • 不开启无性能损耗
  • 开启不影响流程

event在ftrace中的events目录下:
在这里插入图片描述

事件以目录的形式作为主体,目录中的文件作为事件的属性。每个目录中都有一个enable文件,用于使能这个或者这类事件。

[root@qemu_imx6ul:/tracing/events/sched]# cd sched_switch
[root@qemu_imx6ul:/tracing/events/sched/sched_switch]# ls
enable   filter   format   id       trigger
[root@qemu_imx6ul:/tracing]# echo 1 > events/sched/sched_wakeup/enable
[root@qemu_imx6ul:/tracing]# echo nop > current_tracer
[root@qemu_imx6ul:/tracing]# cat trace | head -40
# tracer: nop
#
# entries-in-buffer/entries-written: 483/483   #P:1
#
#                              _-----=> irqs-off
#                             / _----=> need-resched
#                            | / _---=> hardirq/softirq
#                            || / _--=> preempt-depth
#                            ||| /     delay
#           TASK-PID   CPU#  ||||    TIMESTAMP  FUNCTION
#              | |       |   ||||       |         |sh-176   [000] dns3 31291.656047: sched_wakeup: comm=rcu_preempt pid=7 prio=120 target_cpu=000sh-176   [000] dns2 31291.661390: sched_wakeup: comm=ksoftirqd/0 pid=3 prio=120 target_cpu=000sh-176   [000] dns2 31291.714298: sched_wakeup: comm=rcu_preempt pid=7 prio=120 target_cpu=000sh-176   [000] dns2 31291.722990: sched_wakeup: comm=ksoftirqd/0 pid=3 prio=120 target_cpu=000<idle>-0     [000] dnh4 31292.612645: sched_wakeup: comm=kworker/u2:0 pid=6 prio=120 target_cpu=000<idle>-0     [000] dns4 31292.619844: sched_wakeup: comm=kworker/0:2 pid=102 prio=120 target_cpu=000<idle>-0     [000] dns3 31292.621198: sched_wakeup: comm=ksoftirqd/0 pid=3 prio=120 target_cpu=000kworker/u2:0-6     [000] dn.3 31292.633752: sched_wakeup: comm=sh pid=176 prio=120 target_cpu=000<idle>-0     [000] dnh3 31293.270182: sched_wakeup: comm=init pid=1 prio=120 target_cpu=000

3. trace-cmd

每次如果都是通过读写文件的方式使用ftrace就太复杂了,这个过程可以通过命令行的形式完成,实现这个功能的软件是:trace-cmd

常用子命令用法
start开始追踪
stop停止追踪
clear清空追踪结果
show查看缓冲区的追踪结果
reset停止内核追踪并清空缓存
report从trace.dat读取trace
record记录追踪事件到trace.dat
list列出可用的事件、选项、追踪器等

list:

  • -t:查看可用的追踪器
  • -e:查看可追踪的事件
  • -f:查看可追踪的函数
[root@qemu_imx6ul:~]# tmd list -f | grep do_sys_open
do_sys_open
[root@qemu_imx6ul:~]# tmd list -f | wc -l
31103
[root@qemu_imx6ul:~]# cat /tracing/available_filter_functions  | wc -l
31103

record:

  • -P {pid}:指定进程
  • -p {avalilable_tracers}:指定追踪器
  • -l {function}:指定要追踪的函数
  • -g {function}:指定要追踪的函数(For graph function)
  • --max-graph-depth 5:指定追踪的函数调用深度
  • -c -F:追踪子进程

例如:

[root@qemu_imx6ul:~]# trace-cmd start -p function
[root@qemu_imx6ul:~]# trace-cmd record -p function_graph -g do_sys_open -O funcgraph-proc ls
[root@qemu_imx6ul:~]# trace-cmd report | head -40
cpus=1trace-cmd-551   [000] 72595.333330: funcgraph_entry:                   |  do_sys_open() {trace-cmd-551   [000] 72595.493349: funcgraph_entry:                   |    getname() {trace-cmd-551   [000] 72595.493856: funcgraph_entry:                   |    gic_handle_irq() {trace-cmd-551   [000] 72595.495327: funcgraph_entry:                   |      __handle_domain_irq() {......

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/news/781764.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

C语言例1-11:语句 while(!a); 中的表达式 !a 可以替换为

A. a!1 B. a!0 C. a0 D. a1 答案&#xff1a;C while()成真才执行&#xff0c;所以!a1 &#xff0c;也就是 a0 原代码如下&#xff1a; #include<stdio.h> int main(void) {int a0;while(!a){a;printf("a\n");} return 0; } 结果如…

JUC:Monitor 与 Java对象头的内容与锁关系

文章目录 Monitorjava对象头Monitor&#xff08;锁、管程&#xff09; Monitor java对象头 普通对象 Mark Word 主要用来存储对象自身的运行时数据、klass word就是指向该对象的类型。 数组对象 mark word 不同对象状态下结构和含义不同。 Monitor&#xff08;锁、管…

SRS OBS利用RTMP协议实现音视频推拉流

参考&#xff1a;https://ossrs.net/lts/zh-cn/docs/v5/doc/getting-started 1&#xff09;docker直接运行SRS服务&#xff1a; docker run --rm -it -p 1935:1935 -p 1985:1985 -p 8080:8080 registry.cn-hangzhou.aliyuncs.com/ossrs/srs:5运行起来后可以http://localho…

Vuex工作机制

知识点 vuex 官网介绍 题目 vuex的数据流向&#xff1f;vuex整个触发过程&#xff08;actions&#xff0c;state&#xff0c;view&#xff09;&#xff1f; vuex的工作原理&#xff1f; 答案 Vuex的数据流是组件中触发action&#xff0c;action提交mutations&#xff0c;m…

【AI面试】YOLO 如何通过 k-means 得到 anchor boxes的?Yolo、SSD 和 faster rcnn 的正负样本定义

如果你的项目中有目标检测相关的内容,那么本篇内容就一定要好好看看。不会的看到了理解下,会的看看是不是和自己理解的一样。 一、YOLO 如何通过 k-means 得到 anchor boxes的? YOLOv2 和 YOLOv3是目标检测领域中非常流行的算法,它们都使用了anchor boxes来提高检测的准确…

数据恢复宝典:揭秘分区合并后的数据拯救之路

在计算机存储管理中&#xff0c;分区合并是一项常见的硬盘操作。它通过将两个或多个相邻的磁盘分区合并成一个更大的分区&#xff0c;来扩展存储空间或简化磁盘管理。然而&#xff0c;这个看似简单的操作背后&#xff0c;却隐藏着数据丢失的巨大风险。许多用户在尝试分区合并时…

ElementUI表格table组件实现单选及禁用默认选中效果

在使用ElementUI&#xff0c;需要ElementUI表格table组件实现单选及禁用默认选中效果, 先看下效果图&#xff1a; 代码如下&#xff1a; <template><el-tableref"multipleTable":data"tableData"tooltip-effect"dark"style"widt…

云原生应用(5)之Dockerfile精讲及新型容器镜像构建技术

一、容器与容器镜像之间的关系 说到Docker管理的容器不得不说容器镜像&#xff0c;主要因为容器镜像是容器模板&#xff0c;通过容器镜像我们才能快速创建容器。 如下图所示&#xff1a; Docker Daemon通过容器镜像创建容器。 二、容器镜像分类 操作系统类 CentOS Ubuntu 在…

深入理解element-plus table二次封装:从理论到实践的全面指南

前言 在许多中后台管理系统中&#xff0c;表格占据着半壁江山&#xff0c;如果使用element plus组件库&#xff0c;那么少不了要用到table组件&#xff0c;可是table组件的功能过于基础&#xff0c;因此&#xff0c;我在table组件的实现基础之上进一步封装&#xff0c;从而实现…

安卓工控一体机主板定制_联发科MTK平台解决方案

新移科技安卓工控一体机方案基于MT8766主芯片&#xff0c;采用四核 Cortex-A53 CPU&#xff0c;搭载Android 12.0系统&#xff0c;主频高达2.0GHz&#xff0c;具有低功耗和高性价比的优势。搭载ARM IMG GE8300 高性能GPU和4G全网通版本的RF&#xff0c;网络连接稳定快速。 可直…

vue 侦听器(二)

即时回调的侦听器 watch 默认是懒执行的&#xff1a;仅当数据源变化时&#xff0c;才会执行回调。但在某些场景中&#xff0c;我们希望在创建侦听器时&#xff0c;立即执行一遍回调。举例来说&#xff0c;我们想请求一些初始数据&#xff0c;然后在相关状态更改时重新请求数据…

【Node.js】图片验证码识别

现在越来越多的网站采取图片验证码&#xff0c;防止机器恶意向服务端发送请求。但是常规的图片验证码也不是非常安全了。有非常多第三方库可以对图片上的数字文字等进行识别。 代码实现 首先安装依赖&#xff1a; npm install node-native-ocrnpm&#xff1a;(node-native-oc…

经验分享:开源知识库才是企业低成本搭建的最佳选择!

身为企业所有者的你&#xff0c;是否为建设企业的知识库而头疼&#xff1f;想要一个功能全面而又简单易用的知识库&#xff0c;但又担心成本过高&#xff1f;那我今天要分享的内容&#xff0c;可能会给你带来一些启示。那便是&#xff1a;开源知识库便是你企业低成本搭建的最佳…

mysql null和空值的区别

null 也就是在字段中存储null值&#xff0c;空值也就是字段中存储空字符(‘’) 占用空间的区别 执行sql&#xff1a;mysql> select length(NULL), length(‘’), length(‘1’); 空值’是不占用空间的&#xff0c;而null的长度是null&#xff0c;其实是占用空间的。mysql…

单元测试(UT)用例简介

单元测试&#xff08;Unit Testing, UT&#xff09;用例是一系列预先设计好的、针对软件最小可测试单元的测试场景。每一个单元测试用例都是为了验证一个独立代码单元&#xff08;如函数、方法、类&#xff09;的行为是否符合预期。这些用例通常包含以下几个关键组成部分&#…

Tron波场区块链 | 使用Java将Tron钱包助记词转私钥 全网独门一份

如何使用Java将Tron钱包助记词转换为私钥? 本来想着这个问题挺简单&#xff0c;可是查了半天&#xff0c;不是&#xff0c;不止半天查了好长时间&#xff0c;看了半天官网文档&#xff0c;全网Java就没有实现的。 咋办。。。咋办呢&#xff1f; 好巧&#xff0c;官网我看到…

.Net Web窗口页属性

<%Page %> Page 指令定义 Web 窗体使用的属性&#xff0c;这些属性将被 Web 窗体页分析器和编译器使用。只能包含在 .aspx 文件中。我们每新建一个 Web 页面时&#xff0c;系统会自动为该 Web 页面头部创建一个 Page 指令&#xff0c;来指明页面最基本的属性。 Langu…

ARM-按键中断实验

代码 #include "stm32mp1xx_gic.h" #include "stm32mp1xx_exti.h" extern void printf(const char *fmt, ...); unsigned int i 0; void do_irq(void) {//获取要处理的中断的中断号unsigned int irqnoGICC->IAR&0x3ff;switch (irqno){case 99:pr…

C++奇迹之旅(三):缺省参数与函数重载

文章目录 &#x1f4dd;缺省参数分类&#x1f320; 缺省参数概念&#x1f309;缺省参数分类 &#x1f320;全缺省参数&#x1f309;半缺省参数 &#x1f320; 函数重载&#x1f309; 函数重载概念&#x1f320;参数类型不同&#x1f320;参数个数不同&#x1f320;参数类型顺序…

SpringWebFlux初步认识

反应式编程的认识 基础认识 命令式编程&#xff1a;后一行代码需要等待前一行代码执行完毕&#xff0c;也就是后面的执行任务步骤依赖于前面的执行任务。 反应式编程&#xff1a; 定义了一组如何处理数据的任务&#xff0c;这些任务是可以并行进行的&#xff0c;可以在处理数…