function_graph的工作原理是什么,怎么用

function_graph是Linux内核内置的ftrace追踪器之一,能够以图形化方式展示函数调用链和耗时,是性能调优和问题定位的利器。

什么是function_graph?为什么它值得关注

function_graph是ftrace框架下的一个tracer,专门用于记录内核函数的进入和退出事件,它通过缩进和耗时标注,直观呈现函数调用层次和每层执行时间,相比传统的printk或手动打点,function_graph可以在不修改内核代码的情况下,快速摸清代码路径和性能瓶颈。

考研英语“天坑词”function除了“功能;职务”外,你还知道别的意思吗?
加载中
考研英语“天坑词”function除了“功能;职务”外,你还知道别的意思吗?

核心工作原理

function_graph在内核函数入口处插入钩子,记录调用深度和时间戳;在出口处再次记录,计算实际耗时,输出结果中,每一层缩进代表一个函数调用,右侧的数字是该函数执行时间(微秒级),这种机制让开发者一眼看清“时间花在了哪里”。

典型应用场景

  • 内核驱动开发:验证驱动程序的行为是否符合预期,例如检查中断处理函数是否过度占用CPU。
  • 启动优化:分析内核启动阶段各子系统的初始化顺序和耗时,定位拖慢启动的模块。
  • 性能抖动排查:当系统出现偶发卡顿,利用function_graph追踪特定进程的内核调用,寻找异常延迟点。

function_graph怎么用?从配置到实战

前提条件:内核配置

function_graph依赖ftrace支持,大部分发行版默认启用,若需确认,可检查内核配置是否包含CONFIG_FUNCTION_GRAPH_TRACER=y,在/boot/config-$(uname -r)中搜索该选项即可。

启用与基本操作

通过tracefs虚拟文件系统控制,挂载点通常在/sys/kernel/tracing/sys/kernel/debug/tracing,以下命令序列是典型流程:

# 挂载tracefs(如未挂载)
mount -t tracefs nodev /sys/kernel/tracing
# 选择function_graph tracer
echo function_graph > /sys/kernel/tracing/current_tracer
# 开始追踪
echo 1 > /sys/kernel/tracing/tracing_on
# 等待一段时间或复现问题,然后停止
echo 0 > /sys/kernel/tracing/tracing_on
# 查看结果
cat /sys/kernel/tracing/trace

function_graph的工作原理是什么,怎么用

输出示例:

 1)               |  do_sys_open() {
 1)               |    getname() {
 1)   0.910 us    |      kmem_cache_alloc();
 1)   0.210 us    |      __check_object_size();
 1)   2.500 us    |    }
 1)   0.130 us    |    file_open();
 1)   5.200 us    |  }

缩进代表调用深度,右侧数字是函数执行时间,后的空格数表示层级。

进阶技巧:过滤和追踪特定进程

按函数名称过滤

只追踪某个函数及其子调用,避免输出过多:

echo do_sys_open > /sys/kernel/tracing/set_graph_function

按进程过滤

追踪特定PID的调用:

echo 1234 > /sys/kernel/tracing/set_ftrace_pid

排除不关心的函数

使用set_graph_notrace排除一些高频且无价值的函数(如printkspin_lock等),减少噪音。

使用trace-cmd简化操作

trace-cmd是ftrace的前端工具,封装了上述文件操作,更直观:

# 记录function_graph追踪,持续10秒
trace-cmd record -p function_graph -O graph-time -l do_sys_open sleep 10
# 查看结果
trace-cmd report

-l指定只追踪的函数,-O graph-time输出时间信息,这种方式适合自动化脚本和长时间抓取。

function_graph性能分析最佳实践

识别热点函数

在高负载场景下,开启function_graph后,观察哪些函数耗时占比最大,较深的缩进和较大的时间值意味着潜在的优化点,在网络驱动中,若hard_start_xmit函数耗时异常,多数情况下是锁竞争或硬件响应慢。

分析内核态延迟

当用户态程序响应变慢,但CPU使用率不高,问题可能在等待内核资源,可以通过function_graph追踪该进程的内核调用,检查mutex_lockwait_event等函数的等待时间,如果schedule()函数频繁出现且耗时较长,说明进程被频繁切换,需要调整调度策略或减少锁持有时间。

function_graph的工作原理是什么,怎么用

结合trace_hwlat检测硬件干扰

function_graph可以与硬件延迟检测器配合使用,先通过echo hwlat > current_tracer确认硬件是否存在异常中断,再切换回function_graph追踪具体受影响的内核路径,行业共识认为,这种组合排查方式是解决系统抖动问题的高效套路。

function_graph与其他追踪工具有何不同?

与perf对比

  • perf:基于硬件计数器和采样,适合宏观性能统计(如CPU周期、缓存命中率),但函数级调用链信息不如function_graph精细。
  • function_graph:提供完整的调用树和精确时间,适合微观行为分析,但开销较大(所有函数入口出口都插桩),不适合长时间全量开启。

与strace对比

  • strace:追踪用户态系统调用,不深入内核内部。
  • function_graph:追踪内核函数,包括系统调用内部实现,例如do_sys_open内部的路径,两者互补,排查用户态问题用strace,内核态问题用function_graph。

与systemtap对比

  • systemtap:需要编写脚本,动态插桩,灵活性高但学习曲线陡峭。
  • function_graph:无需脚本,简单配置即可使用,适合快速验证和初步定位。

选择建议

  • 快速定位内核函数调用顺序:function_graph
  • 分析CPU热点和硬件事件:perf
  • 追踪用户态系统调用:strace
  • 复杂自定义探针:systemtap

function_graph使用注意事项

性能开销

function_graph在每个内核函数入口和出口插入探测点,会显著增加系统开销,根据内核版本和硬件,整体性能可能下降10%-30%。生产环境建议仅在短时间、低负载下使用,或通过set_graph_notrace排除高频函数

缓冲区溢出

默认的trace buffer较小,长时间追踪可能导致输出被截断,可通过

function_graph的工作原理是什么,怎么用

echo 8192 > /sys/kernel/tracing/buffer_size_kb调整缓冲区大小,8192表示8MB,可根据内存容量适当增大。

内核版本差异

  • 内核版本<3.0:function_graph可能不支持某些架构(如ARM的早期版本)。
  • 内核版本>=4.0:支持更完善的过滤机制和trace-cmd集成。
  • 内核版本>=5.10:引入osnoise追踪器,与function_graph配合可进一步增强实时性分析。

读trace输出时注意时间单位

默认时间单位为微秒(us),但部分内核配置下可能显示为纳秒(ns),可通过echo 0 > /sys/kernel/tracing/trace_options关闭latency-format,确保输出一致。

function_graph是内核开发者手中最直观的调用链分析工具,能快速缩小问题范围,避免盲目加日志,搭配过滤器和trace-cmd,即可在复杂场景中高效定位性能瓶颈。

function_graph常见问题解答

function_graph怎么使用?

/sys/kernel/tracing目录下,先设置current_tracerfunction_graph,然后开启tracing_on,停止后读取trace文件,也可以使用trace-cmd record -p function_graph一键操作,推荐先用set_graph_function指定目标函数,避免输出过多。

function_graph和perf的区别是什么?

function_graph追踪函数调用树和精确时间,适合微观路径分析;perf基于采样,适合宏观性能统计,两者定位不同,function_graph更侧重“谁调用了谁,花了多久”,而perf侧重“什么代码消耗了最多CPU”,排查具体内核函数行为时首选function_graph,分析系统整体性能分布时选perf。

function_graph能追踪用户态吗?

不能,function_graph只追踪内核态函数,包括系统调用内部实现,若需用户态函数调用链,应使用gprof、perf的用户态采样或动态插桩工具(如uprobes),function_graph可以配合set_ftrace_pid追踪特定进程的内核调用,但无法进入用户态代码。

首发原创文章,作者:王坚‌,如若转载,请注明出处:https://test.idctop.com/article/511629.html

(0)
ftp服务器文件能直接打开吗,怎么打开文件?
上一篇 2026年7月22日 11:49
CDN证书是什么?,怎么免费申请CDN证书
下一篇 2026年7月22日 11:52

相关推荐

  • 服务器套CDN配置步骤是什么?,配置注意事项有哪些?

    服务器套CDN是指将服务器与CDN服务结合使用,通过边缘节点缓存来加速网站访问、降低源站负载,是目前网站加速的主流方案,服务器套CDN是什么?核心原理与价值服务器与CDN如何协同工作CDN的本质是分布式缓存网络,当用户发起请求时,DNS解析将请求指向最近的CDN节点,如果节点有缓存则直接返回,没有则向源站服务器……

    2026年7月24日
    1200
  • CDN出现问题怎么解决?CDN加速访问慢怎么办

    CDN加速失效通常源于源站配置错误、节点调度异常或HTTPS证书过期,排查时需优先检查DNS解析记录与源站响应状态,多数情况下通过刷新缓存或修正回源规则即可解决,分发网络(CDN)作为现代网站架构的基石,其稳定性直接决定了用户体验与业务转化,当CDN出现访问缓慢、404错误或加载失败时,往往让运维人员感到头疼……

    2026年6月17日
    5100
  • www.cdn.so是什么平台?cdn.so加速服务安全吗

    cdn.so 作为新一代智能内容分发网络,其核心价值在于通过边缘计算节点实现毫秒级响应,显著降低服务器负载并提升全球访问速度,是解决高并发场景下网站卡顿问题的最优解,在数字化转型的深水区,网站加载速度直接决定了用户的留存率,当用户点击链接后的前三秒内页面未能完全呈现,超过半数的人会选择离开,这种“秒开”体验不再……

    2026年6月24日
    1610
  • cdn阻断url怎么解决,cdn阻断url

    CDN阻断URL是指通过内容分发网络的访问控制功能,主动拦截特定资源链接的请求,以应对恶意爬虫、资源盗链或突发流量攻击,其核心在于利用边缘节点策略实现毫秒级响应与流量清洗,在2026年的Web生态中,随着AI生成内容(AIGC)的爆发式增长,非人类流量的占比已突破40%,传统的WAF(Web应用防火墙)已难以单……

    2026年6月5日
    4200
  • 服务器热备盘配置的详细步骤是什么?, 如何配置

    服务器热备盘配置的核心在于为RAID阵列预留一块或几块空闲硬盘,当阵列中某块硬盘出现故障时,系统自动将热备盘顶替上去,重建数据并恢复冗余,从而避免业务中断和数据丢失,热备盘怎么配置?核心步骤与注意事项配置热备盘并没有想象中那么复杂,关键是掌握正确的前置条件和操作路径,绝大多数服务器主板集成的RAID控制器(如L……

    2026年7月29日
    1200
  • 服务器集群书推荐哪几本最经典?如何快速搭建高可用服务器集群

    选服务器集群书没有万能的“一本通”,但按角色和场景匹配去选,才是最高效的路径,市面上的集群类书籍少说上百本,从入门科普到源码级剖析都有,但多数人买错不是因为书不好,而是没想清楚自己到底是学运维、学开发,还是学架构,这篇文章把选书逻辑、核心知识点和实操路径一次讲透,服务器集群入门学什么:先分清书里的“骨”和“肉……

    2026年8月7日
    300
  • 又拍云cdn咋样,又拍云cdn好用吗

    又拍云CDN在2026年的综合表现属于行业第一梯队,特别适合对图片存储、小文件加速及静态资源分发有高频需求的企业,其“存储+CDN”一体化架构在成本效益与稳定性上显著优于传统纯分发厂商,但针对超大视频流媒体或全球复杂网络环境,需结合具体业务场景评估其边缘节点覆盖的极致深度,在2026年的数字内容分发市场中,又拍……

    2026年5月18日
    4200
  • cdn服务商国内哪家好?国内cdn服务商排名推荐

    2026 年国内 cdn 服务商选择的核心结论是:对于高并发、强合规的国内业务,必须优先选择持有 ICP 备案资质且具备国家级骨干网直连能力的头部厂商,如阿里云、腾讯云或网宿科技,以规避备案延迟与节点覆盖不足的风险,2026 年国内 CDN 市场格局与核心指标进入 2026 年,国内 CDN 市场已从单纯的“价……

    2026年5月11日
    6400
  • cdn会员策略是什么,cdn会员怎么买

    CDN会员策略的核心在于从“带宽计费”转向“资源包+动态调度”的混合模式,2026年最优解是选择支持边缘计算集成、具备AI流量预测能力且覆盖全球主要节点的商业级CDN服务,而非单纯追求低价的入门级套餐,随着2026年Web 3.0应用、高清直播及AI大模型推理需求的爆发,传统CDN已无法满足低延迟与高并发的双重……

    2026年6月3日
    2800
  • cdn公司运维怎么做?cdn运维外包费用及流程详解

    CDN运维的核心在于通过智能调度降低延迟并保障高可用,其本质是构建一个分布广泛、响应迅速且具备自我修复能力的边缘计算网络,在2026年的互联网环境下,企业对于内容分发网络(CDN)的依赖已从单纯的“加速访问”升级为“全链路稳定性保障”,运维团队不再仅仅是盯着监控大屏看流量曲线,而是需要深入到底层架构,处理从源站……

    2026年6月26日
    2000

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注