perf stat → 统计计数:IPC、Cache Miss、分支预测
perf record/report → 采样:哪个函数最占 CPU
perf top → 实时监控:线上救火
perf c2c → 伪共享检测:多线程性能不线性扩展时
核心优化思路:
IPC < 1 → 看 Cache Miss / 分支预测
Cache Miss 高 → 改数据结构(连续内存/对齐)
分支预测差 → 排序/分支消除/[[likely]]
perf stat → 统计计数:IPC、Cache Miss、分支预测
perf record/report → 采样:哪个函数最占 CPU
perf top → 实时监控:线上救火
perf c2c → 伪共享检测:多线程性能不线性扩展时
核心优化思路:
IPC < 1 → 看 Cache Miss / 分支预测
Cache Miss 高 → 改数据结构(连续内存/对齐)
分支预测差 → 排序/分支消除/[[likely]]