Posted in 问题排查与答疑为什么BenchmarkSortParallel比单线程慢?——NUMA节点跨区访问+cache line伪共享的perf trace实证 第一章:Golang数据排序 G … 为什么BenchmarkSortParallel比单线程慢?——NUMA节点跨区访问+cache line伪共享的perf trace实证Read more by Gopher老张|2026年4月24日|GOMODCACHE目录清理, line伪共享, NUMA节点绑定, perf调优脚本, 分布式TraceID注入, BenchmarkSortParallel, 跨区访问