Lobsters | 📄 原文链接 | 2026-08-09 收录

汇编耻辱堂:反向竞赛,寻找单条指令的性能地板

来源:github.com — 2026-08

📋 概述

Chris Domas(xoreaxeaxeax)发起了一个反其道而行之的竞赛:传统指令延迟分析追求让代码跑得最快,而这个"Assembly Hall of Shame"专门寻找单条指令性能的绝对下限——即让一条指令尽可能慢。目前 x86 冠军是 fxrstor64,通过从高延迟的 PCIe MMIO 区域加载 512 字节 FPU/MMX/XMM 状态,并用一群"锤子核心"饱和 PCIe 根复合体,让这条指令创下约 1980 亿周期、耗时 62 秒的记录。项目还收录了 nop、rdtsc、idiv、enter 等指令按最慢程度的排行榜,并有严格规则(指令不可被中断、需工厂默认配置等)。

🔑 核心要点

💡 金句

我们寻找单指令性能的绝对下限——让一条指令慢到不能再慢。
← 返回 Lobsters 首页