dev.to | 📄 原文链接 | 2026-09-17 收录

12 KB 里数清一千亿件事:HyperLogLog

来源:dev.to — 2026-09-16

📋 概述

作者用一个面试场景解释 HyperLogLog:若用哈希集合对上千亿请求 ID 精确去重,需要约 1TB 内存,或者干脆拆成四十台机器分片,为了回答「今天有多少不同的人来过」而维护一整套分布式系统。HyperLogLog 主动放弃精确性,用一组寄存器加调和平均数,把内存固定在约 12 KB。

🔑 核心要点

💡 金句

出路不是更大的哈希集合,而是有意识地放弃「精确」。
← 返回 dev.to 首页