本文用系统工程师熟悉的存储层次来重新理解 AI 的记忆架构:上下文窗口是 CPU 缓存(执行面而非存储面),活跃工作记忆是 RAM(检索文档和工具结果),持久记忆是文件系统(有意写入的决策和知识),推理账本是 git 历史(包含修正和修订链),写入端托管是监管链(可归属、可验证、不可篡改)。作者指出将上下文窗口当作记忆来用是架构层面的错误——如同期望 CPU 缓存替代文件系统,只在进程退出前有效。
🔑 核心要点
上下文窗口 = CPU 缓存:它是推理执行面而非持久存储。推理完成后状态消失,除非其他组件主动保存。