HN | 📄 原文链接 | 2026-07-29 收录

Kimi Linear:一种表达性强且高效的注意力架构

来源:arxiv.org — 2026-07-29

📋 概述

Moonshot AI 团队发布 Kimi Linear 论文,提出一种新型线性注意力机制,在保持与标准 Softmax Attention 相近表达能力的同时,将长序列推理的计算复杂度从 O(n²) 降至 O(n)。该架构是 Kimi K3 模型长上下文能力的核心技术支撑,通过精心设计的核函数和归一化策略,解决了传统线性注意力在语言建模中表达能力不足的问题。

🔑 核心要点

💡 金句

注意力机制的 O(n²) 复杂性不是物理定律,而是一个设计选择。Kimi Linear 证明了,当我们足够聪明地重新排列计算顺序时,O(n) 同样可以表达丰富的上下文依赖。
← 返回 HN 首页