Lobsters | 📄 原文链接 | 2026-08-18 收录

模型在「故意变笨」:用世界知识换取推理能力的交易

来源:w4g1.dev — 2026-08-17

📋 概述

作者观察到数学与代码基准一路飙升,而纯事实回忆(SimpleQA)却惨不忍睹——小模型幻觉率高达 80% 以上。这是刻意为之的交易:实验室在用「世界知识」换取「推理能力」。推理是可压缩的少量过程,蒸馏与 RL 能高效迁移;而事实会腐烂,且训练一次成本极高。于是知识被搬到运行时——检索、工具调用、文档——模型只负责推理。这让幻觉从「不可定位的权重错误」变成「可检查、可修正的数据 Bug」,也让端侧 20-40B 模型成为现实。

🔑 核心要点

💡 金句

当知识住在模型外,错误答案就有了地址:它引用文档,你就能打开文档去核对、去修正。
← 返回 Lobsters 首页