来源:dank.systems — dank.systems · 390 分 · by jaykru
📋 概述
作者列出几条论点:前沿实验室的估值建立在「很快能替代多数知识工作者」的叙事上,但现实中的前沿模型即使在最简单的任务上也需要大量监督与护栏;模型只在与训练任务近邻的区域内泛化,任务稍有扰动就会彻底失败或开始刷奖励;刷奖励问题只能靠领域专家的严格规格化来解决,而领域专家本身昂贵,规格化又是一项独立技能,两者的交集极小。他引用硬件工程的经验:一个典型 CPU 项目里规格与验证工程师人数约是设计工程师的三倍,五比一也不罕见。