我现在(多半)按速度选模型,而不是智商
来源:martinalderson.com — 2026-08-02
📋 概述
作者第一次不是按“原始智商”而是按“速度”挑选日常使用的模型。他认为 ~Opus 4.6 级别的模型已足够聪明,够用就好;而快的软件用起来舒服得多,100-200tok/s 是人的舒适区间。开放权重生态让 GLM5.2、DeepSeek V4 Flash 等“足够好”的模型既快又便宜,价格战已打响。但受 Amdahl 定律约束,模型提速的收益会被工具调用和人的审查所吞噬。
🔑 核心要点
- ~Opus 4.6 级别的模型已“足够聪明”,够应付多数日常任务
- 100-200tok/s 是人体感舒适的区间,快比“聪明”更影响使用体验
- GLM5.2、DeepSeek V4 Flash 等开放权重“足够好”模型又小又快又便宜
- 价格战已打响,GLM5.2 已是 Opus 的 5%,OpenRouter 上提供商的吞吐差异巨大
- 受 Amdahl 定律约束:模型快 5 倍只让单次 agent 回合快 2 倍,瓶颈转移到工具调用与人工审查
- 2027 年很可能出现合理价格的 500tok/s+ 优质模型
💡 金句
对一个 turn 而言,模型 5 倍速只换来 2 倍速,因为另外那 25 秒根本没动。
👍 0
👎 0
← 返回 Lobsters 首页