Qwen 3.8 27B 很出色,但默认把一切想得「太过头」
来源:simonwillison.net — 2026-08-16
📋 概述
Simon Willison 实测阿里开源的 Qwen 3.8 27B(Apache 2,27B 参数、带视觉),发现它能力出色——一个 17GB 的文件就能跑起编码代理、标注边界框、生成精良 SVG——但默认的 xhigh 推理档位导致「灾难性的过度思考」:让它画个圆圈都能沉思数分钟再产出一个花哨动画。他的强烈建议是:先把推理档位降到 low 或关掉,别用默认值。
🔑 核心要点
- xhigh 是默认档位,对消费者硬件完全不是好起点,会耗尽 8K 上下文并狂烧推理 token。
- 同一提示在开/关推理时差异显著:开时 21 分钟产出精良 SVG,关时 2 分钟完成但质量略逊。
- 它很擅长 bounding box:一张图里的鹈鹕框标得极其准确。
- 可驱动 编码代理(如 Pi),长上下文+工具调用+代码生成三者兼备。
- 启动 Multi-Token Prediction(llama.cpp 的 draft-mtp)后吞吐提升约 72%。
- 唯一短板是速度(15-30 tok/s),但仍证明 17GB 开权重模型已是可行本地方案。
💡 金句
17GB 的一个文件,就能在我家里那台机器上干这么多事——这简直是奇迹。
👍 0
👎 0
← 返回 Lobsters 首页