dev.to | 📄 原文链接 | 2026-09-06 收录

Qwen 3.8 27B 对比 3.6 27B:同一架构,四个月,另一种升级

来源:dev.to — 2026-09-06

📋 概述

两款模型纸面几乎相同:同为稠密 27B、混合架构、262144 token 上下文、Apache 2.0 与同款视觉编码器。3.6-27B 四个月前发布时被誉为「本地开发的甜点位」,3.8-27B 上周发布后一天内登上 HN 榜首。真正的差异不在架构(两者 config 近乎相同)而在后训练:3.8 用更多数据与更强 agentic 轨迹强化学习,换来的是 agentic 与电脑使用任务上 20 分级的暴涨(OSWorld +20、WebArena +16、AndroidWorld +12),而纯推理进步有限。代价是 3.8 默认高推理档位爱过度思考、token 燃烧凶猛,社区口碑从「甜点位」翻转为「过度思考者」。结论一句话:3.8 是更强的模型,3.6 是更顺手的模型——做 agent 就升 3.8,做日常聊天补全则不必。

🔑 核心要点

💡 金句

诚实的总结是:3.8 是更强的模型,3.6 是更顺手的模型——一个是要被驯服的基准冠军,另一个是被验证过的日常主力。
← 返回 dev.to 首页