前沿模型的真实定价
来源:playcode.io — 2026-07-13
📋 概述
Token 不是固定大小的文本单位——各厂商的分词器对同一段代码切出的 token 数量差异巨大。Playcode 实测发现,同样的 TypeScript 代码在 Claude 新分词器下比 GPT 多出 73% 的 token,这意味着标注的 $/Mtok 价格完全不可直接比较。Anthropic 的新分词器(Sonnet 5/Opus 4.8/Fable 5)比旧版多产生约 30% 的 token,而标价未变,实际每请求成本大幅上升。在真实的 Agent 工作负载中——混合了系统提示词、工具 schema、代码和 JSON——这一差距会让账单悄然膨胀 40% 以上。
🔑 核心要点
- 同样的 2,888 字符 TypeScript 文件:GPT-5.x 仅 681 token,Claude 新分词器高达 1,178 token(+73%)
- Claude 新老分词器对比:系统提示词(42,661 字符)膨胀 +39%,TypeScript +31%,Rust +29%
- 在真实场景中,Opus 4.8 的 $5/$25 标价等效于 $7.50/$37.50,Sonnet 5 优惠期后等效 $4.50/$22.50
- 测试覆盖 16 种真实负载:英文散文、HTML、JS/Python/TS/Rust/JSON/中文——使用各厂商官方 token 计数端点验证
- 中文字符是个例外:新旧分词器对中文的处理几乎无差异(~0%),这是 tokenizer 切换后唯一"持平"的语言
- 作者指出这只是 输入 token 的差异,输出冗长程度、thinking 模式、缓存策略会让整任务账单进一步偏离
💡 金句
同样的 TypeScript 代码,在 Claude 上比 GPT 贵 73%——不是因为标价更高,而是因为每行代码被切成了更多块。$ / Mtok 这个数字本身就是一层面纱。
← 返回 HN 首页