我是如何将 Claude Code Token 用量削减 60% 并得到更好输出的
来源:dev.to — 2026-07-31
📋 概述
作者发现两个关键习惯导致 token 浪费:将 Claude Code 会话当作持久工作区(上下文窗口累积数小时的失败尝试和已解决的错误)和使用模糊提问(引发模型反复确认和猜测)。解决方案是在每次实质性会话前写五行精确的任务描述(目标、相关文件、约束条件、已失败方案、预期输出),并在长会话中主动重置上下文。
🔑 核心要点
- 上下文窗口管理:不要将 Claude Code 会话当作全天候的共享工作区——过时的失败尝试会污染当前推理
- 五行任务描述:每次会话前写 objective、relevant files、constraints、what already failed、expected output
- 主动重置会话:在关键里程碑后或上下文变得混乱时主动开启新会话,保持"选择性连续性"
- 模糊提问的代价:"你觉得这个方案怎样?"引发模型猜测和反复确认,大幅增加 token 消耗
- 输出质量提升:清理上下文后的输出更精确——"上下文中的熵产生响应中的熵",这个关系始终成立
💡 金句
Entropy in the context produces entropy in the response. That relationship is consistent.
👍 0
👎 0
← 返回 Dev.to 首页