Sebastian Raschka 深入探讨了如何控制大语言模型的推理深度——即让模型在简单问题上快速回答、在复杂问题上「深思熟虑」。文章综述了从Chain-of-Thought到预算强制(Budget Forcing)等多种技术,分析了OpenAI o系列和Anthropic的扩展思考机制。核心洞见是:并非所有问题都需要深度推理,自适应地分配推理预算可以在成本和性能之间取得最优平衡。