Claude Messages API 思考块新增一致性约束
Anthropic 调整 Claude Messages API 思考块机制。受影响账户复用思考块必须保持系统提示、工具和消息一致,否则报错;非严格模式可删除不匹配块。新规先覆盖 2026 年 8 月 31 日后创...
Anthropic 调整了 Claude Messages API 处理思考块的方式,目标是防止模型推理被用于非法蒸馏。对于受影响账户,多轮对话返回此前的思考块时,必须同时保持生成该思考块时的系统提示、工具和消息不变,否则 API 会报错。

开发者也可以启用“非严格”模式。此时系统会删除不匹配的思考块,再继续请求,而不是直接失败。这条路径为缓存或重放请求提供了兼容性,但可能影响推理连续性。
Anthropic 给出的理由是,修改早期上下文可以被用来诱导模型解密并输出推理,这是工业规模非法蒸馏的一种手段。把思考块与生成它的上下文绑定,可以减少这类诱导链路。
新机制按账户创建时间分阶段推进。目前适用于 2026 年 8 月 31 日及以后创建的 Fable 5.1 新 API 账户,未来模型版本将扩展至所有账户。因此在同一系统中,新老账户可能面临不同策略,历史请求重放、故障恢复和缓存设计都需要适配。
对依赖思考块重放做调试、评测或缓存加速的流程,需要重新评估兼容性。严格模式可能让原本可复用的历史请求直接失败,开发侧要把错误处理纳入重试逻辑。非严格模式更适合不强制保留完整上下文的轻量场景。
工程上,缓存思考块时应把系统提示、工具和消息序列纳入缓存键。严格模式要求完全一致;非严格模式降低了门槛,但需要测试回复质量和推理连续性。目前 Anthropic 未披露受影响账户的判定标准、具体错误码,以及非严格模式对延迟、费用和质量的影响,落地前仍需核实。


