动察 Beating AI 快讯,Anthropic 给 Sonnet 5.5 的思考块又加了一层限制。现在模型生成的 thinking block 会和产生它的账号或组织绑定。用户在 Claude Code 等场景中途切换账号时,聊天记录可以继续,但原账号生成的 thinking 会被丢掉,Claude 需要根据现有对话重新推理。Anthropic 的 API 里已经加入 organization_binding_mismatch 和 end_user_binding_mismatch 等检查。
Anthropic 此前已经从 Fable 5.1 开始给 thinking 加「上下文锁」。系统提示词、工具或前面的消息被修改后,原来的 thinking 就可能失效。这次又增加账号绑定,主要防止攻击者批量切换账号,反复利用 Claude 已经生成的高质量推理做模型蒸馏。
Sonnet 5.5 还是首个配备防「推理抽取」分类器的 Sonnet。Anthropic 称,Sonnet 5.5 的能力比上一代高出很多,因此开始给它增加这类防蒸馏措施。分类器主要识别大规模套取 Claude 推理、用于训练其他模型的行为,普通开发者基本不会感受到变化。