Claude Sonnet 5.5快30%以上:迁移却有五处破坏性变化

|作者: QUASA 编辑团队|2 分钟阅读
Claude Sonnet 5.5快30%以上:迁移却有五处破坏性变化

Anthropic于2026年9月28日推出Claude Sonnet 5.5;据Tom's Guide的发布报道,厂商称其输出生成速度比Sonnet 5快30%以上,API仍按每百万输入Token 2美元、输出Token 10美元计费,模型已进入Claude应用、Claude API及主要云平台。对日常使用者,更快的生成速度有望减少连续对话中的等待;对接入API的开发者,升级还取决于现有请求怎样使用思考和工具。

Claude Platform的Sonnet 5.5迁移指南列出从Sonnet 5升级Messages API代码时的五项破坏性变化:关闭前置思考的写法、强制工具调用、思考块复用、计算机使用工具版本和顾问工具配置。另有一项响应结构变化不会使请求失败,却可能让原本展示工具执行进度的流式界面停止显示中途说明。迁移范围因此要按应用实际使用的API能力判断。

生成更快,单次任务的账单仍取决于用量

速度提升针对模型生成输出的环节,不能直接换算成整段对话的耗时。一次请求还可能经历输入处理、模型思考、外部工具运行和网络传输;在反复调用工具的任务中,任何一个环节都可能决定最终等待时间。连续追问、改写或制作文档时,较快的输出更容易被用户感知,但复杂代理流程不会因此自动缩短同样比例。

每Token价格维持原水平,与完成一项任务的总成本是两件事。较少的输出Token或工具循环可以降低账单,但结果随任务、思考强度、缓存使用方式和应用提示而变。对已经按固定预算运行的服务,换模型后需要看实际Token消耗;只比较标价,无法判断同一工作流最后会花多少钱。

渠道也会影响升级工作量。Claude应用中的普通对话由产品处理请求结构;直接使用Messages API的应用则自己保存消息、传回工具结果并解析内容块。通过云平台调用时,模型已经可用,但计算机使用工具的兼容版本并不完全相同。把这些部署都视作一次简单的模型ID替换,容易漏掉只在特定平台出现的参数错误。

接近高端模型的成绩,有三种不同证据

Anthropic的发布数据与客户评价列出Artificial Analysis在预发布部署上进行的GDPval-AA v2.1评测:Sonnet 5.5为1844分,Opus 5.5为1846分;同页引述Balyasny Asset Management高级AI工程师Joe Poirier对其私有金融任务测试的评价,称它有“the best quality-to-cost tradeoff of the seven models we ran”。前一组分数来自规定条件下的职业任务评测,后一判断来自客户自己的任务集和模型比较,衡量的对象并不相同。

媒体作者对日常写作、整理资料和连续追问的偏好则属于个人上手体验。它能提示普通用户哪些交互可能更顺畅,不能替代统一条件下的速度或质量测量。尤其是复杂、开放式工作,接近某项基准的分数不意味着所有任务都能取得与Opus相同的结果;应用选型仍要看自身任务要求。对开发者而言,能力提升也不会消除请求参数不兼容带来的失败。

五处变化怎样影响API请求

这些变化集中在Messages API的参数、对话状态和工具定义。纯文本请求涉及的改动较少;带有工具循环和历史思考块的应用,则可能在发送请求时被拒绝,或在模型切换后得到不同的响应结构。

  • 关闭前置思考:Sonnet 5使用的thinking.type为disabled,换到Sonnet 5.5后应改为between_tools。这个设置关闭回答前的思考,工具调用之间仍可能产生thinking块;它也不能与xhigh或max思考强度直接组合。旧配置若把“关闭前置思考”理解为响应中绝不会出现thinking块,解析逻辑同样要调整。
  • 强制工具调用:tool_choice设为any或指定某个tool会使请求返回错误。改用auto后,可以用严格输入约束规范实际发生的工具调用,但auto允许模型直接回答,并不保证它一定调用工具。把“必经某工具”作为业务条件的流程,需要由应用识别未调用工具的结果。
  • 思考块复用:新模型的thinking块与生成它的模型及此前对话绑定。在启用对话签名校验的账户中,改写较早的消息再回传旧块可能使请求失败;跨模型继续会话时,不兼容的旧块则可能被丢弃。保存会话时只追加消息,并在工具循环中原样传回需要保留的块,关系到后续请求能否延续原有状态。
  • 计算机使用工具:Claude API和Google Cloud需要把computer_20251124迁至computer_toolset_20260801;Amazon Bedrock仍可使用computer_20251124。更早的computer_20250124在Sonnet 5.5上不被接受。共用一套代理逻辑、分别部署到不同平台的应用,因而不能共用未经区分的工具版本配置。
  • 顾问工具:使用advisor时,Claude Opus 4.8、Claude Opus 4.7和Claude Sonnet 5等旧顾问配置不能继续搭配Sonnet 5.5执行模型。兼容顾问的建议结果以加密内容块返回;此前把顾问回复当作可读正文展示或解析的代码,也会失去原来的输入。

请求成功后,进度文字仍可能消失

工具调用之间较长的进度说明现在可能放进thinking块,较短的说明仍可留在text块。默认显示设置下,thinking块的文字可能为空,所以只把text块写入界面的应用,会继续运行工具,却不再展示过去可见的中途说明。用户看到的短暂停顿,不能仅凭聊天窗口判断为工具循环已经停止。

流式接收端需要按内容块类型处理事件,并把非空的进度更新放在随后发生的工具调用之前展示。若产品需要保留可见说明,应选择会返回相应文字的思考显示设置;使用between_tools时,工具间的说明也可以返回。另一方面,空thinking块可能仍带有签名,工具循环不能只因它没有可见文字就随意删除,否则下一轮请求所携带的状态可能不完整。

三档迁移范围,对应三种现有集成

  • 可直接升级:仅发送普通文本或图像、没有强制工具选择,也不回放经过编辑的思考块的调用,通常可以先替换模型ID。这里的“直接”只描述请求结构:输出措辞、时延和Token用量仍可能变化,不能把旧模型的结果当作新模型的固定模板。
  • 需要改代码:请求里已有disabled思考设置、any或指定tool的强制选择、旧版计算机使用工具,或不兼容的顾问配置,就要修改相应参数或工具定义。展示工具间文字的产品还需处理thinking和text两种内容块;否则API请求成功,用户界面仍会表现出进度中断。
  • 应先回归测试:会编辑历史消息的长对话代理、在不同模型之间切换的会话,以及跨云平台部署的计算机操作流程,需要跑完整的请求、工具、回复循环。测试重点是工具未被调用时的业务处理、思考块能否继续回传、平台工具版本是否匹配,以及最终输出是否符合原有约束。

强制工具调用尤其会改变应用的责任边界:旧配置曾由API要求模型走工具分支,改用auto后,这项保证不能靠同一个请求参数恢复。若后续处理必须依赖工具结果,应用需要把模型直接给出的回答识别为未完成流程,避免将它当作已经执行过工具的结果继续传递。

相关阅读:

分享:

订阅我们的新闻通讯

将最新 Web3、AI 和加密货币新闻直接发送到您的邮箱。

0