Opus5.5擅长使用缓存同样的任务轮次更少
最新 Claude 文章指出:
Claude更擅长使用缓存
这并非 Opus 5.5 特有的现象,而是过去六个月我们添加的众多 Claude Code 功能共同作用的结果。考虑到我们刚才讨论的编码会话趋势,你可能会预期缓存未命中率会更高,但事实恰恰相反。未命中缓存的输入减少了 50% 以上。
例如,我们降低了因刷新登录页面等小操作而意外破坏缓存的可能性。我们也降低了因在对话中添加指令或按需加载工具等较大操作而破坏缓存的可能性。对于 Opus 5.5 和 Fable 5.1 等较新型号,您现在可以在会话期间更改缓存级别,而无需重置缓存。
我们还优化了缓存功能,使其更适用于长时间运行的会话和委托会话。使用 API 密钥和云服务的开发者现在可以设置一小时的缓存有效期(订阅用户此前已拥有此功能),并且派生的子代理会从父代理的缓存开始,而无需为相同的上下文再次付费。
同样的任务,但轮次更少。
Opus 5.5 完成相同任务所需的转数比其他型号更少。Zeta Labs 发现,Opus 5.5 的转数和每次任务的刀具调用次数都少于 Opus 5,但成本却几乎只有 Opus 5 的一半,而且完成的高难度任务数量却是 Opus 5 的两倍。
换句话说,简单、耗时且机械化的任务所需回合数相同,而耗时更长、难度更高的任务则更有可能让 Opus 5.5 避免因方法错误而浪费代币。减少回合数甚至比缓存代币更具成本效益。
值得注意的是,尤其是在 Claude 长时间无人值守或不间断运行的情况下,Opus 5.5 的输出速度比 Opus 5 快 30% 以上。虽然这不会提高缓存命中率或减少令牌使用量,但这意味着长时间运行的等待时间更短。
清晰可见的 agent 运行数据真的能有效帮助模型和 agent 找准方向去优化和升级!!!
之前的项目也再次验证了这个方向是没有错的。查询同样的任务,每一轮调用了多少工具,上下文压力,token 输入缓存,命中缓存,任务回合,耗时,成本等每一步都清晰可见!
AI工具 开发者选项 我这行的AI路 agent评测 cluade 数据可视化





