上周 Anthropic 发布了 Opus 5.5,这周紧接着发布了 Claude Sonnet 5.5,模型发布速度一个比一个勤快。
距离各大厂商最近一次呼吁行业放慢脚步,反复提示 AI 即将毁灭人类才过去多久来着?一个月都不到,月初毁灭人类,月末人类继续前进。
这次的 Sonnet 5.5 依然主打高性价比的生产力走量,价格维持在每百万 Token 输入 2 美元、输出 10 美元,但由于单任务所需 Token 减少,实际综合成本降了差不多 30%,响应速度也提升了 30% 以上。
能力提升主要集中在代码和 Agent 任务。Terminal-Bench 4.0 评测得分从上一代的 10.3% 暴涨到 70.6%,CursorBench 达到 55.5%,逼近 Opus 5.5 和 GPT-6 Sol。
常规迭代,没有什么特别显著的亮点,不外乎更智能更安全,就不罗列生物风险审查、网络攻击防御和沙盒防逃逸指标了。
哦,对了,「蒸馏对抗」进一步加强,针对性非常强。
嘴上全是全人类福祉,身体却异常诚实。一边把风险推向极致,呼吁全行业放慢研发节奏、筑牢安全防线,另一边新模型一个接一个的推。
先上岸的人急着拆梯子。
