Moran StudioMoran Studio

一周一个饺子,Anthropic 发布了 Claude Haiku 5.5

•3 分钟阅读
一周一个饺子,Anthropic 发布了 Claude Haiku 5.5

Anthropic 发布了 Claude Haiku 5.5,主打高并发和成本敏感场景,也是 A 社目前响应速度最快的轻量模型。

官方对它的定位非常明确,主要负责数据筛选、内容摘要、分类检索,或者在复杂任务里充当 Opus 5.5 和 Sonnet 5.5 的子代理。值得一提的是,新模型首次加入了可调节的思考力度设置,允许根据任务复杂度在成本和智能表现之间做取舍。

不过,我觉得模型等级多,不同等级又增加不同程度的思考能力调级,实际使用的时候,用户的心智成本非常高。

这批迭代主打的就是降价,Haiku 也不例外。

针对 10 万 Token 以内的短提示词请求,Haiku 5.5 相比上一代降价达到 90%,每百万 Token 输入 $0.1、输出 $0.5,缓存命中打对折,只要 $0.01,综合运行成本平均下降约 75%。

Haiku 5.5 的这个价格明显就是奔着 GPT-6 Luna 来的,且缓存命中价格更低。如此一来,在同能力模型中,Haiku 5.5 成为了新的性价比之王。DeepSeek 的性价比正在被渐渐蚕食,Haiku 5.5 的价格已经远低于 4.1 Flash 了。

基准测试中,Haiku 5.5 不仅全面拉开跟上一代的差距,在部分指标上也压过了 GPT-6 Luna:

  • 计算机操作测试 OSWorld 2.1 离线子集得分 72.4%,上一代仅为 15.7%
  • 专业知识评估 GDPval-AA 达到 1620 分,明显高过 Luna 的 1437 分
  • Agent 编程评测 Terminal-Bench 4.0 达到了 39.2%,相比 4.5 的 0% 提升巨大

配套方面,官方给 Python 和 TypeScript SDK 补充了浏览器操作的测试版支持,并给 Max 和 Team 订阅用户提供每月 100 至 500 美元的 API 赠额。

截至目前,Anthropic 还是比 OpenAI 慷慨不少的,O 社最近一波操作太毁口碑了。