Anthropic 周三发布 Claude Haiku 5.5,称其是公司迄今推出的最便宜、最快、也最强的小型模型。该模型面向高频任务,例如文档摘要、数据库查询,以及对速度敏感的工作,比如实时客服和替用户操作网页浏览器。
对于开发者将 Claude 接入自家产品的情况,在提示词不超过 100,000 个 token 时,Haiku 5.5 的收费为每百万输入 token 0.10 美元、每百万输出 token 0.50 美元。token 是 AI 模型读取和生成的较小文本单位,大约相当于四分之三个单词,也是大型 AI 公司计费的基础。这一价格与 OpenAI 在 9 月 22 日推出其竞争对手小模型 GPT-6 Luna 时设定的费率一致。
Haiku 4.5 的收费为每百万输入 token 1 美元、每百万输出 token 5 美元,因此新价格低了 90%;而超过 100,000 个 token 的提示词则可享受 50% 的降幅。由于旧模型约 90% 的请求都低于这一门槛,而且 Haiku 5.5 的文本切分 token 数略多,Anthropic 估计平均节省幅度接近 75%。
Anthropic 为 Haiku 设计的用途包括客服聊天和长邮件摘要。公司表示,这类重复、简单、非创造性的任务最适合这款模型。

不过,基准测试显示,这并不是一个“笨”模型。例如,在 OSWorld 2.1 上,这是一项测试 AI 能否通过长链、多步骤任务操作真实电脑的测试,采用部分得分百分比计分,Haiku 5.5 的成绩为 72.4%,高于 OpenAI 的 GPT Luna 的 48.9%。
作为对比,Anthropic 的 Claude Sonnet 5.5 得分为 70.6%。

我们对该模型做了一个简单逻辑题测试,它的响应极快,几乎是瞬间给出答案。不过它给出了错误答案,这并不是你希望模型出现的情况,因此不要盲目信任它。
在 GDPval-AA v2.1 上,这项测试使用借鉴自国际象棋的 Elo 评分体系,评估模型在 44 个职业的真实专业工作表现,Haiku 5.5 的得分为 1620。Luna 为 1437,Haiku 4.5 为 735。
这也是首个带有可调“努力”设置的 Haiku 模型,用户可以通过这一选项在成本与更聪明的回答之间做权衡。Anthropic 还将 Sonnet 5.5 的缓存读取价格减半至每百万 token 0.10 美元,这一价格适用于模型已经处理过的文本。
Haiku 5.5 距离 Opus 5.5 的发布时间仅 15 天,后者于 9 月 22 日发布;距离 Sonnet 5.5 也只有 9 天,后者于 9 月 28 日发布,这三款 Claude 5.5 模型是 Anthropic 先前承诺推出的最后一批。Opus 5.5 是自首席执行官 Dario Amodei 发表文章呼吁行业放缓 AI 能力提升以来的首次发布。
Haiku 5.5 目前已可在 Claude 网站、Amazon Web Services、Google Cloud 和 Microsoft Azure 上使用,产品名为 claude-haiku-5-5。Anthropic 还将在本周推出每月 API 额度:Max 5x 订阅用户可获 100 美元,Max 20x 用户可获 200 美元,Team 方案则可在用户之间共享、最高达到 500 美元。












