亚洲财经

☰ 搜索

Anthropic 推出 Haiku 5.5:迄今为止最便宜、最快的 Claude 模型

Anthropic 发布 Claude Haiku 5.5:更便宜、更快且更具能力的小模型

周三,Anthropic 发布了 Claude Haiku 5.5,将其称为该公司打造的成本最低、速度最快且能力最强的小型模型。该模型主要针对高并发任务,如文档摘要和数据库查询,同时也适用于对速度敏感的工作,例如实时客户支持以及为用户操作网页浏览器。

对于将 Claude 集成到自身产品中的开发者而言,若提示词长度在 10 万 token 以内,输入 token 的费率为每百万个 0.10 美元,输出 token 为每百万个 0.50 美元。Token 是 AI 模型读取和写入的文本基本单位,大约相当于四分之三个单词,也是大型 AI 公司计费的基础单位。这一定价与 OpenAI 于 9 月 22 日发布的竞争对手小型模型 GPT-6 Luna 的费率持平。

此前,Haiku 4.5 的费率为 1 美元和 5 美元,因此新费率降低了 90%;而对于超过 10 万 token 的提示词,费用则削减了 50%。由于约 90% 针对旧模型的请求都在此限额之内,且 Haiku 5.5 将文本分割成稍多的 token,Anthropic 估计平均节省幅度接近 75%。

客户支持聊天和长邮件摘要正是 Anthropic 开发 Haiku 的初衷。因此,本质上重复性高、简单且非创造性的任务是该模型的最佳适用场景。

话虽如此,基准测试显示这绝非一款愚笨的模型。例如,在 OSWorld 2.1 测试中(该测试评估 AI 能否通过长期多步骤任务操作真实计算机,得分以部分信用百分比计算),Haiku 5.5 的表现优于 OpenAI 的 GPT Luna,成功率分别为 72.4% 对比 48.9%。

在 Terminal-Bench 4.0 中,AI 代理被要求通过自行键入命令来完成专业任务,得分基于首次尝试正确的比例。Haiku 5.5 得分为 39.2%,而 OpenAI 的 Luna 为 16.4%,Haiku 4.5 为 0%。作为对比,Anthropic 的 Claude Sonnet 5.5 得分为 70.6%。

我们在一个简单的逻辑问题上测试了该模型,其响应速度极快,几乎是瞬间完成。然而,它给出了错误的答案,这并不是用户希望从模型中得到的结果,因此请勿盲目信任其回答。

在 GDPval-AA v2.1 测试中(该测试使用源自国际象棋的 Elo 评级系统,根据 44 种职业的真实专业工作对模型进行评分),Haiku 5.5 获得了 1620 分。Luna 获得 1437 分,而 Haiku 4.5 仅获得 735 分。

这也是首款具备可调节“努力程度”设置的 Haiku 模型。该设置允许用户在成本与更智能的回答之间进行权衡。此外,Anthropic 还将 Sonnet 5.5 的缓存读取价格减半至每百万 token 0.10 美元,这是针对模型已处理过的文本的折扣费率。

Haiku 5.5 的发布紧随 Opus 5.5(9 月 22 日发布)15 天之后,以及 Sonnet 5.5(9 月 28 日发布)9 天之后,后者是 Anthropic 承诺推出的 Claude 5.5 系列中的最后一款。Opus 5.5 是自 CEO Dario Amodei 发表文章呼吁行业放缓 AI 能力提升步伐以来的首次发布。

目前,Claude Haiku 5.5 已在 Claude 网站、Amazon Web Services、Google Cloud 和 Microsoft Azure 上线,模型名称为 claude-haiku-5-5。Anthropic 本周还在推出月度 API 额度优惠:Max 5x 计划订阅者可获得 100 美元,Max 20x 计划为 200 美元,Team 计划用户则可共享高达 500 美元的额度。