美国时间10月7日,Anthropic发布Claude Haiku 5.5。在不超过10万token的请求中,新模型的输入、输出单价比上一代低90%。它能整理文档、查询数据库、操作浏览器,也能给更强的Opus和Sonnet当助手。在Anthropic公布的客户案例中,金融AI公司Rogo让大模型负责制作演示文稿,Haiku去翻公司的年度报告,找出需要的收入数字。

Claude Haiku 5.5发布:调用价降九成,小模型给大模型打下手

Haiku 5.5按输入提示词长度分两档计费:不超过10万token时,每百万输入token收费0.10美元,输出0.50美元;超过这一长度,输入、输出分别为0.50美元和2.50美元。上一代Haiku 4.5对应的是1美元和5美元,短提示词档降了90%,长提示词档降了50%。Anthropic称这是自家历代产品中最便宜的小模型,并估算运行成本约降低75%。不过分词器有变化:开发者西蒙·威利森用同一段长提示词测试,Haiku 5.5的计数比4.5多约25%。接近10万token分界的请求迁移后需要重新计数,原本按低价档计费的输入可能进入另一档。

降价后,10万token以内Haiku 5.5的单价与GPT-6 Luna持平;按威利森列出的价格,Luna要到27.2万token以上才进入长上下文收费档,届时输入、输出为0.20美元和0.75美元,仍低于Haiku 5.5长提示词档的单价。实际花费还取决于同一项任务生成多少内容、需要调用几轮。

缓存方面,Anthropic把Sonnet 5.5每百万token的缓存读取价格从0.20美元降至0.10美元,按官方估算,可让大多数智能体任务的运行成本再降约20%。订阅用户还能领取每月API额度:Max 5x为100美元,Max 20x为200美元,Team按席位汇总、整个团队每月最多共享500美元。这些额度不会提高订阅使用上限,未用完的部分也不结转。

在Anthropic公布的OSWorld 2.1离线子集评测中,Haiku 5.5得分从上一代的15.7%升至72.4%,同一表格中GPT-6 Luna为48.9%。知识工作评测GDPval-AA的Elo评分从735升至1620;“人类最后的考试”在不使用工具时,得分从10.2%升至45.9%。这代Haiku首次支持调整推理强度,共五档。Anthropic称按标准速度模式比较,它是公司目前最快的模型。