Anthropic 发布 Claude Opus 5.5,这是 Claude 5.5 家族首款模型,未来几周还会推出 Sonnet 5.5 和 Haiku 5.5。官方称,它在多数任务上已达到 Claude Fable 5.1 水平,典型任务成本比 Opus 5 降低 40%,输出速度提高超过 30%。

Opus 5.5 面向长时间编程 Agent 和知识工作。Terminal-Bench 4.0 中得 66.4%,高于 GPT-6 Astra 的 57.9% 和 Opus 5 的 52.3%;CursorBench 4.0 从 46.6% 升至 57.8%;GDPval-AA v2.1 得 1846 Elo,超过 Fable 5.1 的 1735。但 AutomationBench 得 40.0%,略低于 GPT-6 Astra 的 41.4%;Terminal-Bench-Science 0.1 也与 Astra 有差距。Anthropic 提醒,榜单差距不能完整反映真实体验,内部使用中它与 Fable 5.1 的差距比部分评测结果更小。
长任务更能体现升级。早期测试者用 Opus 5.5 在一天内完成 68 万行代码迁移;20 万行代码库审计不到三小时完成,而 Opus 5 完成同类任务超过 20 小时,token 消耗约为 Opus 5.5 的 2.5 倍。将 HAProxy 从 C 重写为 Rust 时,Opus 5.5 用时 9.5 小时,Fable 5.1 用时 12 小时,前者成本低 51%。
价格方面,Opus 5.5 的 API 输入和输出价格分别为每百万 token 4 美元和 20 美元,比 Opus 5 低 20%;缓存读取价格从 0.50 美元降至 0.20 美元,降幅 60%。Fast mode 最高 2.5 倍速度,价格为每百万输入 token 8 美元、输出 token 40 美元。模型支持 100 万 token 上下文和 12.8 万 token 最大输出,思考模式始终开启,默认 effort 为 medium,可按任务调整。长时间运行的 Agent 可通过上下文压缩整理较早对话,同时保留最近回合。Opus 5.5 已经上线。










