9月23日凌晨,Anthropic先发布Claude Opus 5.5,称典型工作负载运行成本较上一代下降约40%。几小时后,OpenAI推出GPT-6 Sol和GPT-6 Luna,API输入、输出单价比GPT-5.6当时的促销价降低50%或更多。两家都把价格作为发布重点。

OpenAI与Anthropic同日发新模型,价格竞争转向任务成本

OpenAI称,两款新模型沿用旗舰Astra的训练方法,把专业工作、事实性、编程、计算机使用和对齐方面的改进带到更低价格档位。Sol每百万Token输入2美元、输出10美元;Luna输入0.10美元、输出0.50美元。Anthropic的Opus 5.5输入价从5美元降至4美元,输出价从25美元降至20美元,缓存读取价从0.50美元降至0.20美元,并称输出速度提高30%以上。

两家的降价百分比并非同一口径。Anthropic的40%来自单价、速度和Token消耗共同影响的典型工作负载成本,OpenAI的50%以上首先是API单价变化。模型若输出更长、反复调用工具,最终账单也可能增加。Anthropic引用早期测试称,有用户不到一天让Opus 5.5完成68万行代码迁移。

OpenAI公布的对照中,Sol位于Astra之下。AutomationBench里,Sol在xhigh推理强度下得分33.2%,比低推理强度的Astra高2.9个百分点,单任务成本约为后者四分之一。DeepSWE v1.1中,Sol在max档得分68.8%,Claude Fable 5在xhigh档为69.9%,相差1.1个百分点,OpenAI估算其单任务成本低约80%。内部测试显示,Sol事实错误率约为上一代一半;Artificial Analysis的AA-Omniscience显示,Sol幻觉率从92%降至60%,回答率从99%降至83%。