谷歌当地时间9月30日公布新旗舰模型Gemini 4 Argon,称其在部分编程和知识工作测试中超过GPT-6 Astra,但首批只向一小批网络安全合作伙伴开放。后续将先面向付费API客户和Google AI Ultra订阅用户,具体日期尚未公布。谷歌目前正参与美国政府的模型发布前自愿测试程序,并根据早期使用者的反馈完善防护措施。

距上一代旗舰Gemini 3推出已近一年。这段时间里,谷歌不断更新更小、更便宜的Flash模型,新旗舰却迟迟没有露面。皮查伊曾在5月表示,下一次重大模型更新会在6月推出。
Argon主要面向软件开发、金融研究、法律文书和网络安全等需要连续完成多个步骤的工作,输出上限从6.4万token提高到100万token。谷歌公布的成绩显示,在DeepSWE v1.1中Argon得分77.9%,高于GPT-6 Astra的74.1%和Claude Opus 5.5的74.2%;Vals Index中为68.9%,后两者分别为63.1%和67.0%。但在另外两项编程测试中仍落后:FrontierSWE v2为55.0%,低于Astra的65.5%;Terminal-Bench 4.0为57.4%,低于Opus 5.5的66.4%。
对外开放前,谷歌内部已有数千名员工用上Argon,参与调试、算法设计以及把C/C++代码迁移到Rust等工作。在视频解码软件libgav1上,Argon智能体替换了约3.2万行代码,谷歌称修改后的版本保持相同视频输出,运行速度达到原Rust移植版的2.7倍。另一组智能体分析谷歌数据中心的性能数据并实施内存优化,谷歌称部署后可释放超过300 TiB内存。涉及重要系统的大规模重写,仍需经过自动化与人工审计、仿真测试和评审才会进入生产环境。
安全方面,谷歌通过Fairwind计划向首批网络安全合作伙伴开放Argon。安全公司Wiz在公益项目Scan for Good中使用它,发现了一处此前前沿模型未发现的严重漏洞,涉及多家医院使用的医疗软件及敏感个人信息。面向可信网络防御者和内部团队的版本不设网络安全任务防护限制;面向更广泛用户的版本则需加强恶意用途识别、提示注入防护和行为监控,任务执行偏离用户意图时监控系统可以中止运行。定价方面,首发期间打五折,每百万输入token收费2美元、输出10美元,常规价格分别为4美元和20美元,命中缓存的输入按当期输入单价的5%计费,优惠结束时间尚未公布。









