OpenAI发布新一代图像生成模型ChatGPT Images 2.5。官方称,该模型在细节质量、生成速度、编辑精度以及多轮修改一致性上做了优化,并增加了Sketch手绘参考、创作模板、图片评论编辑等功能。据OpenAI数据,用户每周通过ChatGPT Images和API中的GPT Image系列生成超过30亿张图片。

OpenAI发布ChatGPT Images 2.5:图片编辑更精准,新增手绘参考

相比上一代Images 2.0,Images 2.5对“修改”的理解提升最明显。过去,AI绘图从零生成图片容易,但局部修改时常常连带改动其他区域。新模型能够更准确执行指定修改,同时保留原有主体、构图和视觉风格。在实际测试中,模型能保持参考人物的面部特征,将人像转换成不同风格的摄影作品;也能生成“马斯克与教父在片场自拍”这类电影幕后场景照片。对“一只橘猫坐在椅子上拿iPad,iPad屏幕中又出现同一只橘猫和iPad并不断循环”的递归画面请求,模型同样能识别视觉嵌套关系,完成多层递归。

在复杂艺术风格方面,Images 2.5的理解也有提升。测试中的黑神话风格画面接近游戏概念原画,《三国演义》连环画风格的插画则能表现出黑白线描、淡彩和旧纸张质感等特征,中文文字生成表现也不错。此外,模型会用数字直观地显示图片生成进度,有网友在等待生成时玩起了贪吃蛇。

Images 2.5的提升主要体现在三个方向:对复杂提示词的理解能力增强,能同时处理多个风格、主体和条件限制;对人物、产品等参考主体的保持能力更好,多次修改后更加稳定;编辑流程更贴近真实设计工作,用户可以围绕同一张图反复调整,而不是重新生成图片。不过,噪点问题依然明显,官方展示案例中也能看到一些细节瑕疵。