OpenAI 于 9 月 8 日发布了 ChatGPT 图像 2.5,直接与 Google 的 Nano Banana 2 (Gemini 3.1 Flash Image) 相对,并称其提供更清晰的细节、更丰富的纹理和更自然的光照。与图像 2.0 相比,图像生成的延迟下降了多达 50%,并且此版本引入了两个新的 API 模型,GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst。Flare 是快速的默认选项,而 Sunburst 则为高端编辑精度而构建。
早期的比较显示,GPT 图像 2 在提示中包含过多限制时,会出现过度锐化现象,GPT 图像 1 存在被称为“尿液滤镜”的黄色偏色。在这轮测试中,图像 2.5 中没有出现黄色偏色或过度锐化现象,且图像 2.5 在保持细节的同时维持了色彩平衡。报告明确指出,在评估的场景中,早期的伪影在图像 2.5 中是缺失的。这些观察结果以直接比较之前 GPT 图像模型的行为的方式呈现,而不是作为新特性的声明。
蒸汽朋克和肖像测试显示,图像 2.5 在三个模型代际中更加摄影一致。这次比较的对象是 Google 的 Nano Banana 2 (Gemini 3.1 Flash Image),而不是 Nano Banana Pro。在描述为严酷的凌晨 2 点场景的复杂交集测试中,Nano Banana 2 将大部分元素清晰呈现,并注意到一个错误的公用电话贴纸作为一个小瑕疵。该报告将这些场景特定的结果与图像 2.5 的代际一致性测量一起呈现。
本节汇总了多个场景和模型代际的图像质量测试结果。它还展示了与谷歌图像模型的对比结果。
ChatGPT Images 2.5 引入了多个面向用户的图像创建和协作功能。此版本增加了一种草图工具、可重复提示的提示分享功能,以及与图像内区域关联的行内评论,以便于反馈。它还包括旨在输出准备就绪的设计模板,用于海报和商品,支持标准尺寸和布局。这些添加功能解决了编辑和审查工作流,并在发布特性中列出。
API 现在包括更新的质量等级,增加了高于 Images 2.0 的新高和最大等级。报告将这些 “高” 和 “最大” 级别列为之前 API 质量选项的补充,且没有提供额外的实施细节。
Nano Banana 2 在一个 2 点的交叉测试中进行了评估,该测试包含多个表面和可读文本。在该测试中,Nano Banana 2 大多数元素渲染良好。报告指出有一个公共电话的贴纸模糊了其自身的文本,作为该场景的小瑕疵。交叉测试被描述为惩罚性,因为几乎每个表面都有可读文本。
本节汇总了这些功能添加和两个模型的场景级测试观察结果。它将功能和测试笔记作为报告中的单独项目呈现。
ChatGPT 图片 2.5 是一次迭代更新,解决了早期图像伪影的问题,同时引入了面向用户的工具,如草图、提示共享、图像区域的 inline 注释、海报和商品的格式模板,以及扩展的 API 质量层级,包括新的高和最高水平。比较测试报告显示,Images 2.5 在蒸汽朋克和肖像场景中的摄影一致性得到了改善,而谷歌的 Nano Banana 2 在严格的交叉测试中大多数元素表现良好,尽管在该场景中注意到了一些轻微的付费电话贴纸干扰。


