据爱范儿报道,OpenAI于9月9日发布新一代图像生成模型ChatGPT Images 2.5。OpenAI称,新模型重点提升图片细节质量、生成速度、编辑精度和多轮修改中的一致性,并新增Sketch手绘参考、创作模板、图片评论编辑等功能。目前,用户每周通过ChatGPT Images和API中的GPT Image系列生成超过30亿张图片,新模型旨在扩大AI图像工具在个人创作、营销设计、产品视觉等场景中的使用范围。
Images 2.5相比上一代2.0的主要变化是对“修改”的理解能力提升。过去的模型在调整局部细节时容易误改其他部分,OpenAI表示新模型能够更准确执行指定修改,同时保留原有主体、构图和视觉风格。据爱范儿实测,新模型在人像生成中更能保持参考人物的面部特征,在影视角色合成、商品视觉设计和递归结构等复杂任务中表现稳定,对中文及传统连环画等复杂艺术风格的理解也更接近创作场景。网友同时发现,新模型的噪点控制仍不理想,官方展示的部分案例存在细节瑕疵。
在功能层面,OpenAI为ChatGPT增加Sketch功能,用户可手绘草图作为生成图片的视觉参考;模板功能提供海报、商品图片等设计起点;用户也能在图片上添加评论指定修改位置,或分享生成图片所用的提示词。面向开发者,OpenAI发布GPT Image 2.5 Flare和GPT Image 2.5 Sunburst两款API图像模型,前者适用社交内容、电商视觉等大规模生成场景,延迟较GPT Image 2降低50%;后者面向广告素材、高端产品图片等需要精细控制的创意流程。ChatGPT Images 2.5已向ChatGPT、ChatGPT Work和Codex用户开放,覆盖桌面端、移动端和网页端,API用户可调用上述两个模型。