OpenAI于9月8日发布ChatGPT Images 2.5,升级其图像生成工具。该公司称,新版生成的图片有“更自然的光线和更丰富的纹理”,在连续多轮编辑中能更可靠地遵循用户指令,图像生成延迟比4月推出的Images 2.0最多缩短50%。
新版新增Sketch功能。据The Verge报道,用户可在ChatGPT聊天框输入@Sketch打开画板,画出粗略构图,再让模型据此生成完整图片。该媒体记者体验后说,他用鼠标画了一只潦草的猫,随后按指令得到一张写实照片。SiliconANGLE报道称,Sketch让用户能直接在ChatGPT中绘制草图,搭配触控笔使用最方便。
图片编辑也变得更具体。用户可以直接在图片的局部区域添加修改要求,例如“把这个改成蓝色”或“删除这个”,ChatGPT会针对该位置修改;多轮修改时,之前没要求改动的部分和已完成的改动能够保持稳定。The Verge记者在测试中用这种评论把猫的眼睛从蓝色改成了绿色。TechRadar注意到,配套编辑工具栏实际上从8月起已在ChatGPT中逐渐上线,OpenAI没有正式宣布,因此它是否严格属于Images 2.5并不明确。该媒体还介绍了删除背景、擦除物体、调整宽高比等工具,认为这些功能让修图明显更容易。
新版加入面向海报、Logo、传单、产品照片等任务的模板,每个模板会先给出基础提示,再询问风格等细节,逐步生成符合需要的图像。用户还可以把自己的提示词与生成结果一起分享,方便他人继续修改。
面向开发者,OpenAI推出两个API模型:默认的GPT-Image-2.5 Flare适合大多数应用,能在低延迟下生成比GPT-Image-2质量更高的图片;GPT-Image-2.5 Sunburst则牺牲速度换取更高细节保真,适合产品图和营销材料。ChatGPT Images 2.5已向ChatGPT、ChatGPT Work和Codex的桌面、移动端及网页版用户开放。OpenAI表示,模型设置了内容护栏,并使用C2PA元数据和隐形水印来标识AI生成内容,防止深度伪造和未经授权使用。此次发布距离上周的GPT-6 Astra亮相约一周。