OpenAI本周推出ChatGPT Images 2.5,称这一新一代AI图像模型能提供更锐利的细节、更自然的光照和更丰富的纹理,并更好地保留参考照片中的人和物体。OpenAI还表示,新模型生成图像速度最多提升50%,执行复杂视觉指令时更可靠。据TechRadar报道,早期用户反馈并不一致,部分Reddit用户尤其不满生成图像中的噪点。
Images 2.5加入Sketch、海报和产品摄影模板,以及直接在图像上留言请求修改等功能。OpenAI称其为新的最先进图像模型。但Reddit上一名用户评价称:“噪点模式太糟糕了。”另一名用户说:“这……看起来很糟。”抱怨集中在画面发糊、发糙。
在AI图像讨论中,噪点指生成图像出现的颗粒或斑点,让画面有粗糙、沙砾般的观感。生成模型已学会照片包含颗粒、纹理和细微色彩变化,Images 2.5似乎格外热衷于复现这些信号,有时把它们散布到天空、皮肤、羽毛和影棚背景上。这与“更锐利的细节”“更丰富的纹理”的宣传形成反差。一名用户写道:“他们需要去掉这些噪点伪影。这让它在大规模生产里基本没用。”反馈中也有称赞,但远非一致好评。
TechRadar测试了几张高细节主体和本应平滑的图像,并在提示词中要求平滑渐变、消除视觉噪点。影棚马克杯测试中,虚拟陶瓷表面的孔雀、花朵、水果和风景乍看令人印象深刻,但灰色背景有持续颗粒,最小图案开始混乱。暮色仓鸮测试中,羽毛处理不错,翅膀和面部结构可见,爪子有说服力;但背后平滑蓝色天空有明显细颗粒。
奇幻场景测试中,飞马或龙与彩虹出现在高山湖泊,构图意外连贯,但无休止的锐化让画面像电子游戏加载界面,淡蓝天空带有轻微纹理,山、树和生物细节显得脆硬、过度锐化。傍晚屋顶上两个朋友的测试最接近真实感,表情可信,衣服似乎受重力影响;但看上一分多钟,暮色天空、头发和皮肤上的颗粒显而易见。这里没有布光不当或传感器故障,颗粒更可能是模型伪影或创作决定,而非弱光拍照不可避免的物理结果。