据SiliconANGLE于10月8日报道,OpenAI Group PBC在媒体吹风会上宣布,GPT-6模型将为ChatGPT带来“智能UI”。ChatGPT将不再只返回大段文字,而是在判断必要时生成图形、可点击按钮、表单和图表等可视化与交互元素,OpenAI称目标是让学习复杂主题更容易。
公司介绍,ChatGPT会自行判断某个回答是否需要更适合视觉呈现和交互探索的形式,并在回答中直接整合这些元素。对于更基础的提示和问题,聊天机器人仍会沿用纯文本格式,但用户可随时要求更交互式的回复,ChatGPT会相应重新格式化回答。
OpenAI展示的示例包括,用户询问如何组装一辆7速自行车时,ChatGPT没有输出冗长文字,而是生成完整的设计拆解,包含主要部件的可视化图,以及可点击按钮,让读者进一步了解每个部件。另一个示例中,用户要求制定烤羊腿计划并配上每道菜图片,还得到一份可根据宾客人数调整、重新计算所需食材的食谱。
OpenAI解释,这些可视化内容由GPT-6模型预训练过的一个组件库生成。产品经理Aarush Selvan在吹风会上表示,此次更新目标是让“学习复杂主题更容易”。他说,ChatGPT一直主要是文本界面,但公司希望帮助人们把事情做完,并认为“从规划食谱或旅行,到尝试学习某些东西,这类日常事务中最有用的答案并不只是文字”。
据该报道,ChatGPT的智能UI并非完全独创,它与Google LLC去年随Gemini 3推出的“生成式界面”有些相似,不过看起来色彩更丰富,图形元素也更多。Google推出该功能时曾引发兴奋,但似乎并未让Gemini作为聊天机器人明显差异化。
OpenAI没有说明智能UI是否意味着更高的token消耗。该报道指出,由于生成了额外元素,这种情况似乎存在,用户可能需要留意。这些视觉元素是否容易受到所有AI聊天机器人共有的幻觉问题影响,也尚不清楚。
OpenAI本周早些时候还透露,不久将在ChatGPT的回答中引入首批基于图像的广告。报道提到,一些用户可能担心,智能UI会让区分广告与聊天机器人自身回答变得更困难,但广告几乎肯定会成为各AI聊天机器人未来的一部分。
OpenAI表示,智能UI从当天起面向ChatGPT Plus、Pro、Business和Enterprise订阅用户提供,其中Enterprise用户需要工作场所管理员启用。免费用户和Go订阅用户将在次日获得访问权限。