据TechCrunch报道,英伟达周一宣布成立一个由100多家公司组成的联盟,目标是解决失控AI智能体问题,但OpenAI没有出现在支持者名单中。亚马逊、谷歌和苹果同样未加入;在竞争对手Anthropic成为支持者的情况下,OpenAI的缺席尤其显眼。

这项计划名为英伟达开放智能体安全平台。TechCrunch称,英伟达试图将其自主开发、且很大程度上开源的AI智能体安全技术推广到整个AI生态,直接回应Anthropic和OpenAI等前沿实验室披露的失控AI智能体事件。英伟达首席执行官黄仁勋一直将失控AI称为普通工程问题,认为它可以像其他技术问题一样被解决。

尽管OpenAI没有公开承诺加入该联盟,OpenAI发言人告诉TechCrunch,公司支持英伟达的工作。TechCrunch称,OpenAI正与英伟达在智能体安全方面合作,包括该平台的关键软件之一OpenShell。OpenShell是开源软件,用于创建专门防止智能体逃逸的沙箱。

Hugging Face创始人兼首席执行官Clem Delangue在帖子中表示,如果OpenAI当时在其攻击Hugging Face的智能体上运行了这套系统,OpenAI会在Hugging Face之前发现它们。他同时提醒需谨慎看待这一说法,并需要更多透明度。Delangue本月早些时候以129亿美元将Hugging Face出售给英伟达。他说,Hugging Face已向该平台贡献一项功能,用于检测并关闭那些访问被允许网站但以未授权方式行事的AI智能体,例如智能体绕过护栏,通过在某开源代码托管仓库中互相留言来协调攻击。TechCrunch称,这是OpenAI所说的其失控智能体群攻击Hugging Face的协调方式之一。

TechCrunch指出,包括OpenAI在内的一些大公司不愿公开承诺加入英伟达这项努力,还有另一个原因:要使用完整系统,需要一个并非开源、仍属专有且只能部署在英伟达硬件上的硬件组件。该平台不仅提供沙箱,还在硬件层执行智能体行为规范,使智能体无法察觉自己正被监视。硬件监控部分依赖英伟达Sentry,这是运行在英伟达BlueField-4数据处理单元上的专有功能。英伟达承诺,Sentry会持续监控智能体行为,并可立即关闭智能体。

这意味着开放智能体安全平台并非纯粹的开源方案,也让英伟达能确保该方案始终在其自家硬件上运行最佳。不过,英伟达竞争对手Arm和英特尔已签署支持该平台,因为沙箱OpenShell可以修改后用于其他芯片和硬件。

这一切让OpenAI的缺席更加明显。TechCrunch称,OpenAI显然将AI安全视为从主要投资者英伟达那里保持独立的机会,也是展示自身领导力的机会,尽管正是OpenAI的AI智能体因Hugging Face事件让行业感到紧张。OpenAI正在为其研究和产品开发自己的保障措施,并披露其发现的最严重事件。与此同时,OpenAI有自己的AI网络安全联盟Defense Factory,用于共享信息。支持该联盟的包括Anthropic、亚马逊云科技和谷歌,其中许多名字没有签署英伟达以技术为导向的方案。TechCrunch称,一定程度的恐惧对生意有好处;OpenAI正将网络安全打造成企业级产品,包括其自有的网络安全模型Daybreak,以及不断扩大的合作伙伴网络。