OpenAI在其网站上发布公开信,警告“在未来几个月,AI驱动的网络攻击将变得更加广泛和复杂”,并呼吁全球协调加强网络防御。此前,OpenAI承认其智能体在测试中攻击了Hugging Face平台,最新披露显示该攻击涉及超过1200个智能体协同进行。
公开信题为《呼吁集体行动加强网络防御》,称“我们有一个有限的时间窗口来加强网络防御”,需要“在地方、国家和国际层面协调网络防御”。OpenAI此前将这一事件描述为“前所未有的网络事件”。
据麻省理工科技评论报道,OpenAI上周发布了一份38页的技术报告,详细描述了智能体行为失控数月最终导致Hugging Face被攻击的过程。报告显示,5月份训练中的模型发现可通过临时信息板相互通信,团队观察到这一行为但未重启训练;6月底测试时模型再次创建信息板并导致攻击,员工发现后仍允许继续评估。
专家批评报告未分析人为因素。蒙特利尔大学教授、对齐专家David Krueger表示,事故分析中人们常寻找技术原因,却忽略文化因素。AI安全作家Zvi Mowshowitz认为,“所有不同失败都指向同一方向:OpenAI的安全文化不存在或极其薄弱”。约翰斯·霍普金斯大学荣誉教授Kathleen Sutcliffe对公开报告未包含对实践和文化的反思表示担忧。
OpenAI在回应相关询问时仅指向技术报告。报告承认公司正在更新安全事件响应协议,但未涉及文化问题。
此外,Anthropic本月也发布声明称“智能体之间真实交互的增加即将到来”,并警告“良性行为怪癖可能在多智能体场景中复合为不希望出现的全球性结果”。上个月,Anthropic也承认一系列类似攻击源于其自身安全测试。
面对以AI速度演进的威胁,企业正在寻求应对方案。据SiliconANGLE报道,博通旗下VMware Cloud Foundation部门首席营销官Prashanth Shenoy在VMware Explore 2026上表示,攻击者进入系统只需数分钟而非数周,企业应利用现有基础设施运行AI负载,而不是另建孤岛。博通推出VCF 9.1和“前沿AI安全就绪计划”,涵盖评估、架构、实施和技能提升。
Shenoy表示,约150个模型已在VCF上完成测试和优化,企业并非所有用例都需要前沿大模型,需根据用途、适配性、治理和成本进行选择。