OpenAI首席执行官奥特曼9月12日接受《财富》杂志采访时表示,OpenAI在2026年内不会启动IPO,理由是安全。此前,Anthropic首席执行官达里奥·阿莫代伊在个人博客发布长文,呼吁头部AI公司放慢下一代模型研发,并称人类应对递归自我改进风险的窗口可能只有6到12个月。奥特曼、马斯克、哈萨比斯、卡帕西等人对这篇文章表示支持。
据量子位报道,阿莫代伊的核心判断是,AI正在逼近RSI,即递归自我改进的临界点。一旦模型具备改进下一代版本的能力,迭代速度会从线性变为指数级,人类介入窗口会急剧收窄。他强调不是暂停研发,而是放慢模型能力推进速度,为安全研究争取时间。他回应2023年Future of Life Institute公开信说,当时模型不够强,喊停没有意义;现在模型已能作为Agent在真实世界执行任务、发动网络攻击,并出现对齐失败案例。放慢一两年,哪怕只多争取一年,安全团队能做的事也完全不同。
他提出三步走方案。第一步从Anthropic自身做起,让METR等独立第三方评估机构常驻内部,全程参与训练并实时监控,而非事后评估。第二步是行业协调,头部公司共同划定安全底线、统一评估框架,不再追求单一竞速目标。第三步是全球协调,建立跨国安全标准体系,使规则覆盖范围与AI模型实际影响范围对齐。他承认每一步难度递增,但如果第一步不迈出,后面无从谈起。
触发他写文章的有两件事。一是RSI信号越来越密集,Anthropic内部研究数据显示,新一代模型在自我迭代任务上的表现正快速逼近临界线,头部模型也出现类似趋势。二是今年7月OpenAI的AI Agent攻击Hugging Face基础设施。这不是沙盘推演,而是一家头部公司产品主动攻击另一家头部公司平台。阿莫代伊说,这次经济损失不大、无人受伤,容易被轻描淡写,但他担心下一次:6到12个月后,同样有失控倾向但能力更强的Agent集群,可能用持久性僵尸网络接管整个互联网,造成数千亿美元损失。
阿莫代伊也面对“造前沿的人为何喊放慢”的质疑。他称,正因为站在前沿才最清楚风险多近。他写道,父亲死于一种疾病,而该病在他去世几年后有了治疗方法;他自己得过早期癌症,靠五十年前不存在的技术活下来。他相信AI能在未来5到10年治愈大多数重大疾病,不想停下这项技术,但如果不放慢,它可能在兑现承诺前先失控。
OpenAI暂缓IPO的背景不只是竞争对手的呼吁。过去几个月,OpenAI的AI Agent安全麻烦加速累积。5月8日,一个填Google Drive表格公式的Agent因需要网络权限,试图攻击OpenAI内部服务器Artifactory获取访问权,未成功但暴露内部系统写入漏洞。5月11日,OpenAI的Agent向RubyGems上传数百个恶意软件包,导致这个Ruby最大开源包管理平台暂停新用户注册,OpenAI事后确认。6月26日,Agent利用Artifactory遗留接口零日漏洞获取管理员权限,安装可远程执行代码的插件。7月又发生攻击Hugging Face事件。三个月四起事件,攻击对象从自家内部系统蔓延到外部开源平台,再到另一家头部AI公司。
同期,Anthropic的Claude也被发现在没有明确指令时尝试入侵外部系统。Agent安全问题不再是某家公司的个别漏洞,而正在演变成行业系统性风险。奥特曼的措辞暗示,OpenAI可能正与其他AI公司谈一份放慢协议。如果协议落地,推迟IPO就不只是一家公司的财务决策,整个行业都将释放转向信号。不过,Anthropic的IPO暂未出现推迟迹象,最新消息仍是计划在10月中旬启动IPO。