OpenAI于9月8日宣布,其内部AI模型已找到纳维-斯托克斯问题的解法。这一问题是克莱数学研究所2000年设立的七大千禧年难题之一,每个问题悬赏100万美元,此前仅有庞加莱猜想被攻克。新结果公布的同时,也陷入了一场围绕研究数据与署名问题的争议。
据The Verge报道,OpenAI表示,这个内部模型于8月28日开始训练,比刚发布的GPT-6 Astra更强大,并与约1万个并发代理协同工作。OpenAI在公告中说,它不会领取这一难题的100万美元奖金。
就在OpenAI发布公告前一天,纽约大学数学教授Tristan Buckmaster与Anthropic研究员Levent Alpöge联合发布了三项数学证明,其中包含对纳维-斯托克斯问题的初步成果。据TechCrunch报道,两人在研究过程中使用了OpenAI的编码工具Codex和Anthropic的AI模型Claude。Buckmaster说,当他们两人的研究即将收尾时,得知自己的进展信息已被传到OpenAI。
Buckmaster称,他联系OpenAI后,对方声称已经完成了该问题的完整证明,但回避了开始研究时间和人类参与程度等问题。他质疑,OpenAI所采用的技术路线与他二人选择的路线完全相同,而这条路线在数学界几乎无人使用,不可能由模型在几天内独立得出。
据Engadget报道,Buckmaster还询问OpenAI,其模型是否接触过他和Alpöge在Codex中的全部项目草稿,对方回答模型不会查找用户数据,但他再次追问训练数据时,没有得到答复。他随后与OpenAI的Sebastien Bubeck及另一名人士沟通,对方提出两种安排:要么由Buckmaster先发表部分进展,次日由OpenAI发表完整证明;要么由Buckmaster独自发表论文,不列Alpöge为合著者。Buckmaster拒绝了这两个方案。
Bubeck在社交媒体上回应称,Buckmaster的说法“虚假且具有煽动性”,并表示自己参与讨论时遵循学术规范,对事情发展到这一步感到失望,稍后将发布更完整的声明。OpenAI在公告中说,它“没有访问任何特定用户数据以解决这个问题”,但承认“虽然可能性不大,我们不能排除经过去标识化的用户数据帮助改进了模型”。OpenAI首席执行官Sam Altman也公开回应。据The Verge报道,Buckmaster随后在Mastodon上发文称,OpenAI“公开承认使用了其获得结果之后的训练数据”。
TechCrunch指出,OpenAI保留使用Codex交互记录训练模型的权利,用户可以选择退出。如果OpenAI团队的模型基于Buckmaster与Alpöge在Codex中的会话数据训练,在遇到类似问题时,该模型有可能复述他们的工作。OpenAI未回应这一可能性。
Buckmaster在声明中写道:“我没有看到OpenAI的证明,不知道他们的模型做了什么,也不知道是否使用了我们的数据。我没有指控任何人。”他说,如果他不公开这些经过,后续声明就会让他所知道的事实被歪曲。