OpenAI于10月6日公布了一批由其尚未发布的前沿模型生成的数学问题解答,共722篇论文手稿,覆盖372个成果族,即把相关论文归入同一组。据The Verge报道,这是该公司连续取得数学突破的最新一批成果。
由一批顶尖数学家新组成的独立顾问团体AGMAI(数学与人工智能咨询组)表示,此次发布包含“数百个”未解问题的解答。这批结果已被预期数周,但在此之前,OpenAI一直没有说明模型究竟解决了哪些问题,也未给出确切的发布时间。
9月,OpenAI曾表示其模型“解决了数学大部分领域中100多个长期未解问题”。此次发布的论文及其他材料还包括模型部分推理过程的摘要、所用算力的估算,以及尝试问题数量的统计。OpenAI称,“平均结果”相当于ChatGPT Pro思考三小时。
AGMAI在9月底发布首批建议,敦促AI实验室及时发布数学成果,尽可能通过既有学术渠道,并披露所用模型名称、提示词和计算成本等信息。该团体还呼吁AI公司“不要将数学成果的发布当作推广自身模型的营销工具”,称这一做法对数学界造成严重伤害。
对于此次发布的流程,OpenAI表示,结果发布在GitHub仓库中,并附有论文修订与引用协议;公司正在探索符合该委员会指南的其他社区托管方案,今后的发布将通过引用、数学阐述和结果呈现方式继续提高论文质量。
这些结果的全部影响可能还需要一段时间才能显现,数学家正在评估和消化。它们进一步扩充了OpenAI及Anthropic等竞争对手实验室迅速积累的数学成果,其中包含涉及千禧年大奖难题的结果,该难题是数学领域最著名的未解问题之一。
今年以来,AI实验室快速进入这门学科,尤其是它们处理公告的方式,引发了关于研究实践、伦理,以及企业如何为人类数学家署名的激烈争论。这些数学家的工作是其系统的基础,也可能被用于产出结果。