据量子位报道,菲尔兹奖得主陶哲轩9月18日代表SAIR Foundation宣布启动“开放数学模型计划”,意在联合学术界与产业界,为数学及科学研究构建开放权重模型与配套开源工具,首阶段聚焦理解论证、核对文献、形式化证明等日常科研场景。该计划以开放权重、可复现评测与社区治理为原则运作,即日起面向社区征集资金、算力、专业经验与社区建设方面的合作伙伴。

陶哲轩在声明中称,他去年与几位科学家和投资人共同创立SAIR Foundation,目标是打造一个非营利组织,在数学及其他科学领域支持人工智能的负责任使用,且不依附于任何大型AI公司。基金会资源起初相当有限,主要活动集中在播客、短期活动与竞赛,近期获得XTX Markets支持,资助了下一轮SAIR竞赛。他同时表示,基金会正与来自学术界与产业界的多家关键伙伴洽谈一项计划,目标是构建面向科学的开放权重模型,以及便于同时使用开源与闭源大语言模型的科学开源工具。

按照原计划,该计划将循序渐进推进,未来几个月先从若干试点项目起步。但陶哲轩称,考虑到当下形势与各界对开放模型的强烈需求,基金会决定加快进度,将首次公开宣布提前,尽管部分关键规划仍在推进之中。目前计划已开始征集意向表达,意向可在公告页面底部登记。基金会计划在短期内发布更多更新与信息,包括合作伙伴名单,以及将该计划融入现有播客、活动与竞赛体系的后续规划。

公告介绍,数学因可被他人审视与延续的发现而进步,一代代研究者构筑了共享的知识体系,靠开放交流和对彼此贡献的尊重维系。当人工智能成为数学研究的一部分,这些准则应当塑造人们使用的工具。第一阶段将聚焦日常数学工作,包括理解艰深论证、核对文献、探索示例、编写代码以及形式化证明。计划将以可靠的辅助、可验证的结果以及持续使用的成本来衡量其价值。

在开放开发方面,模型将提供开放许可的权重与代码,公开训练方法,并提供可复现的评测。训练数据将附带可追溯的来源与兼容的授权,其共享边界会被清楚标注。模型发布时,将同时报告失败与局限,而非只宣扬成功。独立团队将能够复现这项工作,并把模型适配到自身的数学需求。数据方面,公告称数学界拥有数据,并决定其使用方式;计划将仅在获得用户明确同意、且依据事先约定条款的前提下,使用用户数据训练或改进模型,研究者自行决定分享什么、出于何种目的分享。

知识产权方面,本计划开发的模型、代码与工具将在开放许可下与社区共享,例如Apache 2.0、MIT或CC BY 4.0,视情况而定。联合开发成果的权属、许可与署名,应从一开始就与贡献者约定。研究者保留其独立既有成果的权属,这些成果若分享给本计划,研究者将为其数学思想与结果获得署名。治理方面,计划欢迎跨越机构、地域与职业阶段的参与,数学界应当治理这项计划,设定优先事项并决定共享资源如何使用,治理规则与决策将公开。公告同时称,计划会与战略产业伙伴合作以提供算力等资源,但这些合作必须保持社区的研究独立性。

公开资料称,SAIR Foundation成立于2025年,是一家由陶哲轩发起、多位诺贝尔奖得主及全球顶尖科学家共同指导的非营利性研究机构。基金会致力于解决科研体系的结构性瓶颈,通过跨学科的全球协作,以科学、安全的方式加速向通用人工智能和超级人工智能演进。基金会强调构建全球顶尖科学家网络,关注科研范式变革,并将可验证性作为核心原则,以应对AI在科研中的幻觉问题。