OpenAI内部模型24天再解百余道数学难题,引入独立顾问组回应学界质疑

OpenAI内部模型24天再解百余道数学难题,引入独立顾问组回应学界质疑

AI模型24天又解决了百余道长期悬而未决的数学问题。

当地时间9月21日,OpenAI宣布,除此前公布的纳维–斯托克斯(Navier–Stokes,简称NS)千禧年难题外,一款自8月28日开始训练的内部模型,已解决数学多个领域的百余项难题。

OpenAI表示,模型在数学领域的进展速度令内部数学家感到意外,也促使其讨论如何向数学界披露成果,让研究者有时间准备和适应。

图片由AI生成

在披露进展的同时,OpenAI宣布与数学家成立的独立顾问组合作,就研究成果的评估、审查和发布等提供建议。

此前,围绕OpenAI“88小时解题”的研究贡献归属,以及将数学难题作为AI能力测试的做法,数学界已出现质疑。

9月8日,OpenAI公布NS问题研究结果,称内部AI系统给出了数学证明,并将证明过程转换为可由计算机逐步核查的形式。按照披露,从首批智能体启动到得到解答,系统耗时约88小时,之后又用了17小时完成证明的形式化与验证。

伴随研究结果公布,贡献归属问题受到关注。据外媒此前报道,纽约大学数学教授特里斯坦·巴克马斯特(Tristan Buckmaster)质疑OpenAI借用了其研究思路。他曾与Anthropic研究员Levent Alpöge合作,并使用AI工具开展研究。

OpenAI在9月10日的说明中回应称,经内部调查,巴克马斯特在公告发布前两个月输入Codex的提示词,不可能通过训练或其他方式影响此次系统。同时,OpenAI承认对方在有外力欧拉方程研究上的优先成果,并称双方证明存在显著差异。

9月11日,多位数学家联名发表公开信,批评AI公司将攻克数学难题作为模型能力测试的做法,认为企业与数学界的目标存在严重错位,署名者包括陶哲轩、彼得·舒尔策、马丁·海雷尔等。

数学家联名公开信截图

公开信强调,解题是通向概念理解和新思想的手段。数学成果还需要经过讲解、讨论、简化和传播,才能成为其他研究者能够理解和使用的知识。如果仓促公布结果,没有充分提炼方法、解释思路和引用前人工作,就会引出贡献归属等问题。

数学家们认可AI促进数学研究的潜力,但担忧当机器越来越擅长直接给出答案时,人类通过研究积累理解、培养人才和提出新问题的过程可能被忽视。

此次独立顾问组的成立,为双方建立了新的沟通渠道。

据介绍,OpenAI最初接触部分成员,希望设立外部顾问委员会。经协商,数学家决定成立独立组织,并邀请其他成员加入。首批9名成员包括蒂莫西·高沃斯、马丁·海雷尔、爱德华·威滕等。其中,海雷尔也是前述公开信的署名者。

此外,顾问组独立于任何AI公司,成员不就这项工作收取报酬,建议将公开发布;服务对象也不限于OpenAI,可以包括其他对数学产生重大影响的AI企业。目前,其具体任务是就OpenAI所称由内部模型产出的大量重要数学成果,研究如何协调发布,并征集数学界意见。

按照OpenAI的说明,顾问组将就成果重要性、学术规范,以及AI工具如何支持研究与学习提供建议。不过,OpenAI也明确表示,顾问组不负责就其内部数学研究的推进速度提供建议。

顾问组也表示,它在任何AI公司都没有决策权,企业仍须为自身决定负责。