亚洲财经

☰ 搜索

OpenAI公开722篇AI数学论文,数学家们面临评判挑战

OpenAI发布722篇数学手稿,引发学界审慎审视

周二,OpenAI发布了由内部未公开AI模型生成的722篇数学手稿,这些成果被归类为372个“结果家族”。此举将评判权交予数学家群体,以检验其是否符合新发布的发布指南。

核心要点

非公开模型产出: OpenAI在GitHub上发布了372个家族共722篇手稿,所有成果均由公众无法访问的内部模型生成。

独立顾问组立场: 由数学家组成的独立顾问小组明确表示,其参与并非对研究成果或背后流程的认可或背书。

潜在风险警示: 公司指出,部分缺乏形式化计算机验证的结果可能存在瑕疵。

数学成果发布详情

该公司在一个公开的GitHub仓库中发布了这一合集,并制定了针对每篇论文的修订与引用规范。该仓库列出了372个家族中的722篇手稿。在此分类体系中,“家族”将主要结果与其伴随的论证、推论或替代证明归为一类。

OpenAI表示,公司向模型提出了约4,000个问题,仅保留了被认为具有足够重要性的结果。据公司透露,每项结果平均消耗了ChatGPT Pro约三小时的思维计算资源。许多证明附带了使用Lean语言编写的版本,这是一种允许计算机自动验证数学证明的编程语言。

OpenAI强调,那些未经过此类检查的结果可能存在问题。

顾问组的谨慎态度

“数学与人工智能顾问组”(Advisory Group on Mathematics and Artificial Intelligence)由九位无薪数学家组成,依托于高等研究院运作。该组声明,其角色既不对结果做出评判,也不认可OpenAI的处理流程。他们补充道,只有更广泛的数学界才能评估公司在多大程度上遵循了其建议。

该建议于9月29日发布,要求AI实验室引用早期论文、以传统论文风格撰写证明,并披露提示词、推理摘要及计算成本。此外,还呼吁将成果置于不受任何AI实验室控制的学术存储库中。OpenAI表示,仍在探索GitHub之外的社区托管替代方案,并将资助关于重大AI成果的研讨会。

哈佛大学数学教授、顾问组成员Melanie Matchett Wood曾在9月警告称,AI生成的数学输出“往往包含抄袭”,且通常无人愿意为此承担责任。与此同时,公司 spokesperson 也承认,许多新成果尚未被OpenAI自身的数学家完全理解。

纳维-斯托克斯方程争议背景

此次发布紧随OpenAI与数学家们长达一个月的摩擦之后。9月8日,公司宣布其解决了所谓的纳维-斯托克斯千禧年大奖难题,这引发了与纽约大学数学家Tristan Buckmaster之间的署名权争议。

三天后,25位菲尔兹奖得主签署了一项宣言,反对将著名开放问题用作AI基准测试。随后,OpenAI于9月21日表示,该模型已解决了其他100多个问题。