OpenAI 公布了一款尚未发布的前沿模型对长期未解数学问题给出的解答,共计 722 篇论文稿件,涉及 372 组结果。该消息最先由 The Verge 报道。此番发布正值有关研究伦理、学术规范的讨论升温之际,也引发了人们对企业如何致谢其系统所依托、并可能用于产出结果的人类数学家工作的关注。
这 372 组结果涵盖了相关论文。此次发布还包括部分模型推理过程摘要、计算资源用量估算,以及模型尝试解决的问题数量统计。OpenAI 表示,平均每项结果所用的计算量,相当于 ChatGPT Pro 思考三小时。
今年 9 月,OpenAI 表示,其模型已解决数学多数领域中 100 多个长期未解的开放问题。AGMAI 表示,此次发布包含数百个开放问题的解答。
AGMAI(数学与人工智能咨询组)是一个新成立的独立咨询组织,由顶尖数学家组成,负责以负责任的方式传达相关成果。该组织于 9 月下旬发布首批建议,敦促 AI 实验室尽可能通过成熟的学术渠道及时发布数学成果,并披露模型名称、提示词和计算成本。
AGMAI 还敦促 AI 公司不要把数学成果发布当作模型的营销工具,并表示这种做法会对数学界造成重大伤害。
OpenAI 表示,将通过 GitHub 仓库发布这些成果,并制定论文修订和引用的规范。公司也在继续探索其他由社区托管、且符合委员会指南的发布方式。OpenAI 表示,未来将继续提升论文质量,包括完善引用、数学阐释和成果呈现。
论文稿件数量展现了此次发布的规模,而 AGMAI 的建议则着眼于成果应如何分享。
数学家评估并消化这些成果可能需要一段时间,因此其全面影响或许不会立刻显现。这些成果也加入了 OpenAI 及 Anthropic 等竞争实验室迅速扩大的数学成果库,数学界仍在消化其中的内容,包括涉及千禧年大奖问题之一的成果;这类问题是数学界最著名的开放问题之一。
