OpenAI数学论文争议
5 节点2 篇7 来源
OpenAI于10月6日在GitHub一次性公开了由内部前沿模型生成的722篇数学手稿,声称解决了包括准黎曼猜想、四维挂谷猜想及纳维-斯托克斯方程在内的数百个难题。这一举动并未如预期般获得欢呼,反而引发了数学界关于“机器生成速度远超人类理解能力”的激烈抵制。
【背景】此前OpenAI曾邀请数学家制定发布规范,但此次发布仍被指违背了“确保人类理解”的核心原则。
时间线显示,10月7日OpenAI因符号错误撤回3篇手稿并修订14篇;10月8日《新科学家》报道剑桥大学团队发现其纳维-斯托克斯证明的自然语言版本与Lean形式化代码存在逻辑不一致(Lemma 8.6处阈值差异),质疑自动形式化的可靠性;同日,NYU教授Tristan Buckmaster指出该发布直接摧毁了多名早期职业研究者的未发表项目;10月9日,菲尔兹奖得主陶哲轩转载“人类数学协会”声明,呼吁数学家停止与OpenAI合作,批评此举展示的是“权力而非学术”。
争议核心在于:OpenAI认为这是推动知识边界的透明尝试,且已提供部分计算成本数据;而批评者(如Terence Tao, Melanie Wood)指出,仅42%的结果完成Lean形式化,且缺乏对自然语言与代码对应关系的元数据支持,导致学术界被迫承担巨大的验证负担,甚至可能因恐惧想法被AI吸收而破坏协作文化。目前尚无定论表明这些结果是否全部正确,但信任危机已实质性地改变了人机协作的伦理边界。
后续需关注:1. OpenAI是否会公布更多Lean形式化证明以回应“ mistranslation ”指控;2. AGMAI(数学与人工智能咨询小组)是否会对此次违规发布采取进一步制裁或指导措施;3. 陶哲轩等学者发起的抵制行动是否会导致主流数学期刊拒绝引用未经人工深度重构的AI生成成果。
事情怎么走到这一步
OpenAI在GitHub发布722篇由内部模型生成的数学手稿,涉及372个结果族,约42%附带Lean形式化证明。
openai.com ↗OpenAI更新仓库历史,因符号错误撤回3篇关于Weil类和Hodge猜想的论文,并修订另外14篇。
github.com ↗TechCrunch报道,数学界批评OpenAI未遵循AGMAI建议,特别是未提供自然语言与Lean代码的对应元数据,且仅10篇披露推理链。
techcrunch.com ↗New Scientist报道,剑桥团队发现OpenAI纳维-斯托克斯证明的自然语言版与Lean版在关键引理上存在不一致,引发对自动形式化可靠性的质疑。
newscientist.com ↗