跳到正文
原文
The Verge · AI· Robert Hart·· 6 小时前精选AI 评分92

OpenAI 发布近 400 项 AI 生成数学成果引发学界对验证缺失与学术冲击的担忧

‘Pure insanity’: Mathematicians will need years to make sense of OpenAI’s latest drop

AI 导读

OpenAI 本周向数学界发布了近 400 个 AI 生成的数学结果,涵盖组合学、几何、数论等 700 多篇手稿,被多位数学家形容为“纯粹的疯狂”和“前所未有的洪流”。尽管部分成果涉及黎曼猜想、霍奇猜想等千年难题,但仅有约 300 个结果(占总数 42%)完成了 Lean 形式化验证,其余大量论文缺乏严谨的计算机可验证证明,导致学界难以在短时间内确认其正确性。

这一发布暴露了当前 AI 科研产出的核心矛盾:速度远超人类理解能力,且质量参差不齐。许多论文存在引用不规范、篇幅过短、逻辑跳跃等问题,甚至出现因符号错误而撤回的情况。OpenAI 虽承诺改进论文质量和补充形式化验证,但未披露具体模型名称、提示词及完整测试问题集,也未停止对数学问题的持续测试。这种“先发布后解释”的模式加剧了学术界的不安,尤其是对博士生和初级研究员而言,其研究计划可能瞬间被颠覆。

事实层面,OpenAI 确实释放了大量数学成果,部分具有高度价值;推断层面,这标志着 AI 正从辅助工具转向独立研究者角色,但尚未建立配套的验证与责任机制;猜测层面,未来可能出现更多类似规模的发布,进一步压缩人类数学家的生存空间。整个事件反映出 AI 实验室在追求技术突破时,对学术生态和社会影响的系统性忽视。

推荐理由

材料揭示了AI生成数学成果在验证与学术规范上的巨大缺口,迫使从业者重新评估对前沿模型产出可靠性的判断。

来源:The Verge · AI · theverge.com