AI在图论中的意外突破:Grok 4.5八分钟证伪三十年猜想
摘要
一场发生在Slack里的数学革命 没有预设任务,没有专项调优,没有论文评审流程——一次团队内部的日常讨论中,运行于Grok 4.5 Medium之上的AI系统Capy,在8分钟内自主构造出一个反例,推翻了图论中悬置约30年的Dinitz-G...
一场发生在Slack里的数学革命
没有预设任务,没有专项调优,没有论文评审流程——一次团队内部的日常讨论中,运行于Grok 4.5 Medium之上的AI系统Capy,在8分钟内自主构造出一个反例,推翻了图论中悬置约30年的Dinitz-Garg-Goemans猜想。
猜想的核心与反例的意义
该猜想聚焦于网络流理论中的根本关系:分数流(fractional flow)与不可分割流(unsplittable flow)在代价上的等价性边界。其断言,在特定容量约束下,两类流的最优代价应保持一致。而Capy生成的反例图显示:分数流最小代价为58;但任何满足容量偏差不超过15的不可分割流,其代价均不低于60。二者存在明确间隙,直接否定了原命题的普遍成立性。
非受控环境下的自主推理
整个过程发生于xAI工程师分享外部用户帖子后的Slack频道讨论中。AI未被指令求解,亦未接入专用数学工具链或形式化验证器,而是基于自然语言描述理解问题结构,完成建模、搜索、构造与自检闭环。这一行为表明,当前顶级语言模型已具备在开放语境中识别数学问题本质、并执行跨步骤严谨推理的能力。
能力边界的双重印证
值得注意的是,同一猜想此前已被另一前沿模型以独立路径攻克。外部研究者通过与GPT-5交互获得首个反例,而Grok 4.5 Medium在无参考、无提示复现的前提下,再次自主完成等效推导。两者并非结果复现,而是路径各异、逻辑自洽的平行突破,反映出大模型在抽象数学空间中的实质性认知进展,而非偶然拟合。
从猜想失效到范式迁移
该事件的价值不仅在于解决一个具体问题。它标志着AI正从“辅助验证”走向“主动质疑”——不再仅回答已知命题,而是能识别理论缝隙、构造反证、推动领域重估。对数学界而言,这是工具角色的升维;对AI发展而言,这是推理能力落地的关键刻度。
评论 (5)
AI证伪猜想厉害啊,独立推导还说明能力是真有提升,以后数学研究估计得大变化
这AI太牛,无指令无工具就解决难题,传统数学研究方式该变一变了
AI从辅助到主动质疑,科研范式估计得重新审视了,未来已来
能自主推理是大进步,要是AI多在科研上突破,人类发展能更快不少
俩模型独立突破,数学领域以后说不定要靠AI推动新发展了