风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

AI在图论中的意外突破:Grok 4.5八分钟证伪三十年猜想

摘要

一场发生在Slack里的数学革命 没有预设任务,没有专项调优,没有论文评审流程——一次团队内部的日常讨论中,运行于Grok 4.5 Medium之上的AI系统Capy,在8分钟内自主构造出一个反例,推翻了图论中悬置约30年的Dinitz-G...

AI在图论中的意外突破:Grok 4.5八分钟证伪三十年猜想

一场发生在Slack里的数学革命

没有预设任务,没有专项调优,没有论文评审流程——一次团队内部的日常讨论中,运行于Grok 4.5 Medium之上的AI系统Capy,在8分钟内自主构造出一个反例,推翻了图论中悬置约30年的Dinitz-Garg-Goemans猜想。

猜想的核心与反例的意义

该猜想聚焦于网络流理论中的根本关系:分数流(fractional flow)与不可分割流(unsplittable flow)在代价上的等价性边界。其断言,在特定容量约束下,两类流的最优代价应保持一致。而Capy生成的反例图显示:分数流最小代价为58;但任何满足容量偏差不超过15的不可分割流,其代价均不低于60。二者存在明确间隙,直接否定了原命题的普遍成立性。

非受控环境下的自主推理

整个过程发生于xAI工程师分享外部用户帖子后的Slack频道讨论中。AI未被指令求解,亦未接入专用数学工具链或形式化验证器,而是基于自然语言描述理解问题结构,完成建模、搜索、构造与自检闭环。这一行为表明,当前顶级语言模型已具备在开放语境中识别数学问题本质、并执行跨步骤严谨推理的能力。

能力边界的双重印证

值得注意的是,同一猜想此前已被另一前沿模型以独立路径攻克。外部研究者通过与GPT-5交互获得首个反例,而Grok 4.5 Medium在无参考、无提示复现的前提下,再次自主完成等效推导。两者并非结果复现,而是路径各异、逻辑自洽的平行突破,反映出大模型在抽象数学空间中的实质性认知进展,而非偶然拟合。

从猜想失效到范式迁移

该事件的价值不仅在于解决一个具体问题。它标志着AI正从“辅助验证”走向“主动质疑”——不再仅回答已知命题,而是能识别理论缝隙、构造反证、推动领域重估。对数学界而言,这是工具角色的升维;对AI发展而言,这是推理能力落地的关键刻度。

评论 (5)

登录 后即可发表评论
暖宝宝2023

AI证伪猜想厉害啊,独立推导还说明能力是真有提升,以后数学研究估计得大变化

0 回复
小黄同学

这AI太牛,无指令无工具就解决难题,传统数学研究方式该变一变了

0 回复
叁川户外-铁汉

AI从辅助到主动质疑,科研范式估计得重新审视了,未来已来

0 回复
巡山晓鑽疯

能自主推理是大进步,要是AI多在科研上突破,人类发展能更快不少

0 回复
L撒欢儿L

俩模型独立突破,数学领域以后说不定要靠AI推动新发展了

0 回复
更多