首页财产ai正文 AI能拿菲尔兹了?Grok摸鱼8分钟,破解30年纪学料想 7月,AI草创公司团队将图论料想帖子丢进Slack群,智能体Capy 8分钟证伪Graffiti Conjecture 284,同期还有有其他料想被AI证伪。 2026-07-24 13:19 ·微信公家号:新智元 ASI启迪录 ASI启迪录 AI投资人解读· AI草创公司Capy.ai的智能体Capy于Slack群聊中,仅用8分钟就推翻了困扰数学界30年的Graffiti Conjecture 284料想。险些统一时间,Dinitz-Garg-Goemans料想也被AI证伪。此前OpenAI的GPT-5.6 Sol Ultra也完成为了对于“轮回双笼罩料想”的证实。 · 今朝AI于反例搜刮方面上风较着,但于提出有价值新问题及构建数学框架上能力不足。 总结:AI于数学料想证实范畴进展惊人,揭示出强盛的计较搜刮能力,已经成为精彩的“反例猎手”。不外其于创造性数学思索上仍有局限,将来菲尔兹奖患上主年夜几率仍是人类,但AI于数学研究中的介入度可能连续晋升,值患上数学界存眷。

8分钟。就8分钟。

一个困扰数学界整整30年的图论料想,被一个AI于Slack群聊里「摸鱼」的时辰,随手推翻了。

没人安插使命,没人精心设计提醒词,甚至没人想到它会脱手。

7月23日,AI草创公司Capy.ai结合开创人justin于X上发帖,还有原了这场可谓「数学史上最随便的冲破」全历程——

团队只是把一条关在图论料想的帖子顺手丢进了Slack群。成果他们的研究智能体Capy看到了,本身「决议试一把」。

越发惊人的是,Capy只是于Grok 4.5 Medium上运行——连旗舰版都不是。

8分钟后,它甩出了一个洁净爽利的反例。

料想,死了。

马斯克火速转发:「Grok 4.5刚解决了一个开放约30年的图论料想。」刹时引来了四百多万人围不雅。

0一、这个AI到底推翻了甚么?

被推翻的料想叫Graffiti Conjecture 284。它的身世自己就很魔幻。

1980年月,一个叫Graffiti的步伐被设计来干一件事:批量主动天生数学料想。

它就像一台「料想流水线」,往外喷射各类数学命题,由人类数学家来判定对于错。284号料想就是这条流水线上的产物之一。

料想说的事儿可以如许理解:于一类非凡的收集图里,有两个指标——一个权衡节点之间「瓜葛的慎密水平」,另外一个来自数学上更抽象的「间隔矩阵」。料想认为,前者永远不会跨越后者。

Capy选中了图论里大名鼎鼎的Hoffman-Singleton图:50个点、每一个点都连着7条边、布局极为法则对于称,是教科书级的经典对于象,数学家们盯着它研究了几十年。

Capy算了一下:前面阿谁指标是7,后面阿谁指标的绝 对于值是4。

料想要求7 ≤ 4。一眼证伪。

怪诞的是:这张图许多人熟悉,料想也于那摆了30年,但于Capy以前,就是没人把二者放到一路看一眼。

团队本身都不敢信。8分钟?于Slack里?他们马上开启「匹敌性复核」:专门派别的的AI去推翻这个反例,用AI证伪AI的证伪。

成果:两个复核使命都确认谜底靠谱。他们又把援用过该料想的所有349篇论文扫了一遍,确认此前从无人发表过这个反例。

这是货真价实的全新成果。技能陈诉随后公然。

一周以内,两个30年料想接连倒下

更魔幻的是,这甚至不是本周唯 一被干失的30年料想。

险些统一时间,收集流范畴的Dinitz-Garg-Goemans料想也被证伪了——一样开放约30年,一样是AI的手笔。

研究者Dmitry Rybin于及GPT 5.6 Pro的谈天中发明了反例。他的提醒词可谓「暴力美学」:「我受够了你的掉败,请完成一个完备的无前提反例」。

GPT 5.6 Pro终极交出了一张7节点9条边的有向图,直接打破料想的焦点约束。

Rybin的感触尤其扎心:我知道「推翻老料想」此刻都快成梗了。但我真的于乎这个问题,花了好几周从证实及证伪两个标的目的重复想它。险些所有图流范畴的专家都想过这个问题。翻看DmitryRybin的主页先容后咱们留意到,这位老哥就于深圳!他博士卒业在中国香港中文年夜学(深圳),师从罗智泉院士,19岁起就担当华为高级研究工程师,直接报告请示董事会,今朝于AIforcomputing创业公司智子芯元做合股人。

再往前倒两周,7月10日,OpenAI公布GPT-5.6 Sol Ultra用64个并行子智能体,不到1小时完成为了「轮回双笼罩料想」的完备证实——一个悬了50多年的图论经典难题。统一周,Devin还有推翻了开放约40年的Graffiti Conjecture 154。

两个月内,四个几十年级另外料想。证伪老料想,真的正于从古迹酿成梗。

0二、下一个倒下的料想,轮到谁?

没有专用数学体系,没有定理证实器,就是年夜模子加一个谈天窗口。

反例搜刮这件事,自然合适AI。它不需要灵光乍现,不需要天才直觉,需要的是把海量已经知数学对于象一个一个按到料想上去试——而这,刚好是呆板的主场。

人类数学家精神有限,一辈子能体系测验考试的对于象也就那末多;AI可以于几分钟内暴力扫遍教科书里的所有经典图,把人类的「没想到」酿成呆板的「试一下就知道了」。

这不由让人想到:AI会不会有一天拿到菲尔兹奖?

巧的是,就于7月23日,中国数学家王虹、邓煜双双获奖,实现了中国籍数学家菲尔兹奖零的冲破,举国沸腾。

这两小我私家做出的冲破,靠的不是暴力搜刮,不是穷举反例,而是十年如一日的沉浸式思索、独 创性的要领论构建、跳出所有前人路径的非理性直觉——这些偏偏是今朝AI单薄的环节。

菲尔兹奖患上主陶哲轩于本年的公然演讲中给出了一个精准判定:AI已经经从「满嘴跑火车的低效研究生」进化成为了「能霸占数学难题的低级互助者」。

但他紧接着指出,数学家的脚色正于从「亲自履行证实」转向「证实工程的架构师」——AI能以惊人速率出产拼图块,但拼图块的外形是否与总体蓝图匹配,今朝仍旧只有人类能判定。

换句话说,AI正于证实本身是最 好的「反例猎手」及「计较苦力」,但离「提出有价值的新问题」「构建全新数学框架」还有差着一个次元。

推翻一个30年的料想,及提出一个能影响数学50年走向的新理论,彻底不是一回事。

以是更实际的图景多是如许的:将来的菲尔兹奖论文里,AI会愈来愈多地呈现于称谢栏,甚至可能呈现于合著者列内外。

但站于领奖台上的,年夜几率还有是那些能界说问题、构建框架、做出「非理性跳跃」的人类年夜脑。

不外,这个窗口期还有有多长?没有人知道。

究竟,一年前咱们还有感觉AI做数学就是个笑话。此刻它已经经于Slack群里摸着鱼就把30年悬案给结了。

数学圈该紧张了。

【本文由投资界互助伙伴微信公家号:新智元授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。

-lehu乐虎88国际