作者lc85301 (pomelocandy)
看板Stock
标题Re: [情报] Anthropic AI 证伪雅可比猜想
时间Mon Jul 20 23:22:19 2026
※ 引述《spen2005 (乡民)》之铭言:
刚好小弟最近有 trace 几个案例,就来献丑一下
: Anthropic 研究员、数论学家 Levent Alpöge 在 X 上宣布,Anthropic 的 Claude
: Fable 5 找到了雅可比猜想的反例,并且已经被迅速验证。
: ---
: "hello there the jacobian conjecture is false thanx to my close friend akhil
: for asking about it and my other close friend fable for working during the
: world cup final"
:
: "雅可比猜想是错的,多亏了我的朋友akhil问起这件事,还有我的另一位朋友Fable,在
: 世界盃决赛期间还在忙这个。"
: ---
: 雅可比猜想是 1939 年提出的经典数学难题,已经困扰数学界超过 80 年,它也和
: Dixmier 猜想、Poisson 猜想、Weyl algebra 等重要问题密切相关,因此这个结果会连
: 带改变数学家对多项式映射、代数几何与非交换代数的理解。
: AI已经开始在数学前沿独立做出贡献,而这只是刚开始。随着形式化验证的成熟,加上持
: 续成长的AI模型,算力或许才是真正的瓶颈,期待未来能看到AI解决更困难的问题。
: 连结: https://x.com/__alpoge__/status/2079028340955197566?s=20
:
: --
:
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 140.112.16.175 (台湾)
: ※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Stock/M.1784550477.A.C5D.html
: 嘘 fifa186 : 所以那里错了?验证细部结果是啥?全都没说 07/20 20:30
: 推 pponywong : 他就说找到反例了 07/20 20:31
就跟费马最後定理一样,它假设 \forall n>2 x^n + y^n = z^n 不存在整数解
你找到一组 x, y, z, n 代进去,可以满足这条式子,费马最後定理就证伪了
: 推 Obama19 : Vibe proofing 时代要开始了吗 07/20 20:39
早就开始了
最近大多是从 Erdos Problem 开始,Erdos 是个匈牙利数学家
https://en.wikipedia.org/wiki/Paul_Erd%C5%91s
他最喜欢做的就是突然跑去某个数学家的门前
管你要不要工作先缠着你讨论数学三天三夜
你满足他之後他就会离开去下一个数学家,藉此他留下了一堆问题与猜想
还有专门的网站在追踪这些问题的状况,让大家可以讨论看看能不能破解
https://www.erdosproblems.com/
第一次是 2026/04 的,有个大学生把 1196 号问题丢进去 ChatGPT 5.4 Pro
GPT 想了 80m 然後就给了个证明出来
https://www.erdosproblems.com/1196
https://chatgpt.com/share/69dd1c83-b164-8385-bf2e-8533e9baba9c
相关评论可以看:
https://www.threads.com/@wang_jackpot/post/DXS55-CmQm6
----
再来就是过了一个月,五月的时候 ChatGPT 跳出来证伪另一 80 年的 Erdos Problem
单位距离猜想
这个推文有人贴中文解释的影片了,有兴趣的大家可以自己看
https://www.youtube.com/watch?v=hMUHQWuYzjQ
这个问题的心得我放在下面的推文一并回应
----
再来就是这次的 Jacobian Conjecture 了
我体感是 2026 ChatGPT 5.4 之後,不确定是吃了什麽聪明药
在证明数学问题上突然有了进展
: → RedLover1009: 他的证伪真的是证伪吗?还是只是AI自认为的证伪? 07/20 20:45
验算一下就好了
: 推 poeoe : 还搞不懂AI有多强的 来看这件事就知道了 07/20 20:48
: 推 smalmal : 最近还蛮多例子的 不管是物理或数学 07/20 20:50
: 推 WSJ8964 : 你只要会偏微分跟算行列式,你也可以验证他给的反 07/20 20:50
: → WSJ8964 : 例是不是对的 07/20 20:50
: 推 hyperyoujo : 公司的扫地阿姨出来宣称证伪了大家会信,才能说是A 07/20 21:06
: → hyperyoujo : I超越人类吧,否则AI证任何东西都还是要一位高等数 07/20 21:06
: → hyperyoujo : 学研究者、还是顶尖的那种出来讲那都还差得很远 07/20 21:06
: → hyperyoujo : 代表就是找到了一个反例,结果反例也不是一般人能 07/20 21:08
: → hyperyoujo : 很简单的论证AI说的是对的、或者没有人类去担保没 07/20 21:08
: → hyperyoujo : 人愿意相信就代表AI还没超越人类 07/20 21:08
: 推 poeoe : 人类证不出来的东西 AI能证出来 就是AI超越人类啊 07/20 21:08
: → hyperyoujo : 我用计算机按出高斯积分结果,或是用电脑算出来, 07/20 21:09
: → hyperyoujo : 绝大多数人都会相信我按出来的结果是对的,即便没 07/20 21:09
: → hyperyoujo : 受过高等教育的人也会信,这才叫做电脑超越人类 07/20 21:09
: → hyperyoujo : @poeoe 看来你听不懂我的逻辑,那个不叫AI超越人类 07/20 21:10
: → hyperyoujo : 叫做AI辅助人类 07/20 21:10
: → hyperyoujo : 只有AI能普遍靠自己说服多数人它是对的才叫超越人 07/20 21:11
: → hyperyoujo : 类,目前的AI只要没有人类过一遍它的证明并用人类 07/20 21:11
: → hyperyoujo : 的信誉担保,没人会信,这不叫超越 07/20 21:11
其实我觉得不太需要争执超越不超越
现在的状况是,AI (大语言模型) 可以在看完一堆文字之後
可以意识到到:啊这里有个工具,可以拉过来解决这边这个问题,两边接得起来
并不是说人类做不到,但人类精力有限 (对所以 Erdos 会服用安非他命)
要吃饭、有杂事要做,数学又有一堆数不清的分枝,有时跨个领域就不懂了
单位距离猜想证伪後,他们有出一份数学家写的评论,一位的评论如下:
要解决这个问题,需要以下几个不太可能的条件同时成立
1. 努力想破解单位距离猜想
2. 想要证伪它,尽管之前的大佬们 Erdos 都觉得已经做到最好了
3. 可以把这个问题映射到其他的领域上
4. 熟知类体论等,最後用来构造反例的理论
工具都在,不是说人类做不到,啊就很少,少到 80 年来没人做到
所以数学界最有名的费尔兹奖,很常会颁给那些连结不同数学领域的学者
而且不要小看第2点,"大佬已经想过"或是"大佬们都这麽想"
对学术界的新手们来说是个很难违抗的人情事故,特别你刚进场要有一些成果
找一些比较有明显破口的问题会是简单多的路
: → spen2005 : hyperyoujo 了解一下形式化证明 07/20 21:13
: 推 poeoe : 一般没受过教育的大众相不相信都不重要 AI现在就是 07/20 21:13
: → poeoe : 能证明人类不能证明的事 那就是超越人类了 07/20 21:13
: 推 y598763 : https://bit.ly/4b1clyi 07/20 21:17
: → y598763 : 可以看看这个 AI超越人类的地方是他会综合使用所有 07/20 21:19
: → y598763 : 的工具 但人类不可能一次善用各种工具 但人类也不 07/20 21:19
: → y598763 : 是一无是处 如果要AI从0开始想相对论应该就没办法 07/20 21:19
: → y598763 : 这种全新的架构问题 07/20 21:19
我举的前两个例子,连结都有当初下的 prompt,驱使 AI 去想这个问题
所以 AI 不是万能,它需要人类先研究题目,他再进场来解题
我同意的是 AI 能善用的工具组比人类多太多了,完全没有脑力负担
至於我们能不能帮 AI 加上研究的动机?
这可能是目前人工智慧学者的热门题目
: → birdjack : 但现在为了话题性就要省略成AI全自动超越人类 07/20 21:19
: 嘘 hyperyoujo : @spen2005 形式化证明跟AI能独立证明是两件不同事 07/20 21:22
: → hyperyoujo : 情,不可混淆 07/20 21:22
: → hyperyoujo : 数学界看待这些AI tools我建议外行的去好歹去看一 07/20 21:25
: → hyperyoujo : 下Terence Tao的演讲,这是股板我知道大家还是倾向 07/20 21:25
: → hyperyoujo : 看乐观面,但正确的理解才能把握基本面跟预期 07/20 21:25
: → hyperyoujo : 数学界有一种说法是本来很重要的证明AI能证後,这 07/20 21:28
: → hyperyoujo : 些证明可能变得没那麽重要,这让数学家转而能花时 07/20 21:28
: → hyperyoujo : 间去做更有意义的事,这就好像计算机出来前的各种 07/20 21:28
: → hyperyoujo : 快速计算数字的公式现在意义也变小了一样 07/20 21:28
: → hyperyoujo : 人类就厉害在这种转换思维,我们会主动去找有意义 07/20 21:28
: → hyperyoujo : 的问题 07/20 21:28
说真的数学那麽广,多的是还没解决的问题跟猜想,有很多甚至连怎麽开始都不知道
你把它丢进 AI 里只会得到一堆胡言乱语浪费你的时间(还有你的 token 跟钱钱)
而且,你还要有对应的数学基础才能知道他在话唬烂
可以说 AI 并没有来到什麽数学之神的位置,什麽题目来都可以解
也没有厉害到老妪能解,数学就是数学,你看上面那些证出来的问题
哪个证明真的大家都能看懂…?
就跟 code 一样,AI 吐一堆程式码你没真的写过程式,怎麽可能人人都懂
你要是不信,你可以把上面的 Erdos Problem 随便选个还没证明的
现在有 AI Pro 帐号的也不少,丢丢看看看他能不能证,他的证明你能不能懂
至於到底是乐观还是辈观,最近科学人刚出了这一篇黎曼猜想的文章
https://www.scitw.cc/posts/The-Scariest-Problem-in-Math-tw
他直接写<数学界最恐怖的问题>,谁管你是人类证的还是 AI 证的
数学家一心只想知道问题的解答,只想看证明好吗XDD
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 175.182.207.190 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Stock/M.1784560951.A.709.html
1F:推 ijtm : 嗯嗯 跟我想的一样 07/20 23:25
2F:推 Parahydrogen: 用心文 推 07/20 23:25
3F:推 dogalan : 谢谢分享 07/20 23:31
4F:推 addy7533967 : 推推 07/20 23:34
5F:推 windfeather : 感谢分享 07/20 23:38
6F:嘘 mutsutakato : 费马定理要n>2喔 07/20 23:40
对欸,已修正XDD
7F:推 stonerr : 感谢分享! 07/20 23:41
8F:推 super1315566: 用心推 07/20 23:44
9F:推 Fezico : 这时代的图灵机superplus豪华超级加强版? 07/20 23:47
10F:推 abc0922001 : 这几次AI都不是发明新方法,都拿已有的工具 07/20 23:47
这个用词有一个很有趣的辩论
请问数学究竟是发明还是发现?
11F:推 jl40 : 推 我听得很有趣 07/21 00:06
12F:推 dakkon : AI获得动机,这听起来有点像艾西莫夫的科幻小说 07/21 00:15
13F:推 sdbb : 谢谢 07/21 00:20
14F:推 sarsman : 证伪这种容易验证但需要快速试误迭代的东西很适合AI 07/21 00:23
15F:→ sarsman : 其实找软体漏洞也是同理 07/21 00:23
16F:推 Ensidia : 具体化说 要证明这个问题需要 ABCDE五个技能树点90% 07/21 00:23
17F:→ Ensidia : 人类的精力跟脑力几乎完全不可能达到 AI可以 07/21 00:24
18F:→ sarsman : 以前人类只能燃烧生命时间去赌,现在可以烧token了 07/21 00:24
19F:→ Ensidia : AI比人类强的点就在於他可以几乎全部技能树都90% 07/21 00:25
20F:→ Ensidia : 人类的科学研究因为已经累积太多东西 07/21 00:26
21F:→ Ensidia : 要点满一个技能树都需要穷极一生了 07/21 00:26
22F:→ Ensidia : 以後有AI配合的话自己不会的技能就可以用AI了 07/21 00:26
23F:→ sarsman : 看重要性跟验证容易度,都满足的话我是都丢给AI没错 07/21 00:32
24F:推 RedLover1009: 最後一段很推,谢谢分享 07/21 00:48
25F:推 Arodz : 推 07/21 00:50
26F:推 josephpu : 推分享 07/21 00:51
27F:推 NoMomoNoLife: 谢谢 07/21 00:54
28F:推 unjak : 推 07/21 01:29
29F:推 molsmopuim : 希望AI先轻松解出癌症神药 07/21 01:41
30F:推 bj45566 : 谢谢分享。事实是现在最强大的前几名 AI 在数学能力 07/21 01:51
31F:→ bj45566 : 上已经超越 99.9% 以上的人类了 07/21 01:51
32F:推 willyabs : 谢谢分享 07/21 01:52
34F:→ davide68 : 赶快附和,免得让人家知道我听不懂 07/21 02:01
35F:推 jyhfang : 07/21 03:26
36F:推 CaptPlanet : AI 是真的牛逼 可惜金融游戏不是牛逼就行 07/21 04:19
牛顿:我可以计算天体的运行,但算不出人性的疯狂
37F:推 afflic : 跟下围棋很像,人类常会陷於前人的泥淖,但AI不不会 07/21 04:29
38F:推 masala : 它不需休息不知疲惫与挫折,就是一直计算 07/21 05:40
39F:推 rxsmalllove : 阿咧咧 07/21 06:29
40F:嘘 checkmarx : 股票都不会算 07/21 06:43
41F:推 herculus6502: 推 07/21 06:48
42F:推 dosiris : 所以他不是把working paper证明结合起来而已吗 07/21 07:02
我觉得没那麽轻描淡写,能看出这些证明之间是在描述类似的问题
并且是可以互相结合的,这件事本身就是相当数学的工作
我上面举的两个例子
第一个是人类数学界长久以来的习惯被导向不对的方向
因此没人注意到这条思路,接不起来
第二个是两个领域距离太远了,能够精通两个领域的人类太少
一边是我不知道那边有这套工具可以用来解我的问题
另一边是我这里有一套很棒的工具但不知道可以解这个问题
而 LLM 看过两边 甚至是全数学界可用的工具之後,敏锐的注意到可以
把这两个部分结起来证明问题
43F:推 kerry0496x : 推 07/21 07:18
44F:推 peter2940 : 嗯嗯 我也是这麽想 07/21 07:26
45F:推 t19960804 : 跟我小学想的一样 只是大人都不相信我 07/21 07:37
46F:推 kwht : 推 07/21 08:47
47F:推 Falagar : AI能主动获得动机 想想就恐怖... 07/21 08:50
48F:推 Altair : 谢谢分享! 07/21 08:50
49F:推 umgym : 推分析,现代基础科学研究要突破真的要靠ai的跨领 07/21 08:52
50F:→ umgym : 域能力和无限精力(电力) 07/21 08:52
51F:推 joe2 : 「不确定是吃了什麽聪明药」 难怪台积电那天飞跃 07/21 09:23
52F:→ joe2 : 感谢你的资讯 对我有极大而不成比例的帮助 07/21 09:23
会这麽说是因为 2025 年底的时候,ChatGPT 就试过一次,宣称证明某问题
但後来证明被抓到漏洞(可能还因此被嘲笑了一番)
这次是卷土重来而且一出手就翻掉两个几十年的问题,可算是震惊数学界
53F:推 alyia : 好有趣感谢分享 07/21 09:40
54F:推 patear : 楼主的内容和Esidia的推文都很棒 07/21 10:02
55F:→ patear : sarsman的推文也好 07/21 10:03
56F:推 Torres1211 : 嗯嗯,我们想法差不多 07/21 10:36
57F:推 h73o1012 : 太好了 AI解决问题 人类摆烂爽爽过日 07/21 10:37
58F:推 johnlin35 : 推 07/21 10:57
59F:推 kaizea : 推 07/21 11:11
60F:推 DoraGian : 有一种数学发展到只靠人智很难往前推的感觉 07/21 12:23
我自己是觉得人类的训练变数还是太大了
LLM 可以不眠不休训练还能直接复制模型参数,人类完全不可能
数学家少,能跨各分枝的数学家更少
这次的几个问题假以时日,就如同费马最後定理一样,终究是有被破的一天
但 AI/LLM 成功把这样的过程,从年压到小时
61F:→ takanasiyaya: 这篇就完全不懂AI,以为还在穷举法咧 07/21 12:23
XD 这篇哪里有提到穷举
其实我觉得这是一个很有趣的问题:如何从语言中诞生数学思想?
我们知道 LLM 就是拿着一堆语料去跑模型,那麽他们怎麽从语言中
发现<啊原来数学定理/证明可以这样子结合起来的>
我想到还有另一个问题:如果数学思维可以从语言中训练出来
那麽,学习不同的语言的人,会不会因此擅长於不同领域的数学?
62F:推 UCCUplz : 推分享 07/21 12:30
※ 编辑: lc85301 (36.237.194.231 台湾), 07/21/2026 13:40:47
63F:推 NDSLite : 维度n>2被证伪 n=2还未知 2维是突破点 07/21 19:39