作者thinksilver (银白色的沉思)
看板Stock
标题[新闻] OpenAI新模型Astra曝!攻克10道数学难题
时间Sun Aug 2 18:24:33 2026
原文标题:
OpenAI新模型Astra曝!
攻克10道数学难题、多AI代理协作挑战AGI
原文连结:
https://reurl.cc/QNLxyq
发布时间:
2026-08-02 17:10
记者署名:
钜亨网编译 庄闵棻
原文内容:
OpenAI 正在开发代号「Astra」的全新模型家族,主打多个人工智慧(AI)代理长时间协
同运作、共同解决高难度问题的能力。这项技术若顺利问世,将是该公司迈向通用人工智
慧(AGI)的重要里程碑,同时也可能成为美国川普政府新版 AI 监管框架上路後,第一
批接受审查的产品。
根据《The Information》引述三名知情人士报导,OpenAI 执行长奥特曼(Sam Altman)
本周亲自前往华盛顿特区,向政策制定者与监管官员展示 Astra 的实际运作。
简报中特别强调
该模型能调度多个智能体长时间分工合作,处理从专案管理到
高阶数学证明等复杂任务。
与此同时,OpenAI 也发布一份报告,
公布其最先进 AI 系统成功攻克十道长年
悬而未解的数学难题,范围横跨高维几何、程式设计理论、群论、量子复杂性与极值组合
学等尖端领域。
这些问题各自悬置学界超过十年,而 OpenAI 仅耗费约两千美元的运算成本便完成全部求
解。
今年一月加入 OpenAI 的研究员 Lijie Chen 在社群平台上证实,这十道题目的证明正是
出自旗舰模型 Astra 之手。
根据知情人士说法,Astra 将自成一个独立的模型类别,与 OpenAI 现有的 Sol、Terra
、Luna 系列并列。
目前公司内部尚未拍板该模型上市时间,也还没决定其命名方式,究竟会挂牌为外界期待
已久的 GPT-6,或仅作为 GPT-5 系列的子版本(如 GPT-5.7)发布,仍是未知数。
值得留意的是,尽管相关模型已进入测试阶段,其公开发布脚步恐将受制於监管环境。知
情人士透露,Astra 很可能成为首批必须通过川普政府新版 AI 框架审查的产品。
依该框架规定,AI 业者须在模型正式对外发布前,先向联邦政府提交备案。川普政府为
此设下的最後期限,正落在本周末。
依据 OpenAI 公布的内容,
Astra 在数学与理论电脑科学领域一举拿下十项重
大成果,包括高维球体堆积密度上限、二进制与球面码界限提升、非纯索菲群存在性证明
、康涅斯刚性猜想的推翻、算术电路复杂性新下界、量子平行重复定理、最近向量问题的
多项式因子近似难度证明、埃尔哈特体积猜想、多色拉姆齐数的超指数下界,以及极值数
猜想等极值数猜想等。
其中不少成果直接回应了已故数学家 Paul Erd 留下的经典开放问题。
在具体研究流程上,OpenAI 说明由 Astra 模型负责产出数学论证,人类研究人员则借助
同一模型协助整理论文草稿,最後再将论证转换为 Lean 程式码进行形式化验证。
该公司特别强调,十项突破的数学论证全数由 AI 系统生成,人类研究者的角色仅限於协
助撰写手稿、进行形式验证,并对最终结果的正确性负责。
这并非 OpenAI 首度在数学领域交出成绩单。今年五月,该公司在测试一款尚未发布的模
型时,已让 AI 成功推翻了「单位距离问题」,随後学术界也陆续发表相关後续研究。
随着 AI 系统在科学研究中扮演的角色日益吃重,成果归属争议也随之浮上台面。对此
OpenAI 表示,理解并尊重「莱顿人工智慧与数学宣言」(Leiden Manifesto on AI
and mathematics)连署学者的疑虑,同时也强调,若将完全由 AI 生成的证明归功於人
类,不仅扭曲了 AI 系统的实际贡献,也模糊了人类智识工作本身的界线。
值得一提的是,OpenAI 近期同步推出面向学术界的 ChatGPT 专案,向十万名科学家与数
学家开放免费使用其最强模型,并持续以开放性数学难题作为模型开发过程中的测试指标
。
心得/评论:
新模型攻克了十项数学难题!
虽然那些难题有写出来而且都是中文
但是我一个都看不懂.......
有没有数学大神可以解释一下?
看样子AI只会越来越聪明了,
连人类无法突破的东西都可以交给他了!
那...算力需求肯定是不够用的吧?
各位数学超强的股神怎麽看?
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 180.177.56.226 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Stock/M.1785666277.A.6A9.html
1F:推 Altair : 乖乖当电池吧 (远目 08/02 18:41
2F:嘘 yang1026 : 就现有公式下去套用 08/02 18:44
3F:推 quanhwe : 反观gemini 3.5 pro还出不来 08/02 18:46
4F:推 tyke123 : 什麽时候可以证明数论1+1 08/02 18:46
5F:推 poeoe : 这不意外啊 AI迭代进步太快了 08/02 18:49
6F:推 cutbear123 : 人类快下课了 08/02 18:51
7F:推 qqq852963tw : 完啦人类等死 08/02 18:55
8F:推 tteeccddyy : To the moon 08/02 19:01
9F:推 treeson : 这算是oa两家的优势了,中国开源都在卷coding能力 08/02 19:05
10F:→ treeson : 复杂问题推理还没看到实例 08/02 19:05
11F:推 Grothendieck: 要失业啦 08/02 19:17
12F:推 vincealan : 之前有看到中国那边有数学教授说被AI开发公司出钱 08/02 19:24
13F:→ vincealan : 要求提供数学难题 08/02 19:25
14F:→ GetMoney : 太好啦,快点取代人类,通通抓去做饲料 08/02 19:34
15F:推 cercloud : 有没有一种可能是都堆这麽多算力了,算得出来不是 08/02 19:49
16F:→ cercloud : 理所当然吗 08/02 19:49
17F:推 xm3u4vmp6 : 以前是连堆算力都算不出来 08/02 19:52
18F:推 ksjr : 两千镁的蒜粒有很多吗? 08/02 19:54
19F:推 windalso : 人类证明的话可以拿菲尔兹奖吗? 08/02 19:56
20F:推 rebel : 社畜文职会说 解数学对一般人有用吗 AI就是泡沫啦 08/02 19:57
21F:→ joygo : 之前说好五年出agi 08/02 20:06
22F:→ ert0700 : 可以先把算力拿去硬解微分方程吗..... 08/02 20:21
23F:推 seemoon2000 : 我以为gemini已经只剩搜索和yt影片摘要的功能 08/02 20:25
24F:→ seemoon2000 : Ai算数学不管什麽提醒都是写python在後面算 不是推 08/02 20:27
25F:→ seemoon2000 : 理 推理的部分还是agentic多步骤推理 能解高阶数学 08/02 20:27
26F:→ seemoon2000 : 可能多步骤迭代到100次还能稳定才是他的难点 08/02 20:27
27F:推 jackchen1025: google真的很烂,搞不好ai搞一堆花里胡哨的整合功能 08/02 20:42
28F:推 garo546 : 用ai训练ai太猛啦 指数型成长 08/02 20:53
29F:推 abdiascat : 奇异点现在进行式 08/02 21:16
30F:推 bunjie : 不明觉厉 08/02 21:30
31F:→ bunjie : 不过代表中等聪明的人也可能透过AI协作来破解困难 08/02 21:31
32F:→ bunjie : 的问题 08/02 21:31
33F:→ bunjie : 也让顶尖人员的脑袋和时间放在视野更宽广的战略高 08/02 21:32
34F:→ bunjie : 度 08/02 21:32
35F:→ cicini : 还在AGI 核心算法没改就只是再骗算力 08/02 21:34
36F:推 watchmeisyou: 叫ai去算圆周率啊 08/02 21:46
37F:推 lc85301 : 算圆周率不用 AI,有确定演算法可以直接算… 08/02 22:25
38F:→ lc85301 : 你写个 C code 就能算一亿位了,要 AI 干嘛 08/02 22:25
39F:→ TaiwanUp : 我之前按烂 给评语把LEAN接上GPT 看来已相容了 08/02 22:28
40F:→ TaiwanUp : python matlab早就接上了 08/02 22:29
41F:推 icosahedron : 蒸汽机发明的时候一定也有一堆乡下人说人类要完蛋了 08/02 22:32
42F:推 ace4 : 比较期待AI在生物、医药、有重大突破。 08/02 22:39
43F:→ offstage : 汽车的出现,确实让马车夫们完蛋没错 08/02 22:39
44F:推 ted1985 : 母体世界爽的话。尼欧请不要叫醒我 08/02 23:22
45F:推 ayufly : 天网越来越接近了 08/02 23:29
46F:嘘 okderla : 可以先攻克癌症吗== 08/02 23:38
47F:推 lunatich : 数学家很抖阿,看看莱登宣言 08/02 23:44
48F:推 nfsong : 可以看看数学家 陶哲轩 上礼拜在ACM的公开讨论 08/02 23:54
49F:→ nfsong : 以後一定是AI辅助解题 08/02 23:55
50F:→ nfsong : 但是解完题 要标注AI辅助 08/02 23:55
51F:→ nfsong : 然後AI解题 人类看不懂 08/02 23:56
52F:→ nfsong : 所以现在累积一堆 验证不了的东西 因为人类看不懂 08/02 23:56
53F:→ nfsong : 所以未来解题 要特别帮人类注解 08/02 23:57
54F:→ nfsong : 逻辑推理要帮人类画重点 08/02 23:57
56F:→ nfsong : Terence Tao Mathematics in the Age of AI 08/03 00:01
57F:→ nfsong : ICM 2026 08/03 00:01
58F:推 mainsa : 马夫完蛋了 但多了计程车司机这种工作啊 08/03 00:04
59F:嘘 s1612316 : 无聊 这种证明你只要有够多人够多时间 跟算力堆起来 08/03 00:07
60F:→ s1612316 : 是一样 08/03 00:07
61F:→ s1612316 : 没办法生出 “新东西”就只是一直在人类知识里打转 08/03 00:08
62F:推 yuinghoooo : 左右脑互搏的时候 08/03 00:13
63F:推 a420360 : 酷 08/03 00:41
64F:→ saladim : ICM, not ACM 08/03 01:39
65F:→ yunf : 你怎麽确定他说的完全没错? 08/03 03:11
66F:→ jasonsu449 : 奇点要到了吗? ai发现新理论比人类快 08/03 05:09
67F:推 eason0216 : 又想炒一波,攻克的都是计算题一点思考都没有 08/03 06:37
68F:推 awenracious : AI可以先攻略医疗部分吗 让一些慢性病或癌症能像流 08/03 09:43
69F:→ awenracious : 感一样能更治 08/03 09:43
70F:推 d88647511 : 母体不会爽的 母体已经证明多数人当社畜才是最稳定 08/03 09:51
71F:→ d88647511 : 的生活方式 08/03 09:51
72F:推 sowhysowhat : 还有几集可以逃,人类完全没胜算 08/03 12:21
73F:推 FateOFP : 攻克代表证明了吗..?好奇问 08/03 13:06
74F:→ eemail : 人家给问题,它解开.结果你说怎没新东西? XD 08/03 16:40