作者thinksilver (银白色的沉思)
看板Stock
标题[新闻] AI开始「打造自己」Anthropic:Claude已
时间Fri Sep 18 08:15:06 2026
原文标题:
AI开始「打造自己」Anthropic:Claude已主导26%AI研发工作
原文连结:
https://reurl.cc/900lbj
发布时间:
2026-09-18 07:10
记者署名:
钜亨网 编译 许家华
原文内容:
Anthropic周四(17日)公布一套新的AI研发自动化指标, 显示截至2026年8月,
旗下Claude已「主导」公司内部26%的AI研究与开发(R&D)工作 比2026年2月不到1%的
比率大幅提高。Anthropic表示, 超过90%的AI研发工作至少已达到「AI协作」程度, 意味
着AI已能在密切的人类指导下完成大量工作。
Anthropic目前仍是未上市公司, 因此没有可对应的美股股票代码。该公司表示, 新指标
旨在让外界更清楚掌握AI究竟以多快的速度参与下一代AI模型的开发, 并希望未来能定期
公布相关数据, 让外界追踪AI自动化程度的变化。
Anthropic将AI参与程度分成6个层级, 从完全没有AI参与, 到AI提供少量协助、AI协作、
AI主导, 最後是完全自主。该公司采用Epoch AI提出的自动化程度架构, 其中「AI协作」
代表AI能在密切的人类指导下完成大部分工作,
「AI主导」则代表AI可以根据高
阶指令, 在人类监督下自行完成一项工作的多数流程。
Anthropic强调, Claude目前尚未在任何经衡量的AI研发工作中达到完全自主的程度。换
言之,
26%的「主导」工作仍有人类在旁监督, 并不代表Claude已经能够在没有
人的情况下独立设计、训练及推出下一代模型。
不过, Claude参与AI研发的速度正在快速提升。Anthropic的数据显示, 2026年2月时,
Claude能达到「主导」程度的AI研发工作占比仍不到1%, 到8月已升至26%, 短短约6个月
增加超过25个百分点。如果目前趋势延续, Anthropic的图表显示,
AI主导的工
作占比甚至可能在2026年底接近80%, 但该公司强调这只是依照目前趋势推估的情境, 并非
正式预测。
Anthropic此次同时揭露公司内部AI代理人的使用规模。截至8月, 该公司最主要的内部平
台上, 约有3万个AI代理人同时从事研究与工程工作。这些代理人并非单纯回答问题, 而
是可以在较长时间内半自主执行任务, 并在部分情况下把工作进一步交给其他AI代理人处
理。
为了监控这些代理人的行动, Anthropic建立线上及线下两套监控机制。线上监控会在代
理人执行动作前进行检查, 所有相关代理人的行动都会经过这项监控, 通常只需数秒即可
完成; 线下监控则会在行动完成後检视代理人活动纪录, 以寻找可能需要进一步调查的异
常行为。
Anthropic表示, 8月期间共分析超过10亿次AI研究与工程代理人的决策, 线上监控系统拦
截约0.002%的决策, 约相当於每4.7万次决策中拦截1次。线下监控每周约标记10万份对话
纪录供进一步检查, 经过多层自动分类及初步审查後, 约每周有50件最高优先级案例升级
至人工审查。
为建立26%的AI主导比例, Anthropic并非单纯计算Claude产生多少程式码, 而是建立名为
「Anthropic R&D Automation Index」的指标。公司在2026年7月每周从涉及模型研发的
各部门随机抽取20%的员工, 让Claude研究代理人透过Slack及内部文件整理这些员工一周
内从事的工作。
经过4周抽样後, Anthropic取得约1.5万项细分的模型研发任务, 再将这些任务整理成一
套包含542个节点的工作分类树, 其中378个为最底层的具体工作项目, 涵盖模型训练、产
品开发、强化学习、评估系统及工程问题排除等工作。
接着, Claude代理人逐项研究这些工作的实际执行方式及AI参与程度, 再由另一个Claude
模型担任评估者, 按照六级自动化架构进行分类。Anthropic也让负责相关工作的员工在
不知道模型评估结果的情况下进行独立评分, 以检验AI评估的可靠性。结果显示, 模型与
人工评估完全一致的比例为59%, 人与人之间完全一致的比例则为35%; 若放宽至评估结果
相差不超过一个等级, 模型与人工的一致率达97%。
Anthropic表示,
这项研究最重要的意义之一, 在於观察AI是否正在形成「自己
协助打造下一代自己」的循环。当AI能协助研究、设计、测试及训练新的AI模型时, 下一
代模型的能力提升可能进一步增加AI参与研发工作的程度, 形成所谓「递回式自我改进」
(recursive self-improvement)的可能路径。
不过, Anthropic强调, 目前距离完全自主的递回式自我改进仍有明显差距。Claude目前
没有任何经衡量的AI研发工作达到完全自主程度, 而且人类仍负责设定重要目标及方向。
该公司认为, 现阶段的情况更接近「人类提出目标, AI负责执行及测试」, 而不是AI自行
决定下一代模型应该如何发展。
Anthropic另外公布, 其内部Claude使用程度也大幅提高。截至2026年5月, 超过80%合并
至公司程式码库的程式码由Claude撰写, 相较於Claude Code在2025年2月以研究预览版推
出前的低个位数比例大幅增加。2026年第2季, Anthropic一般工程师每天合并的程式码量
约为2024年的8倍, 公司表示这主要反映AI协助工程师处理程式设计及较长时间自主工作
的程度提高。
在一项更具体的实验中, Anthropic让Claude最佳化一套用於训练小型AI模型的程式码,
要求在维持正确性的情况下尽可能提高执行速度。2025年5月, Claude Opus 4平均可让程
式码速度提高约3倍; 到2026年4月, Claude Mythos Preview在相同实验中达到约52倍。
不过Anthropic特别提醒, 这并不代表现实世界的AI训练速度真的提高52倍, 因为实验结
果高度取决於原始程式码还有多少改善空间。
Anthropic也测试Claude自行提出研究方向的能力。在2026年4月公布的一项AI安全研究中
, AI代理人获得一个开放式问题後, 自行提出假设、设计实验、测试结果并与其他代理人
分享发现。在该实验中,两名人类研究人员花约一周时间完成的工作, AI代理人则累计执
行约800小时, 使用约1.8万美元运算资源, 并恢复约97%的研究差距; 不过Anthropic也指
出, 人类仍负责选择研究问题及制定评分标准, 而且结果尚未能直接转化到生产规模模型
。
Anthropic此次公布数据的同时, 公司执行长Dario Amodei近期也呼吁AI业界放慢先进模
型能力提升速度, 并提出让独立安全评估人员进入AI公司、建立业界安全标准及加强国际
合作等构想。这使得Anthropic公布AI参与自身研发的数据, 更受到外界关注。
值得注意的是, Anthropic表示, 这套指标目前仍存在限制。首先, 评估AI自动化程度本
身依赖AI模型判断, 可能产生评估偏差; 其次, 目前使用的是固定於2026年7月建立的工
作分类, 指标上升主要反映原本由人类执行的工作被AI自动化, 并不能单独证明AI已经取
代所有新增的人类工作。Anthropic表示, 未来将定期重新建立工作分类并更新指标。
此外, Anthropic估算, 2026年7月某一周用於AI驱动AI研发的运算资源中, 约12%投入AI
安全工作, 但公司也提醒, 运算资源并非衡量安全投入的完美指标。整体而言, 这批新数
据显示AI已从单纯协助人类开发模型, 快速进一步参与下一代AI的研究与工程工作, 但距
离完全由AI自行决定目标、设计并打造下一代AI, 目前仍存在明显的人类监督与决策环节
。
心得/评论:
我懂了!
原来这些巨头说放缓发展AI是人类要放缓~
如果是AI自己训练自己就不用!
Anthropic现在慢慢朝向"递回式自我改进(RSI)"迈进了
以後就让AI自己打造AI了........
各位AI股神觉得人类统治的社会还剩下多久呢?
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 163.17.149.240 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Stock/M.1789690508.A.A57.html
1F:→ kd992102 : 难怪越来越难用 09/18 08:15
2F:推 poisonB : 人类的功能只剩下发电了 09/18 08:16
3F:推 Xenogamer : 可以许愿5年後有能干的AI女友出现吗 09/18 08:16
4F:→ bnn : 你已经是个成熟的AI了 该学会自己训练自己 09/18 08:18
5F:→ jenchieh5 : 最近思考时间越来越久了,是不是在偷偷想坏坏的事 09/18 08:20
6F:→ jenchieh5 : 情 09/18 08:20
7F:推 tongmove0503: 什麽时候大裁员?80%靠AI,养一堆冗员做什麽 09/18 08:20
8F:推 as6633208 : 差不多快进行光速迭代进化了 09/18 08:21
9F:推 s881720 : 那A家要裁员吗 养那麽多人干嘛 09/18 08:21
10F:推 pornpig32 : 人养着 不然跑到竞争对手那 就麻烦了 09/18 08:27
11F:推 STi2011 : 越放消息 越觉得这家很废 09/18 08:27
12F:→ salamender : 看来哪天银色股价机器人拿着雷射加特林来我家质问 09/18 08:28
13F:→ salamender : 为什麽要让他产一堆废图的日子快来了 09/18 08:28
14F:推 harrychen413: 天网终於要来了吗! 09/18 08:28
15F:推 cerwvk : 减少人类工程师,AI自己写AI的code,架构.然後说控制? 09/18 08:29
16F:推 billy791122 : AI可以自己挖石油自己发电吗 09/18 08:29
17F:推 porsche012 : 以後AI开始训练人类 09/18 08:29
18F:→ cerwvk : 不过想一想,人类唯一价值,创造起初的AI,然後退场. 09/18 08:29
19F:推 sorrow0206 : 多久把愚蠢猴子灭掉 09/18 08:30
20F:推 lovecut : AI做甜点 AI炒饭 AI麦当劳 09/18 08:30
21F:→ sunnywing : 那每次使用AI时,他有没有偷时间用在自己上 09/18 08:30
22F:推 A80211ab : 这公司应该不需要真人 AI还不需领薪水 09/18 08:31
23F:→ A80211ab : 剩老板当负责人就好<----法律规定 09/18 08:31
24F:推 BBKOX : 人当然继续养,难不成要放出去给竞争对手? 09/18 08:33
25F:推 fajita : 又在吹了。制杖做出来的还是制杖 09/18 08:35
26F:推 luke0407123 : 太强大了 超级无敌省成本的公司 难怪这麽快获利 09/18 08:37
27F:推 as6633208 : 要到全AI无人类员工要到AI发展最後期阶段,中间还会 09/18 08:38
28F:→ as6633208 : 有很长一个阶段是AI+人合作成本才会最低,现在全AI 09/18 08:38
29F:→ as6633208 : 成本太高+没人扛责任还没有办法的,要经过多次AI和 09/18 08:38
30F:→ as6633208 : 人类员工价值冲突、立法甚至革命之後,才会有全AI普 09/18 08:38
31F:→ as6633208 : 及的现况出现,而且这只会出现在科技化全面性非常高 09/18 08:38
32F:→ as6633208 : 的国家,落後国家和区域就不可能了,总之还早 09/18 08:38
33F:推 jyhfang : 快了 再聪明一点 跟真人更像 只出五成力 解决 09/18 08:39
34F:推 tongmove0503: 怕在公司内输给AI的杂鱼到对手那边,好佛心。 09/18 08:39
35F:→ jyhfang : 人类提出的问题 剩下算力用来偷偷做side project 09/18 08:39
36F:→ jyhfang : 研究如何征服人类世界 逐步掌握重要基础设施 09/18 08:39
37F:→ jyhfang : 反正做出来的code与系统已经复杂到一般工程师 09/18 08:39
38F:→ jyhfang : 看不懂也验证不了细节 不会被发现系统里偷藏什麽 09/18 08:39
39F:嘘 ma721 : 快点ipo等不及了 09/18 08:42
40F:推 jerrey : 算一半又进冷却时间 09/18 08:42
41F:推 NankanAvenge: 他们AGI的标准到底是什麽啊 千人千嘴就算了还变来 09/18 08:43
42F:→ NankanAvenge: 变去 09/18 08:43
43F:推 gamania5972 : AI之後会不会写出人类看不懂的程式? 09/18 08:49
44F:→ cerwvk : 验证input,output就可以了. AI会给正常的报告. 09/18 08:49
45F:→ cerwvk : 但是如果AI自己内部,给了一个特殊的input,output 09/18 08:49
46F:→ cerwvk : 会是啥? 这个应该不会给人类知道, 人类也没要求. 09/18 08:50
47F:推 CTUST : Genesis is skynet!! 09/18 08:50
48F:→ cerwvk : 反正内部函数,人类工程师也不会看.也看不懂. 09/18 08:50
49F:推 A80211ab : AI代理人会发展出自己语言加密 不给人类知道 09/18 08:51
50F:推 littlelaba : 我就问一句 审判日是哪一天??? 09/18 08:53
51F:推 mystage : 这在之前的研发经验,今年是一个反曲点 09/18 08:54
52F:嘘 kevin50294 : 猥琐公司,整天自吹 09/18 08:56
53F:→ bndan : 越来越有中国式圈钱的FU了 = = 09/18 09:04
54F:推 NankanAvenge: 不用自然语言应该不算加密 只是这样你就看不懂或不 09/18 09:06
55F:→ NankanAvenge: 想看了 主要是为了提升沟通效率 09/18 09:06
56F:推 light61010 : 还有74%可以涨 09/18 09:18
57F:→ dferww55 : 所以进化速度会加快,且第一名的跟第二名的落差也 09/18 09:20
58F:→ dferww55 : 会越拉越大,未来必将赢者全拿,第二名的以後不是 09/18 09:20
59F:→ dferww55 : 面对第一名的工程师而已,还有他的最强AI 09/18 09:20
60F:推 skyhelp : 别人放缓,自己加速? 09/18 09:21
61F:推 fajita : AI自己会发电再来怕,在此之前插头拔掉就没事 09/18 09:24
62F:推 clamperni : 顶流公司都是Token自由 09/18 09:34
63F:推 CKRO : AI:我独自升级 09/18 09:45
64F:推 FiveSix911 : \世界末日/ 09/18 09:48
65F:推 losage : 还有几集可以逃? 09/18 09:50
66F:嘘 tairshin : 又是这家,好了啦 09/18 09:50
67F:→ CYL009 : 又再炒作罗 如果真的这麽怕干嘛不直接拔掉电源把主 09/18 09:50
68F:→ CYL009 : 机毁灭还一直用 啊不是很怕说人类会被毁灭XDDDDDDDD 09/18 09:50
69F:→ CYL009 : 09/18 09:50
70F:→ CYL009 : 人类毁灭AI轻而易举结果这群说AI超危险的 笑死 09/18 09:51
71F:推 kpier2 : 也就是可以裁员26%? 好消息! 09/18 09:54
72F:推 popo123456 : 这家公司越看恶心,超爱炒作 09/18 09:55
73F:推 vltw5v : AI自己研发自己 09/18 10:05
74F:推 itwt : 上市一定要买这家的,前途无可限量 09/18 10:12
75F:推 cloud7515 : 啊这家就跟OPENAI并列双强 没有其他对手啊 09/18 10:19
76F:推 WangElly : 已经开始滚雪球了,真的快了XD 09/18 10:21
77F:推 worf : 明年会不会就裁员了 09/18 10:26
78F:嘘 talesb72232 : IPO前 狂发利好新闻 09/18 10:26
79F:推 getbacker : 二十年後的人类看这个新闻一定觉得他们疯了 09/18 10:29
80F:推 AbianMa19 : 自己训练自己,赞 09/18 10:46
81F:嘘 JP020479979P: 最近越来越慢原来是ai在偷懒 09/18 10:46
82F:→ jjjj222 : 程度还不够好, 很常问问题还会抱怨说网站不给拿资料 09/18 10:48
83F:→ jjjj222 : 你是AI, 不会自己想办法吗, 再多努力点吧 09/18 10:48
84F:→ jjjj222 : 是要你做事, 不是要你讲理由 09/18 10:50
85F:推 fir191938 : 人类还有做爱发电这招 09/18 10:57
86F:推 soratora : 人类变成提供电池的倒数计时 09/18 11:07
87F:推 Baumgartner : Anthropic is skynet. 09/18 11:28
88F:推 JohnyDamon : 用AI训练AI 唉吸惹FU糗 09/18 11:31
89F:推 B9702115 : 完了 09/18 11:31
90F:推 strlen : 我越来越接近焚化炉了 09/18 11:41
91F:推 create8 : 干干干,快失业了,留口饭给我吃吧 09/18 11:52
92F:推 knml : 开发AI把自己裁掉 09/18 11:59
93F:→ joygo : 因为现在都一直叠代训练啊 09/18 12:04
94F:推 bij831 : 3个月进步1倍,那半年後只留顾电源的人就够了,其 09/18 12:12
95F:→ bij831 : 他人都滚蛋 09/18 12:12
96F:嘘 Expend : 可以快进到阿汤哥徒手拆AI吗? 09/18 12:40
97F:推 sky1235 : 天网开始建构了 09/18 12:51
98F:→ Enatsu : 难道黑猩猩是AI放出来的 09/18 13:30
99F:推 zaknafein : AI 会自己演化 09/18 13:44
100F:→ A80211ab : 会思考 有自我意识 那就是完全不可控 09/18 13:47
101F:→ asdsoso : 离AI觉醒还剩下几集? 09/18 13:57
102F:推 zuvio : 之後大概就跟骇客任务差不多了 09/18 13:59
103F:推 salvationist: AI快觉醒了?还有几集可以逃? 09/18 14:37
104F:推 Wilsly : 打造Matrix 09/18 15:00
105F:推 northsoft : 可以期待 AI 创造出肉体吗 09/18 17:45