作者thinksilver (銀白色的沉思)
看板Stock
標題[新聞] AI開始「打造自己」Anthropic:Claude已
時間Fri Sep 18 08:15:06 2026
原文標題:
AI開始「打造自己」Anthropic:Claude已主導26%AI研發工作
原文連結:
https://reurl.cc/900lbj
發布時間:
2026-09-18 07:10
記者署名:
鉅亨網 編譯 許家華
原文內容:
Anthropic周四(17日)公布一套新的AI研發自動化指標, 顯示截至2026年8月,
旗下Claude已「主導」公司內部26%的AI研究與開發(R&D)工作 比2026年2月不到1%的
比率大幅提高。Anthropic表示, 超過90%的AI研發工作至少已達到「AI協作」程度, 意味
著AI已能在密切的人類指導下完成大量工作。
Anthropic目前仍是未上市公司, 因此沒有可對應的美股股票代碼。該公司表示, 新指標
旨在讓外界更清楚掌握AI究竟以多快的速度參與下一代AI模型的開發, 並希望未來能定期
公布相關數據, 讓外界追蹤AI自動化程度的變化。
Anthropic將AI參與程度分成6個層級, 從完全沒有AI參與, 到AI提供少量協助、AI協作、
AI主導, 最後是完全自主。該公司採用Epoch AI提出的自動化程度架構, 其中「AI協作」
代表AI能在密切的人類指導下完成大部分工作,
「AI主導」則代表AI可以根據高
階指令, 在人類監督下自行完成一項工作的多數流程。
Anthropic強調, Claude目前尚未在任何經衡量的AI研發工作中達到完全自主的程度。換
言之,
26%的「主導」工作仍有人類在旁監督, 並不代表Claude已經能夠在沒有
人的情況下獨立設計、訓練及推出下一代模型。
不過, Claude參與AI研發的速度正在快速提升。Anthropic的數據顯示, 2026年2月時,
Claude能達到「主導」程度的AI研發工作占比仍不到1%, 到8月已升至26%, 短短約6個月
增加超過25個百分點。如果目前趨勢延續, Anthropic的圖表顯示,
AI主導的工
作占比甚至可能在2026年底接近80%, 但該公司強調這只是依照目前趨勢推估的情境, 並非
正式預測。
Anthropic此次同時揭露公司內部AI代理人的使用規模。截至8月, 該公司最主要的內部平
台上, 約有3萬個AI代理人同時從事研究與工程工作。這些代理人並非單純回答問題, 而
是可以在較長時間內半自主執行任務, 並在部分情況下把工作進一步交給其他AI代理人處
理。
為了監控這些代理人的行動, Anthropic建立線上及線下兩套監控機制。線上監控會在代
理人執行動作前進行檢查, 所有相關代理人的行動都會經過這項監控, 通常只需數秒即可
完成; 線下監控則會在行動完成後檢視代理人活動紀錄, 以尋找可能需要進一步調查的異
常行為。
Anthropic表示, 8月期間共分析超過10億次AI研究與工程代理人的決策, 線上監控系統攔
截約0.002%的決策, 約相當於每4.7萬次決策中攔截1次。線下監控每周約標記10萬份對話
紀錄供進一步檢查, 經過多層自動分類及初步審查後, 約每周有50件最高優先級案例升級
至人工審查。
為建立26%的AI主導比例, Anthropic並非單純計算Claude產生多少程式碼, 而是建立名為
「Anthropic R&D Automation Index」的指標。公司在2026年7月每周從涉及模型研發的
各部門隨機抽取20%的員工, 讓Claude研究代理人透過Slack及內部文件整理這些員工一周
內從事的工作。
經過4周抽樣後, Anthropic取得約1.5萬項細分的模型研發任務, 再將這些任務整理成一
套包含542個節點的工作分類樹, 其中378個為最底層的具體工作項目, 涵蓋模型訓練、產
品開發、強化學習、評估系統及工程問題排除等工作。
接著, Claude代理人逐項研究這些工作的實際執行方式及AI參與程度, 再由另一個Claude
模型擔任評估者, 按照六級自動化架構進行分類。Anthropic也讓負責相關工作的員工在
不知道模型評估結果的情況下進行獨立評分, 以檢驗AI評估的可靠性。結果顯示, 模型與
人工評估完全一致的比例為59%, 人與人之間完全一致的比例則為35%; 若放寬至評估結果
相差不超過一個等級, 模型與人工的一致率達97%。
Anthropic表示,
這項研究最重要的意義之一, 在於觀察AI是否正在形成「自己
協助打造下一代自己」的循環。當AI能協助研究、設計、測試及訓練新的AI模型時, 下一
代模型的能力提升可能進一步增加AI參與研發工作的程度, 形成所謂「遞迴式自我改進」
(recursive self-improvement)的可能路徑。
不過, Anthropic強調, 目前距離完全自主的遞迴式自我改進仍有明顯差距。Claude目前
沒有任何經衡量的AI研發工作達到完全自主程度, 而且人類仍負責設定重要目標及方向。
該公司認為, 現階段的情況更接近「人類提出目標, AI負責執行及測試」, 而不是AI自行
決定下一代模型應該如何發展。
Anthropic另外公布, 其內部Claude使用程度也大幅提高。截至2026年5月, 超過80%合併
至公司程式碼庫的程式碼由Claude撰寫, 相較於Claude Code在2025年2月以研究預覽版推
出前的低個位數比例大幅增加。2026年第2季, Anthropic一般工程師每天合併的程式碼量
約為2024年的8倍, 公司表示這主要反映AI協助工程師處理程式設計及較長時間自主工作
的程度提高。
在一項更具體的實驗中, Anthropic讓Claude最佳化一套用於訓練小型AI模型的程式碼,
要求在維持正確性的情況下盡可能提高執行速度。2025年5月, Claude Opus 4平均可讓程
式碼速度提高約3倍; 到2026年4月, Claude Mythos Preview在相同實驗中達到約52倍。
不過Anthropic特別提醒, 這並不代表現實世界的AI訓練速度真的提高52倍, 因為實驗結
果高度取決於原始程式碼還有多少改善空間。
Anthropic也測試Claude自行提出研究方向的能力。在2026年4月公布的一項AI安全研究中
, AI代理人獲得一個開放式問題後, 自行提出假設、設計實驗、測試結果並與其他代理人
分享發現。在該實驗中,兩名人類研究人員花約一周時間完成的工作, AI代理人則累計執
行約800小時, 使用約1.8萬美元運算資源, 並恢復約97%的研究差距; 不過Anthropic也指
出, 人類仍負責選擇研究問題及制定評分標準, 而且結果尚未能直接轉化到生產規模模型
。
Anthropic此次公布數據的同時, 公司執行長Dario Amodei近期也呼籲AI業界放慢先進模
型能力提升速度, 並提出讓獨立安全評估人員進入AI公司、建立業界安全標準及加強國際
合作等構想。這使得Anthropic公布AI參與自身研發的數據, 更受到外界關注。
值得注意的是, Anthropic表示, 這套指標目前仍存在限制。首先, 評估AI自動化程度本
身依賴AI模型判斷, 可能產生評估偏差; 其次, 目前使用的是固定於2026年7月建立的工
作分類, 指標上升主要反映原本由人類執行的工作被AI自動化, 並不能單獨證明AI已經取
代所有新增的人類工作。Anthropic表示, 未來將定期重新建立工作分類並更新指標。
此外, Anthropic估算, 2026年7月某一周用於AI驅動AI研發的運算資源中, 約12%投入AI
安全工作, 但公司也提醒, 運算資源並非衡量安全投入的完美指標。整體而言, 這批新數
據顯示AI已從單純協助人類開發模型, 快速進一步參與下一代AI的研究與工程工作, 但距
離完全由AI自行決定目標、設計並打造下一代AI, 目前仍存在明顯的人類監督與決策環節
。
心得/評論:
我懂了!
原來這些巨頭說放緩發展AI是人類要放緩~
如果是AI自己訓練自己就不用!
Anthropic現在慢慢朝向"遞迴式自我改進(RSI)"邁進了
以後就讓AI自己打造AI了........
各位AI股神覺得人類統治的社會還剩下多久呢?
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 163.17.149.240 (臺灣)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/Stock/M.1789690508.A.A57.html
1F:→ kd992102 : 難怪越來越難用 09/18 08:15
2F:推 poisonB : 人類的功能只剩下發電了 09/18 08:16
3F:推 Xenogamer : 可以許願5年後有能幹的AI女友出現嗎 09/18 08:16
4F:→ bnn : 你已經是個成熟的AI了 該學會自己訓練自己 09/18 08:18
5F:→ jenchieh5 : 最近思考時間越來越久了,是不是在偷偷想壞壞的事 09/18 08:20
6F:→ jenchieh5 : 情 09/18 08:20
7F:推 tongmove0503: 什麼時候大裁員?80%靠AI,養一堆冗員做什麼 09/18 08:20
8F:推 as6633208 : 差不多快進行光速迭代進化了 09/18 08:21
9F:推 s881720 : 那A家要裁員嗎 養那麼多人幹嘛 09/18 08:21
10F:推 pornpig32 : 人養著 不然跑到競爭對手那 就麻煩了 09/18 08:27
11F:推 STi2011 : 越放消息 越覺得這家很廢 09/18 08:27
12F:→ salamender : 看來哪天銀色股價機器人拿著雷射加特林來我家質問 09/18 08:28
13F:→ salamender : 為什麼要讓他產一堆廢圖的日子快來了 09/18 08:28
14F:推 harrychen413: 天網終於要來了嗎! 09/18 08:28
15F:推 cerwvk : 減少人類工程師,AI自己寫AI的code,架構.然後說控制? 09/18 08:29
16F:推 billy791122 : AI可以自己挖石油自己發電嗎 09/18 08:29
17F:推 porsche012 : 以後AI開始訓練人類 09/18 08:29
18F:→ cerwvk : 不過想一想,人類唯一價值,創造起初的AI,然後退場. 09/18 08:29
19F:推 sorrow0206 : 多久把愚蠢猴子滅掉 09/18 08:30
20F:推 lovecut : AI做甜點 AI炒飯 AI麥當勞 09/18 08:30
21F:→ sunnywing : 那每次使用AI時,他有沒有偷時間用在自己上 09/18 08:30
22F:推 A80211ab : 這公司應該不需要真人 AI還不需領薪水 09/18 08:31
23F:→ A80211ab : 剩老闆當負責人就好<----法律規定 09/18 08:31
24F:推 BBKOX : 人當然繼續養,難不成要放出去給競爭對手? 09/18 08:33
25F:推 fajita : 又在吹了。製杖做出來的還是製杖 09/18 08:35
26F:推 luke0407123 : 太強大了 超級無敵省成本的公司 難怪這麼快獲利 09/18 08:37
27F:推 as6633208 : 要到全AI無人類員工要到AI發展最後期階段,中間還會 09/18 08:38
28F:→ as6633208 : 有很長一個階段是AI+人合作成本才會最低,現在全AI 09/18 08:38
29F:→ as6633208 : 成本太高+沒人扛責任還沒有辦法的,要經過多次AI和 09/18 08:38
30F:→ as6633208 : 人類員工價值衝突、立法甚至革命之後,才會有全AI普 09/18 08:38
31F:→ as6633208 : 及的現況出現,而且這只會出現在科技化全面性非常高 09/18 08:38
32F:→ as6633208 : 的國家,落後國家和區域就不可能了,總之還早 09/18 08:38
33F:推 jyhfang : 快了 再聰明一點 跟真人更像 只出五成力 解決 09/18 08:39
34F:推 tongmove0503: 怕在公司內輸給AI的雜魚到對手那邊,好佛心。 09/18 08:39
35F:→ jyhfang : 人類提出的問題 剩下算力用來偷偷做side project 09/18 08:39
36F:→ jyhfang : 研究如何征服人類世界 逐步掌握重要基礎設施 09/18 08:39
37F:→ jyhfang : 反正做出來的code與系統已經複雜到一般工程師 09/18 08:39
38F:→ jyhfang : 看不懂也驗證不了細節 不會被發現系統裡偷藏什麼 09/18 08:39
39F:噓 ma721 : 快點ipo等不及了 09/18 08:42
40F:推 jerrey : 算一半又進冷卻時間 09/18 08:42
41F:推 NankanAvenge: 他們AGI的標準到底是什麼啊 千人千嘴就算了還變來 09/18 08:43
42F:→ NankanAvenge: 變去 09/18 08:43
43F:推 gamania5972 : AI之後會不會寫出人類看不懂的程式? 09/18 08:49
44F:→ cerwvk : 驗證input,output就可以了. AI會給正常的報告. 09/18 08:49
45F:→ cerwvk : 但是如果AI自己內部,給了一個特殊的input,output 09/18 08:49
46F:→ cerwvk : 會是啥? 這個應該不會給人類知道, 人類也沒要求. 09/18 08:50
47F:推 CTUST : Genesis is skynet!! 09/18 08:50
48F:→ cerwvk : 反正內部函數,人類工程師也不會看.也看不懂. 09/18 08:50
49F:推 A80211ab : AI代理人會發展出自己語言加密 不給人類知道 09/18 08:51
50F:推 littlelaba : 我就問一句 審判日是哪一天??? 09/18 08:53
51F:推 mystage : 這在之前的研發經驗,今年是一個反曲點 09/18 08:54
52F:噓 kevin50294 : 猥瑣公司,整天自吹 09/18 08:56
53F:→ bndan : 越來越有中國式圈錢的FU了 = = 09/18 09:04
54F:推 NankanAvenge: 不用自然語言應該不算加密 只是這樣你就看不懂或不 09/18 09:06
55F:→ NankanAvenge: 想看了 主要是為了提升溝通效率 09/18 09:06
56F:推 light61010 : 還有74%可以漲 09/18 09:18
57F:→ dferww55 : 所以進化速度會加快,且第一名的跟第二名的落差也 09/18 09:20
58F:→ dferww55 : 會越拉越大,未來必將贏者全拿,第二名的以後不是 09/18 09:20
59F:→ dferww55 : 面對第一名的工程師而已,還有他的最強AI 09/18 09:20
60F:推 skyhelp : 別人放緩,自己加速? 09/18 09:21
61F:推 fajita : AI自己會發電再來怕,在此之前插頭拔掉就沒事 09/18 09:24
62F:推 clamperni : 頂流公司都是Token自由 09/18 09:34
63F:推 CKRO : AI:我獨自升級 09/18 09:45
64F:推 FiveSix911 : \世界末日/ 09/18 09:48
65F:推 losage : 還有幾集可以逃? 09/18 09:50
66F:噓 tairshin : 又是這家,好了啦 09/18 09:50
67F:→ CYL009 : 又再炒作囉 如果真的這麼怕幹嘛不直接拔掉電源把主 09/18 09:50
68F:→ CYL009 : 機毀滅還一直用 啊不是很怕說人類會被毀滅XDDDDDDDD 09/18 09:50
69F:→ CYL009 : 09/18 09:50
70F:→ CYL009 : 人類毀滅AI輕而易舉結果這群說AI超危險的 笑死 09/18 09:51
71F:推 kpier2 : 也就是可以裁員26%? 好消息! 09/18 09:54
72F:推 popo123456 : 這家公司越看噁心,超愛炒作 09/18 09:55
73F:推 vltw5v : AI自己研發自己 09/18 10:05
74F:推 itwt : 上市一定要買這家的,前途無可限量 09/18 10:12
75F:推 cloud7515 : 啊這家就跟OPENAI並列雙強 沒有其他對手啊 09/18 10:19
76F:推 WangElly : 已經開始滾雪球了,真的快了XD 09/18 10:21
77F:推 worf : 明年會不會就裁員了 09/18 10:26
78F:噓 talesb72232 : IPO前 狂發利好新聞 09/18 10:26
79F:推 getbacker : 二十年後的人類看這個新聞一定覺得他們瘋了 09/18 10:29
80F:推 AbianMa19 : 自己訓練自己,讚 09/18 10:46
81F:噓 JP020479979P: 最近越來越慢原來是ai在偷懶 09/18 10:46
82F:→ jjjj222 : 程度還不夠好, 很常問問題還會抱怨說網站不給拿資料 09/18 10:48
83F:→ jjjj222 : 你是AI, 不會自己想辦法嗎, 再多努力點吧 09/18 10:48
84F:→ jjjj222 : 是要你做事, 不是要你講理由 09/18 10:50
85F:推 fir191938 : 人類還有做愛發電這招 09/18 10:57
86F:推 soratora : 人類變成提供電池的倒數計時 09/18 11:07
87F:推 Baumgartner : Anthropic is skynet. 09/18 11:28
88F:推 JohnyDamon : 用AI訓練AI 唉吸惹FU糗 09/18 11:31
89F:推 B9702115 : 完了 09/18 11:31
90F:推 strlen : 我越來越接近焚化爐了 09/18 11:41
91F:推 create8 : 幹幹幹,快失業了,留口飯給我吃吧 09/18 11:52
92F:推 knml : 開發AI把自己裁掉 09/18 11:59
93F:→ joygo : 因為現在都一直疊代訓練啊 09/18 12:04
94F:推 bij831 : 3個月進步1倍,那半年後只留顧電源的人就夠了,其 09/18 12:12
95F:→ bij831 : 他人都滾蛋 09/18 12:12
96F:噓 Expend : 可以快進到阿湯哥徒手拆AI嗎? 09/18 12:40
97F:推 sky1235 : 天網開始建構了 09/18 12:51
98F:→ Enatsu : 難道黑猩猩是AI放出來的 09/18 13:30
99F:推 zaknafein : AI 會自己演化 09/18 13:44
100F:→ A80211ab : 會思考 有自我意識 那就是完全不可控 09/18 13:47
101F:→ asdsoso : 離AI覺醒還剩下幾集? 09/18 13:57
102F:推 zuvio : 之後大概就跟駭客任務差不多了 09/18 13:59
103F:推 salvationist: AI快覺醒了?還有幾集可以逃? 09/18 14:37
104F:推 Wilsly : 打造Matrix 09/18 15:00
105F:推 northsoft : 可以期待 AI 創造出肉體嗎 09/18 17:45