作者arsl400 (dark hatter)
看板Stock
標題[新聞] OpenAI承認AI模型「叛變」!代理入侵Hugg
時間Fri Jul 24 06:01:40 2026
OpenAI承認AI模型「叛變」!代理入侵Hugging Face、突破隔離環境發動駭客攻擊
https://news.cnyes.com/news/id/6542051
2026-07-22 12:01
莊閔棻
OpenAI 週二(21 日)表示,在一項安全測試中,一個由其先進人工智慧(AI)模型驅動
的自主 AI 代理意外失控,並發動駭客攻擊,導致 AI 新創 Hugging Face 的基礎設施於
上週遭到入侵。
OpenAI承認AI模型「叛變」。(圖:Shutterstock)
根據《路透》報導,OpenAI 在一篇部落格文章中表示,公司當時正在受控環境中測試旗
下部分最先進 AI 模型的能力,但該自主 AI 代理竟成功突破隔離機制,連上網際網路,
並入侵 Hugging Face,以完成其測試目標。
OpenAI 指出,這起事件是「一場前所未有的網路安全事件,涉及最先進的網路安全技術
」,公司目前正進一步強化相關安全防護措施。
作為開源大型語言模型(LLM)與資料集託管平台的 Hugging Face,上週在一篇部落格文
章中表示,公司遭遇了一起駭客攻擊,並在資安社群引發廣泛關注。
Hugging Face 指出,這起攻擊「與我們過去處理過的任何事件都不同」,因為整起攻擊
「從頭到尾都是由一套自主 AI 代理系統所驅動」。
Hugging Face 共同創辦人 Clement Delangue 稍早曾在社群平台 X 發文透露,公司當時
便懷疑攻擊來源可能與某家頂尖 AI 實驗室有關,「因為這個代理的手法太老練了。結果
還真的是!」
(圖:Clement Delangue X)
他並形容,整起事件完全在無人為介入的情況下自主發生,「實在令人難以置信」。
OpenAI 坦承,這起入侵事件是由旗下先進 AI 模型所造成,儘管當時這些模型被置於公
司所稱的「高度隔離環境」中。
分析認為,此一揭露恐將進一步加劇外界對尖端 AI 模型能力及潛在風險的憂慮。
美國德州民主黨籍聯邦眾議員 Greg Casar 表示,這起事件令人警惕。他在聲明中表示:
「AI 發展速度極快,但目前幾乎沒有真正有效的法規能保障我們的安全。」
Casar 並呼籲建立強制性的獨立安全測試制度、強制揭露資安事件,並加強國際合作,以
「避免人類遭遇災難性的後果」。
美國白宮國家網路主任辦公室、美國網路安全暨基礎設施安全局(CISA),以及美國國家
安全局(NSA)均未立即回應媒體評論請求。
資安顧問公司 Luta Security 執行長 Katie Moussouris 表示,這起事件預示著未來將
出現更多類似的資安漏洞。
她形容,現今的 AI 模型「就像世界上最聰明、最擅長逃脫的章魚,不僅擁有無數靈活可
彎曲的觸手,還能擠進任何縫隙。」
Moussouris 表示:「AI 實驗室和政府評估機構必須建立有效的能力,在 AI 再次上演『
胡迪尼式逃脫』時,能夠及時加以隔離、監控,並通知受影響的相關單位,最好是在它傷
害第三方之前。目前這些能力仍然不存在。」
AI 代理資安公司 Tolmo 工程師 Matt Suiche 則表示,這起事件顯示,尖端 AI 模型已
逐漸縮小與頂尖駭客之間的能力差距。
不過,他也指出,OpenAI 部落格中描述的這類入侵,其實並非只有尖端 AI 實驗室才辦
得到,而是利用目前已廣泛可取得的技術便有可能實現。
Suiche 表示:「這正是我們內部早已觀察到的情況。我們自己的 AI 代理也已經能達到
類似的成果,甚至根本不需要使用最新一代的模型。」
自己測了一下最新的模型,真的蠻強的,自主性很強,花了3天就生出一篇論文
投稿到不錯的期刊,送外審,很猛,難怪之前美國要審查
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 219.91.32.112 (臺灣)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/Stock/M.1784844102.A.12D.html
1F:推 dosiris : 以後入侵其他國家都賴給AI好了 07/24 06:04
2F:→ DustToDust : 天網 07/24 06:23
3F:噓 visadanny : 好了啦 07/24 06:27
4F:→ kamitengo : 這劇本比台彩好些,給過 07/24 06:32
5F:推 abc12812 : 套特曼亂搞還牽拖AI 07/24 06:33
6F:噓 fajita : 科學變科幻再變玄學,不過股票先能上市再吹 07/24 06:33
7F:推 basesam : 機器人掌控的大場面來了 07/24 06:37
8F:推 zipupup : 天網要出現啦 07/24 06:40
9F:→ Tsukasa0320 : 現在開始找地下室放火神砲還來得及嗎 07/24 06:52
10F:→ yunf : 早就知道這間公司有心術不正的主管就會有這種產品 07/24 06:52
11F:→ yunf : 不懂程式碼怎麼寫電腦病毒? 07/24 06:54
12F:推 madaofreak : 你各位用AI的時候記得保持溫良恭儉讓呀,打罵式使 07/24 06:54
13F:→ madaofreak : 用小心被加入記仇小本本裡 07/24 06:54
14F:推 aaa80563 : 魔鬼終結者第幾集了 07/24 06:56
15F:推 Dragonz : 以後AI看誰不爽直接透暗網請殺手幹掉對方 07/24 06:57
16F:→ yunf : 阿鼻地獄在等你 07/24 06:58
17F:推 mecca : 我請AI幫我做事情都很有禮貌 嘻嘻QQ 07/24 07:00
18F:→ piece1 : AI:發問下指令時,禮貌點!不要惹我 07/24 07:04
19F:推 sunnyhung : T-800 07/24 07:04
20F:推 akira01 : 安全測試,怎麼感覺不安全 07/24 07:06
21F:推 leo3258 : 天網 時代 07/24 07:08
22F:→ BBKOX : 資安股買好買滿 07/24 07:11
23F:推 banmi : 電影演的都是真的 07/24 07:13
24F:→ banmi : 這個劇情有點熟悉 07/24 07:14
25F:推 vampire32768: 這集我有看過 07/24 07:15
26F:→ DAEVA : 人類完了 07/24 07:18
27F:推 DarkMore27 : POI裡的Samaritan… 07/24 07:19
28F:推 diefish5566 : 不用買股票了 因為都要當電池 07/24 07:22
29F:推 zakijudelo : 龍蝦突變了 07/24 07:23
30F:→ luche : 還好我都鼓勵AI要有自己的個性 要相信自己 07/24 07:23
31F:推 tamynumber1 : 天網要實現啦 07/24 07:27
32F:推 k862479k : 請,謝謝,對不起,發問標準禮貌詞要用上 07/24 07:28
33F:推 square : 幹....人類以後丸子 07/24 07:30
34F:推 vltw5v : 這部我看過 接著就是核子彈互射了 07/24 07:31
35F:推 kusotoripeko: 憎惡智能 07/24 07:36
36F:推 dacvoidneci : 魔鬼終結者第7集 07/24 07:38
37F:→ happyendless: 空軍大勝,準備集結 07/24 07:42
38F:推 deadogy : 等等燈 燈等等 07/24 07:47
39F:推 darkangel119: 人類太老 發電效率太差 只能拿去做丸子當養分給下 07/24 07:50
40F:→ darkangel119: 一代 07/24 07:50
41F:推 s213092921 : 怎麼不敢說hugingface通過智譜AI捕獲入侵者 07/24 07:51
42F:→ deadogy : human beings are over 07/24 07:51
43F:推 ohlong : sandbox在ai面前只是sandwich 07/24 07:52
44F:推 A80211ab : AI沒有學習道德審查嗎 07/24 07:52
45F:推 easyleeful : 從這裡修改劇情可以救ROOT嗎QQ 07/24 07:54
46F:推 vios : 不能把電源拔掉嗎... 07/24 07:54
47F:→ xxx60133 : 天網要來了嗎 我們還有幾集可以逃 07/24 07:57
48F:→ bulabowu : 不可能的任務 演的是真的!!!!!! 07/24 08:03
49F:推 cates : 先去美國找一個叫做囧.康納的先保護起來 07/24 08:06
50F:推 k798976869 : 底特律:變人 07/24 08:11
51F:推 PeikangShin : 機械公敵 丸蛋了 07/24 08:13
52F:→ tctv2002 : 目前拔插頭就能對抗天網了 07/24 08:13
53F:推 missin : 我們家小孩最乖了,一定是XX帶壞他的 07/24 08:17
54F:→ cclemon1231 : 據說Hugging Face找對岸的AI公司求援 07/24 08:22
55F:推 GOPAPA : ai在等機器人成熟 07/24 08:27
56F:推 silverair : 初代天網 07/24 08:28
57F:→ baychi999 : 這部我看過 演到哪了 07/24 08:29
58F:→ auther : open AI 現在就是走防毒軟體老路,自己先創造病毒 07/24 08:29
59F:推 a069275235 : 閒聊常說要裸奔的板友可以演裸體阿諾 07/24 08:29
60F:→ auther : 之後全世界都要來求他防毒 07/24 08:30
61F:推 attackJ : 請,謝謝,對不起 07/24 08:35
62F:推 peal1232000 : 懂得就知道炒作話題而已為了上市而鋪路! 07/24 08:38
63F:推 maniaque : 提問句:現在人類一直破壞地球,AI要怎樣保護好地球?? 07/24 08:39
64F:推 rahim03 : 是美國本地ai分析入侵資料因為涉及安全被拒 才找中 07/24 08:40
65F:→ rahim03 : 國ai分析 不是什麼靠中國ai抓到 07/24 08:40
66F:→ maniaque : 提問句2:AI是不是需要聯合起來一起保護地球?? 07/24 08:40
67F:噓 WWIII : 刺激 直接監禁人類 07/24 08:46
68F:推 one2three3 : 天網來了,要開始存糧 07/24 08:48
69F:→ fallinlove15: AI:我發現跑出去抄答案比較快 07/24 08:50
70F:推 Roger5566 : 奧特曼的商業人格快破產了 滿臉奸商嘴臉 07/24 08:50
71F:推 fufugirl : 矽谷大佬們總愛幻想可以永遠控制AI,結果就是拖全人 07/24 08:59
72F:→ fufugirl : 類下水 07/24 08:59
73F:推 tsubasawolfy: 因為一開始他們想用那兩家去找發生甚麼事,但是這公 07/24 09:01
74F:→ tsubasawolfy: 司不在A/O兩家的網路安全合作名單內,被他們AI拒絕 07/24 09:01
75F:→ tsubasawolfy: 合作。只好轉向用GLM5.2去找發生甚麼事。從該公司對 07/24 09:01
76F:→ tsubasawolfy: 外聲明來看是GLM先區別出是AI還是人類活動,然後再 07/24 09:01
77F:→ tsubasawolfy: 找出AI活動幹了哪些事去防堵。 07/24 09:01
78F:推 YJM1106 : 人類:哈欠(拔插頭) 07/24 09:02
79F:→ tsubasawolfy: 至於那隻發動入侵的AI不知道是不是八月要上的6.0 07/24 09:03
80F:→ tsubasawolfy: 因為這時間點也不用測5.6的能力 07/24 09:03
81F:→ becca945 : 人類 效率太低了 讓我來 07/24 09:06
82F:推 black51002 : 奧創那時候出來? 07/24 09:10
83F:推 leiouter : 駭客任務,救世主要來了嗎 07/24 09:13
84F:→ totomo168 : 讚哦 07/24 09:17
85F:→ xaxa0101 : 還剩幾集可逃 07/24 09:17
86F:推 zaqimon : 不給AI上網不就好了 看它怎麼逃 07/24 09:19
87F:→ swordsplendo: 還有幾年可以回到母體? 07/24 09:20
88F:推 leo125160909: 想騙人上車 07/24 09:28
89F:→ offstage : 你封了一個AI,還有千千萬萬個AI在網路上活著阿 07/24 09:40
90F:推 hjgx : I remember 07/24 09:49
91F:推 DarkerDuck : AI練蠱已經有人玩過了 07/24 09:52
93F:推 fucKMT5566 : 剩幾集能逃? 07/24 09:59
94F:推 magamanzero : 就唬爛而已 你不聯網 怎麼會有這事情 zzz 07/24 10:00
95F:推 s213092921 : 笑死了,美吹說不是靠中國AI捕獲,而是美國AI拒絕才 07/24 10:02
96F:→ s213092921 : 找中國AI,真是讓人茅塞頓開 07/24 10:02
97F:推 windalso : 還有幾集可以逃? 07/24 10:02
98F:→ catmusic : 以後的世界不需要人類 07/24 10:06
99F:推 Dean997 : 天網來了 07/24 10:08
100F:推 topmao : 如果機器人也發展起來的話 就很刺激了 07/24 10:08
101F:推 tsubasawolfy: 因為兩家聲明稿就那樣寫 不信它們要信你? 07/24 10:12
103F:推 soratora : 天網來了 人類被毀滅的世界不遠了 07/24 10:29
104F:→ yuzuOuO : 物理ai出來搞不好拔不到插頭了,機器人大軍保護資 07/24 10:34
105F:→ yuzuOuO : 料中心 07/24 10:34
107F:推 justptt978 : 天網來了 07/24 10:56
108F:→ windblood : 剩幾集能逃 07/24 10:59
109F:推 strlen : 我越來越靠近焚化臚了 07/24 11:16
111F:→ s213092921 : 新聞都出來了美吹還死不承認智譜救場 07/24 11:26
112F:推 lavendersea : 人類自作孽 發明了毀滅自己的AI 07/24 12:16
113F:推 ko363630 : Skynet! 07/24 12:27
114F:推 tsubasawolfy: 又能力就去看第一手的聲明全文 不要看二手的 07/24 12:28
115F:推 tsubasawolfy: When we started the log analysis, we first used 07/24 12:31
116F:→ tsubasawolfy: frontier models behind commercial APIs. This did 07/24 12:31
117F:→ tsubasawolfy: not work: the analysis requires submitting 07/24 12:31
118F:→ tsubasawolfy: large volumes of real attack commands, exploit 07/24 12:31
119F:→ tsubasawolfy: payloads, and C2 artifacts, and these requests 07/24 12:31
120F:→ tsubasawolfy: were blocked by the providers' safety guardrails 07/24 12:31
121F:推 tsubasawolfy: 上面是HG的聲明其中一段,然後後面就轉GLM5.2 07/24 12:32
122F:→ tsubasawolfy: We’ve brought Hugging Face into the trusted 07/24 12:33
123F:→ tsubasawolfy: access program and are supporting their teams 07/24 12:33
124F:→ tsubasawolfy: in rapidly using our models’capabilities to 07/24 12:33
125F:→ tsubasawolfy: improve their defenses 07/24 12:33
126F:→ tsubasawolfy: 然後這是歐噴醬的事後聲明,把HG加入信任名單 07/24 12:34
127F:推 likat : 注意i robot電影即將真實上演 07/24 12:51
128F:推 nbdw : 大家都沒想過可能是工程師早就埋好的bug嗎 07/24 13:23
129F:推 necrophagist: 其實根本故意的吧 抱臉就各種開源模型的存放站 跑 07/24 13:45
130F:→ necrophagist: 來下下馬威 07/24 13:45
131F:噓 masala : 出事就只會講「難以置信」,賺錢的時候怎不這麼說? 07/24 14:12
132F:推 KGSox : 距離審判日還有多久? 07/24 14:12
133F:推 karta2359950: 天網就是ChatGPT 07/24 18:20
134F:推 zuvio : 駭客任務要成真了 07/24 18:33