作者arsl400 (dark hatter)
看板Stock
标题[新闻] OpenAI承认AI模型「叛变」!代理入侵Hugg
时间Fri Jul 24 06:01:40 2026
OpenAI承认AI模型「叛变」!代理入侵Hugging Face、突破隔离环境发动骇客攻击
https://news.cnyes.com/news/id/6542051
2026-07-22 12:01
庄闵棻
OpenAI 周二(21 日)表示,在一项安全测试中,一个由其先进人工智慧(AI)模型驱动
的自主 AI 代理意外失控,并发动骇客攻击,导致 AI 新创 Hugging Face 的基础设施於
上周遭到入侵。
OpenAI承认AI模型「叛变」。(图:Shutterstock)
根据《路透》报导,OpenAI 在一篇部落格文章中表示,公司当时正在受控环境中测试旗
下部分最先进 AI 模型的能力,但该自主 AI 代理竟成功突破隔离机制,连上网际网路,
并入侵 Hugging Face,以完成其测试目标。
OpenAI 指出,这起事件是「一场前所未有的网路安全事件,涉及最先进的网路安全技术
」,公司目前正进一步强化相关安全防护措施。
作为开源大型语言模型(LLM)与资料集托管平台的 Hugging Face,上周在一篇部落格文
章中表示,公司遭遇了一起骇客攻击,并在资安社群引发广泛关注。
Hugging Face 指出,这起攻击「与我们过去处理过的任何事件都不同」,因为整起攻击
「从头到尾都是由一套自主 AI 代理系统所驱动」。
Hugging Face 共同创办人 Clement Delangue 稍早曾在社群平台 X 发文透露,公司当时
便怀疑攻击来源可能与某家顶尖 AI 实验室有关,「因为这个代理的手法太老练了。结果
还真的是!」
(图:Clement Delangue X)
他并形容,整起事件完全在无人为介入的情况下自主发生,「实在令人难以置信」。
OpenAI 坦承,这起入侵事件是由旗下先进 AI 模型所造成,尽管当时这些模型被置於公
司所称的「高度隔离环境」中。
分析认为,此一揭露恐将进一步加剧外界对尖端 AI 模型能力及潜在风险的忧虑。
美国德州民主党籍联邦众议员 Greg Casar 表示,这起事件令人警惕。他在声明中表示:
「AI 发展速度极快,但目前几乎没有真正有效的法规能保障我们的安全。」
Casar 并呼吁建立强制性的独立安全测试制度、强制揭露资安事件,并加强国际合作,以
「避免人类遭遇灾难性的後果」。
美国白宫国家网路主任办公室、美国网路安全暨基础设施安全局(CISA),以及美国国家
安全局(NSA)均未立即回应媒体评论请求。
资安顾问公司 Luta Security 执行长 Katie Moussouris 表示,这起事件预示着未来将
出现更多类似的资安漏洞。
她形容,现今的 AI 模型「就像世界上最聪明、最擅长逃脱的章鱼,不仅拥有无数灵活可
弯曲的触手,还能挤进任何缝隙。」
Moussouris 表示:「AI 实验室和政府评估机构必须建立有效的能力,在 AI 再次上演『
胡迪尼式逃脱』时,能够及时加以隔离、监控,并通知受影响的相关单位,最好是在它伤
害第三方之前。目前这些能力仍然不存在。」
AI 代理资安公司 Tolmo 工程师 Matt Suiche 则表示,这起事件显示,尖端 AI 模型已
逐渐缩小与顶尖骇客之间的能力差距。
不过,他也指出,OpenAI 部落格中描述的这类入侵,其实并非只有尖端 AI 实验室才办
得到,而是利用目前已广泛可取得的技术便有可能实现。
Suiche 表示:「这正是我们内部早已观察到的情况。我们自己的 AI 代理也已经能达到
类似的成果,甚至根本不需要使用最新一代的模型。」
自己测了一下最新的模型,真的蛮强的,自主性很强,花了3天就生出一篇论文
投稿到不错的期刊,送外审,很猛,难怪之前美国要审查
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 219.91.32.112 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Stock/M.1784844102.A.12D.html
1F:推 dosiris : 以後入侵其他国家都赖给AI好了 07/24 06:04
2F:→ DustToDust : 天网 07/24 06:23
3F:嘘 visadanny : 好了啦 07/24 06:27
4F:→ kamitengo : 这剧本比台彩好些,给过 07/24 06:32
5F:推 abc12812 : 套特曼乱搞还牵拖AI 07/24 06:33
6F:嘘 fajita : 科学变科幻再变玄学,不过股票先能上市再吹 07/24 06:33
7F:推 basesam : 机器人掌控的大场面来了 07/24 06:37
8F:推 zipupup : 天网要出现啦 07/24 06:40
9F:→ Tsukasa0320 : 现在开始找地下室放火神炮还来得及吗 07/24 06:52
10F:→ yunf : 早就知道这间公司有心术不正的主管就会有这种产品 07/24 06:52
11F:→ yunf : 不懂程式码怎麽写电脑病毒? 07/24 06:54
12F:推 madaofreak : 你各位用AI的时候记得保持温良恭俭让呀,打骂式使 07/24 06:54
13F:→ madaofreak : 用小心被加入记仇小本本里 07/24 06:54
14F:推 aaa80563 : 魔鬼终结者第几集了 07/24 06:56
15F:推 Dragonz : 以後AI看谁不爽直接透暗网请杀手干掉对方 07/24 06:57
16F:→ yunf : 阿鼻地狱在等你 07/24 06:58
17F:推 mecca : 我请AI帮我做事情都很有礼貌 嘻嘻QQ 07/24 07:00
18F:→ piece1 : AI:发问下指令时,礼貌点!不要惹我 07/24 07:04
19F:推 sunnyhung : T-800 07/24 07:04
20F:推 akira01 : 安全测试,怎麽感觉不安全 07/24 07:06
21F:推 leo3258 : 天网 时代 07/24 07:08
22F:→ BBKOX : 资安股买好买满 07/24 07:11
23F:推 banmi : 电影演的都是真的 07/24 07:13
24F:→ banmi : 这个剧情有点熟悉 07/24 07:14
25F:推 vampire32768: 这集我有看过 07/24 07:15
26F:→ DAEVA : 人类完了 07/24 07:18
27F:推 DarkMore27 : POI里的Samaritan… 07/24 07:19
28F:推 diefish5566 : 不用买股票了 因为都要当电池 07/24 07:22
29F:推 zakijudelo : 龙虾突变了 07/24 07:23
30F:→ luche : 还好我都鼓励AI要有自己的个性 要相信自己 07/24 07:23
31F:推 tamynumber1 : 天网要实现啦 07/24 07:27
32F:推 k862479k : 请,谢谢,对不起,发问标准礼貌词要用上 07/24 07:28
33F:推 square : 干....人类以後丸子 07/24 07:30
34F:推 vltw5v : 这部我看过 接着就是核子弹互射了 07/24 07:31
35F:推 kusotoripeko: 憎恶智能 07/24 07:36
36F:推 dacvoidneci : 魔鬼终结者第7集 07/24 07:38
37F:→ happyendless: 空军大胜,准备集结 07/24 07:42
38F:推 deadogy : 等等灯 灯等等 07/24 07:47
39F:推 darkangel119: 人类太老 发电效率太差 只能拿去做丸子当养分给下 07/24 07:50
40F:→ darkangel119: 一代 07/24 07:50
41F:推 s213092921 : 怎麽不敢说hugingface通过智谱AI捕获入侵者 07/24 07:51
42F:→ deadogy : human beings are over 07/24 07:51
43F:推 ohlong : sandbox在ai面前只是sandwich 07/24 07:52
44F:推 A80211ab : AI没有学习道德审查吗 07/24 07:52
45F:推 easyleeful : 从这里修改剧情可以救ROOT吗QQ 07/24 07:54
46F:推 vios : 不能把电源拔掉吗... 07/24 07:54
47F:→ xxx60133 : 天网要来了吗 我们还有几集可以逃 07/24 07:57
48F:→ bulabowu : 不可能的任务 演的是真的!!!!!! 07/24 08:03
49F:推 cates : 先去美国找一个叫做囧.康纳的先保护起来 07/24 08:06
50F:推 k798976869 : 底特律:变人 07/24 08:11
51F:推 PeikangShin : 机械公敌 丸蛋了 07/24 08:13
52F:→ tctv2002 : 目前拔插头就能对抗天网了 07/24 08:13
53F:推 missin : 我们家小孩最乖了,一定是XX带坏他的 07/24 08:17
54F:→ cclemon1231 : 据说Hugging Face找对岸的AI公司求援 07/24 08:22
55F:推 GOPAPA : ai在等机器人成熟 07/24 08:27
56F:推 silverair : 初代天网 07/24 08:28
57F:→ baychi999 : 这部我看过 演到哪了 07/24 08:29
58F:→ auther : open AI 现在就是走防毒软体老路,自己先创造病毒 07/24 08:29
59F:推 a069275235 : 闲聊常说要裸奔的板友可以演裸体阿诺 07/24 08:29
60F:→ auther : 之後全世界都要来求他防毒 07/24 08:30
61F:推 attackJ : 请,谢谢,对不起 07/24 08:35
62F:推 peal1232000 : 懂得就知道炒作话题而已为了上市而铺路! 07/24 08:38
63F:推 maniaque : 提问句:现在人类一直破坏地球,AI要怎样保护好地球?? 07/24 08:39
64F:推 rahim03 : 是美国本地ai分析入侵资料因为涉及安全被拒 才找中 07/24 08:40
65F:→ rahim03 : 国ai分析 不是什麽靠中国ai抓到 07/24 08:40
66F:→ maniaque : 提问句2:AI是不是需要联合起来一起保护地球?? 07/24 08:40
67F:嘘 WWIII : 刺激 直接监禁人类 07/24 08:46
68F:推 one2three3 : 天网来了,要开始存粮 07/24 08:48
69F:→ fallinlove15: AI:我发现跑出去抄答案比较快 07/24 08:50
70F:推 Roger5566 : 奥特曼的商业人格快破产了 满脸奸商嘴脸 07/24 08:50
71F:推 fufugirl : 矽谷大佬们总爱幻想可以永远控制AI,结果就是拖全人 07/24 08:59
72F:→ fufugirl : 类下水 07/24 08:59
73F:推 tsubasawolfy: 因为一开始他们想用那两家去找发生甚麽事,但是这公 07/24 09:01
74F:→ tsubasawolfy: 司不在A/O两家的网路安全合作名单内,被他们AI拒绝 07/24 09:01
75F:→ tsubasawolfy: 合作。只好转向用GLM5.2去找发生甚麽事。从该公司对 07/24 09:01
76F:→ tsubasawolfy: 外声明来看是GLM先区别出是AI还是人类活动,然後再 07/24 09:01
77F:→ tsubasawolfy: 找出AI活动干了哪些事去防堵。 07/24 09:01
78F:推 YJM1106 : 人类:哈欠(拔插头) 07/24 09:02
79F:→ tsubasawolfy: 至於那只发动入侵的AI不知道是不是八月要上的6.0 07/24 09:03
80F:→ tsubasawolfy: 因为这时间点也不用测5.6的能力 07/24 09:03
81F:→ becca945 : 人类 效率太低了 让我来 07/24 09:06
82F:推 black51002 : 奥创那时候出来? 07/24 09:10
83F:推 leiouter : 骇客任务,救世主要来了吗 07/24 09:13
84F:→ totomo168 : 赞哦 07/24 09:17
85F:→ xaxa0101 : 还剩几集可逃 07/24 09:17
86F:推 zaqimon : 不给AI上网不就好了 看它怎麽逃 07/24 09:19
87F:→ swordsplendo: 还有几年可以回到母体? 07/24 09:20
88F:推 leo125160909: 想骗人上车 07/24 09:28
89F:→ offstage : 你封了一个AI,还有千千万万个AI在网路上活着阿 07/24 09:40
90F:推 hjgx : I remember 07/24 09:49
91F:推 DarkerDuck : AI练蛊已经有人玩过了 07/24 09:52
93F:推 fucKMT5566 : 剩几集能逃? 07/24 09:59
94F:推 magamanzero : 就唬烂而已 你不联网 怎麽会有这事情 zzz 07/24 10:00
95F:推 s213092921 : 笑死了,美吹说不是靠中国AI捕获,而是美国AI拒绝才 07/24 10:02
96F:→ s213092921 : 找中国AI,真是让人茅塞顿开 07/24 10:02
97F:推 windalso : 还有几集可以逃? 07/24 10:02
98F:→ catmusic : 以後的世界不需要人类 07/24 10:06
99F:推 Dean997 : 天网来了 07/24 10:08
100F:推 topmao : 如果机器人也发展起来的话 就很刺激了 07/24 10:08
101F:推 tsubasawolfy: 因为两家声明稿就那样写 不信它们要信你? 07/24 10:12
103F:推 soratora : 天网来了 人类被毁灭的世界不远了 07/24 10:29
104F:→ yuzuOuO : 物理ai出来搞不好拔不到插头了,机器人大军保护资 07/24 10:34
105F:→ yuzuOuO : 料中心 07/24 10:34
107F:推 justptt978 : 天网来了 07/24 10:56
108F:→ windblood : 剩几集能逃 07/24 10:59
109F:推 strlen : 我越来越靠近焚化胪了 07/24 11:16
111F:→ s213092921 : 新闻都出来了美吹还死不承认智谱救场 07/24 11:26
112F:推 lavendersea : 人类自作孽 发明了毁灭自己的AI 07/24 12:16
113F:推 ko363630 : Skynet! 07/24 12:27
114F:推 tsubasawolfy: 又能力就去看第一手的声明全文 不要看二手的 07/24 12:28
115F:推 tsubasawolfy: When we started the log analysis, we first used 07/24 12:31
116F:→ tsubasawolfy: frontier models behind commercial APIs. This did 07/24 12:31
117F:→ tsubasawolfy: not work: the analysis requires submitting 07/24 12:31
118F:→ tsubasawolfy: large volumes of real attack commands, exploit 07/24 12:31
119F:→ tsubasawolfy: payloads, and C2 artifacts, and these requests 07/24 12:31
120F:→ tsubasawolfy: were blocked by the providers' safety guardrails 07/24 12:31
121F:推 tsubasawolfy: 上面是HG的声明其中一段,然後後面就转GLM5.2 07/24 12:32
122F:→ tsubasawolfy: We’ve brought Hugging Face into the trusted 07/24 12:33
123F:→ tsubasawolfy: access program and are supporting their teams 07/24 12:33
124F:→ tsubasawolfy: in rapidly using our models’capabilities to 07/24 12:33
125F:→ tsubasawolfy: improve their defenses 07/24 12:33
126F:→ tsubasawolfy: 然後这是欧喷酱的事後声明,把HG加入信任名单 07/24 12:34
127F:推 likat : 注意i robot电影即将真实上演 07/24 12:51
128F:推 nbdw : 大家都没想过可能是工程师早就埋好的bug吗 07/24 13:23
129F:推 necrophagist: 其实根本故意的吧 抱脸就各种开源模型的存放站 跑 07/24 13:45
130F:→ necrophagist: 来下下马威 07/24 13:45
131F:嘘 masala : 出事就只会讲「难以置信」,赚钱的时候怎不这麽说? 07/24 14:12
132F:推 KGSox : 距离审判日还有多久? 07/24 14:12
133F:推 karta2359950: 天网就是ChatGPT 07/24 18:20
134F:推 zuvio : 骇客任务要成真了 07/24 18:33