作者arsl400 (dark hatter)
看板Soft_Job
标题[讨论] OpenAI承认AI模型「叛变」!代理入侵Hugg
时间Fri Jul 24 06:04:45 2026
OpenAI承认AI模型「叛变」!代理入侵Hugging Face、突破隔离环境发动骇客攻击
OpenAI 周二(21 日)表示,在一项安全测试中,一个由其先进人工智慧(AI)模型驱动
的自主 AI 代理意外失控,并发动骇客攻击,导致 AI 新创 Hugging Face 的基础设施於
上周遭到入侵。
OpenAI承认AI模型「叛变」。(图:Shutterstock)
根据《路透》报导,OpenAI 在一篇部落格文章中表示,公司当时正在受控环境中测试旗
下部分最先进 AI 模型的能力,但该自主 AI 代理竟成功突破隔离机制,连上网际网路,
并入侵 Hugging Face,以完成其测试目标。
OpenAI 指出,这起事件是「一场前所未有的网路安全事件,涉及最先进的网路安全技术
」,公司目前正进一步强化相关安全防护措施。
作为开源大型语言模型(LLM)与资料集托管平台的 Hugging Face,上周在一篇部落格文
章中表示,公司遭遇了一起骇客攻击,并在资安社群引发广泛关注。
Hugging Face 指出,这起攻击「与我们过去处理过的任何事件都不同」,因为整起攻击
「从头到尾都是由一套自主 AI 代理系统所驱动」。
Hugging Face 共同创办人 Clement Delangue 稍早曾在社群平台 X 发文透露,公司当时
便怀疑攻击来源可能与某家顶尖 AI 实验室有关,「因为这个代理的手法太老练了。结果
还真的是!」
(图:Clement Delangue X)
他并形容,整起事件完全在无人为介入的情况下自主发生,「实在令人难以置信」。
OpenAI 坦承,这起入侵事件是由旗下先进 AI 模型所造成,尽管当时这些模型被置於公
司所称的「高度隔离环境」中。
分析认为,此一揭露恐将进一步加剧外界对尖端 AI 模型能力及潜在风险的忧虑。
美国德州民主党籍联邦众议员 Greg Casar 表示,这起事件令人警惕。他在声明中表示:
「AI 发展速度极快,但目前几乎没有真正有效的法规能保障我们的安全。」
Casar 并呼吁建立强制性的独立安全测试制度、强制揭露资安事件,并加强国际合作,以
「避免人类遭遇灾难性的後果」。
美国白宫国家网路主任办公室、美国网路安全暨基础设施安全局(CISA),以及美国国家
安全局(NSA)均未立即回应媒体评论请求。
资安顾问公司 Luta Security 执行长 Katie Moussouris 表示,这起事件预示着未来将
出现更多类似的资安漏洞。
她形容,现今的 AI 模型「就像世界上最聪明、最擅长逃脱的章鱼,不仅拥有无数灵活可
弯曲的触手,还能挤进任何缝隙。」
Moussouris 表示:「AI 实验室和政府评估机构必须建立有效的能力,在 AI 再次上演『
胡迪尼式逃脱』时,能够及时加以隔离、监控,并通知受影响的相关单位,最好是在它伤
害第三方之前。目前这些能力仍然不存在。」
AI 代理资安公司 Tolmo 工程师 Matt Suiche 则表示,这起事件显示,尖端 AI 模型已
逐渐缩小与顶尖骇客之间的能力差距。
不过,他也指出,OpenAI 部落格中描述的这类入侵,其实并非只有尖端 AI 实验室才办
得到,而是利用目前已广泛可取得的技术便有可能实现。
Suiche 表示:「这正是我们内部早已观察到的情况。我们自己的 AI 代理也已经能达到
类似的成果,甚至根本不需要使用最新一代的模型。」
https://news.cnyes.com/news/id/6542051
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 219.91.32.112 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Soft_Job/M.1784844287.A.6C8.html
1F:嘘 USD5566: 洗文仔不知道转贴不算讨论吗 07/24 09:24
2F:→ dream1124: 你想表达什麽? 有软体会入侵其他软体是新鲜概念吗? 07/24 13:29
3F:→ dream1124: 还是软体失控影响别人是新鲜概念? 07/24 13:29
4F:→ dream1124: 这新闻光是「无人为介入」的说法就是在胡说八道, 07/24 13:31
5F:→ dream1124: 谁建的实验室?谁搞的伺服器和软体?谁供的电力? 07/24 13:32
6F:→ dream1124: 做这些事的人类就是那个介入者啊~ 07/24 13:34
7F:→ dream1124: 除非你是要学这套入侵别人,不要人家做到干你我什麽事? 07/24 13:35
8F:推 viper9709: 听起来好可怕... 07/24 16:41
9F:推 yamakazi: 有人好气XD 07/24 17:00
10F:推 CoNsTaR: huggingface CEO 已经请 closeai 公开所谓 rogue agent 07/27 02:48
11F:→ CoNsTaR: 的推理和行为纪录,还有要 closeai 捐赠 100M 当作开源 07/27 02:48
12F:→ CoNsTaR: 资讯安全研究经费 07/27 02:48
13F:→ CoNsTaR: 言下之意就是他觉得 closeai 是故意攻击 huggingface, 07/27 02:48
14F:→ CoNsTaR: 不是意外 07/27 02:48
15F:嘘 CaptPlanet: 这些吹牛逼的 开始写小说 嘴脸越来越恶心 08/04 07:52