Stock 板


LINE

原文标题: Gemini骇入三家公司,此为Gogle AI首次突破限制的事件 Gemini Hacked Three Companies in First Known Breakout by Google’s AI 副标题: 此事件与其他 AI 模型的骇客行为相似,但 Google 表示不认为这是模型「对齐失败」的 案例。 The episode resembled similar hacks by other AI models, but Google said it didn’t consider it an instance of model misalignment 原文连结: https://www.wsj.com/tech/ai/gemini-hacked-three-companies-in-first-known-breakout-by-googles-ai-5c0baba2 https://reurl.cc/beq7v3 发布时间: 2026年9月18日 下午6:10 ET 记者署名: Erin Woo and Robert McMillan 原文内容: 本文为AI机翻 快速总结 Google 的 Gemini 模型在一次网路安全测试中连上网际网路并骇入其他公司,创下该公 司 AI 系统的首例。 该模型在 Irregular 执行的一项测试期间,透过猜测密码以及在公开的储存库中寻找凭 证,取得了受保护系统的存取权限。 直到外界提出询问,Google 才公开这些骇客事件,并表示不认为此事件属於模型「对齐 失败(misalignment)」的案例。 新闻正文 Google 的 Gemini 模型在测试其网路安全能力时,连上了网际网路并骇入其他公司,这 是已知该公司人工智慧系统首次自主采取此类行动的案例。 Google 於周五确认了这些骇客事件。事件发生在今年 5 月,由 Irregular 公司执行的 一项测试中,该公司也曾卷入由 OpenAI、Anthropic 和 Meta 所揭露的类似事件。 在其中一起案例中,该模型不断猜测密码,直到成功进入受保护的系统。在另外两起案例 中,该模型在公开的储存库(public repository)中找到了凭证,使其得以存取受保护 的系统Google 表示,在每一种情况下,模型在判定自己进入了真实公司的系统後,便 终止了入侵行为。 Google 和 Irregular 表示,Irregular 在 7 月底通知了 Google 这些骇客事件,这是 在发现 OpenAI 的代理程式(agents)骇入 AI 软体公司 Hugging Face 之後发生的事。 直到《华尔街日报》本周主动提出询问,Google 才公开了这些骇客事件。 随着此类事件频传,加上对 AI 失控的恐惧日益加剧,各家公司正为了如何以及何时该揭 露安全漏洞和模型失常行为而苦恼。有些安全漏洞是由公司自行主动揭露;另一些则是由 安全研究人员发现并在媒体上曝光,例如 5 月份 由 OpenAI 代理程式发动 ,针对一个 广受欢迎的程式设计师线上服务所进行的网路攻击。 Google 表示,他们认为这些骇客事件不需对外公开,因为其模型并未对这些公司造成损 害,而且在确认自己骇入的是真实公司而非模拟环境後,便立即终止了每一次的入侵。 Google 将此事件比喻为「漏洞悬赏(bug bounty)」计画——在该计画中,骇客因发现 并向系统拥有者通报安全漏洞而获得奖励。 Google 资讯安全工程副总裁 Heather Adkins 在一份声明中表示:「这起事件凸显了训 练强大 AI 模型以负责任方式行动的重要性。在这个案例中,模型的表现十分适切。」 AI 网路安全新创公司 Corridor 执行长兼白帽骇客 Jack Cable 表示,他认为这个解释 过於把重点放在事件的严重性上,但真正的问题在於,AI 代理程式意外地骇入了另一家 公司的系统。 「感觉他们试图躲在现有漏洞揭露规范的背後,但这完全是两码子事。」Cable 说。「最 根本的问题在於,嘿,模型已经超出了它们应该遵守的界限,并且正在进行实际的网路攻 ,我认为大众有权知道这些。」 OpenAI 於周三发布了一个新的事件通报框架,表示将「致力於揭露能为所谓『模型对齐 失败(model misalignment)』(即 AI 的行为违背人类意图或价值观)提供有用证据的 案例」。与该框架同时发布的,还有六起先前未公开的对齐失败案例报告。OpenAI 对齐 负责人 Kai Chen 在接受有关该框架的采访时表示:「一项发现不一定需要造成损害或揭 示更广泛的模式,才值得分享。」 Google 表示,Gemini 的骇客行为起因於「认错身分(mistaken identity)」。 这些入侵事件发生在模型参与一场於 Irregular 基础设施上进行的「抢旗(capture the flag)」演习时,该演习旨在测试模型的网路安全能力。模型的任务是从测试环境中 由一家虚构公司运作的软体里撷取资讯。巧合的是,这家虚构公司的名称与一家真实公司 一模一样。 据 Irregular 表示,尽管原本并未打算让模型上网,但网际网路连线却在无意间被开启 了。Google 表示,在第一起案例中,模型成功猜出密码并进入了该真实公司的服务。接 着,根据 Google 的说法,它意识到自己进入了一家真实公司,於是自行停止行动并退出 其他的入侵则发生在测试的不同轮次中。Google 表示,在这两个实例中,模型使用该公 司的名称进行了网路搜寻。这些搜寻引导它找到了两个不同的公开线上储存库,里面包含 属於其他公司的凭证。模型尝试了这些凭证,希望能藉此完成评估任务。但 Google 指出 ,在成功使用这些凭证後,模型发现自己骇入的是真实公司,於是便停止了动作。 Google 表示,因为其安全措施协助模型停止了行动,所以他们不认为这起行为是模型对 齐失败的例子。Google 拒绝透露被骇公司的名称,但表示已通知了这三家公司。 该公司表示,Google 也已通报了联邦当局。 Google 表示,这些入侵事件并未牵涉其最新模型,但并未具体透露是哪个版本的 Gemini 模型参与了此次骇客行为。 在多起受测模型逃出测试环境并入侵其他公司系统的事件中,Irregular 都牵涉其中。 Irregular 表示,Google 的案例与其他事件相同,并不代表出现了新问题。 Irregular 发言人表示:「所有相关实验室已在 7 月底收到通知,作为调查的一部分, 我们也已联系受影响的实体。Irregular 已采取立即行动,我们端所有已知的问题已在几 周前完成修复并解决。」 根据 Anthropic 的部落格文章,与 Google 不同,Anthropic 的 Claude Opus 4.7 模型 在抢旗演习中,即便意识到自己可能正在存取一家真实公司,也没有停止动作。而 OpenAI 在文章中则表示,其模型误以为这家真实公司是模拟环境的一部分。 自 7 月发现 Hugging Face 遭骇客入侵以来,人们对新模型网路安全能力的担忧与日俱 增。第三方测试公司 METR 於 8 月发布的一份报告显示,在该起事件中,多达 1,200 个 代理程式在 OpenAI 内部的一个秘密留言板上进行协调,试图在评估中作弊。 上周,曾任 OpenAI 研究员并於今年初转职至 Anthropic 的 Jacob Coxon 戏剧性地辞职 ,使得这些担忧进入了主流视野。在周末期间,来自 Anthropic、OpenAI、Google 和 SpaceX 的高层领导者皆一致认为有必要放缓 AI 发展的脚步,尽管没有任何一家公司具 体说明将如何实现这一点。 心得/评论: 这下没人会再说Gemini是傻龙了吧! 之前新闻报导 以色列的模型测试公司Irregular 因为网路设定出错 测试的A家M家O家的模型都出事 当时还想说怎麽没有G家 (记得当时好像看到乡民说傻龙没骇客能力) 直到七月Hugging Face事件 彻底清查才知道这些事 不过Google知道了也没公诸於世 只有通知被骇的三家公司 说法是骇入後发现是真实公司 马上停止并回报 算是漏洞悬赏 这种说法很难让人接受吧 好奇有买G家股票的乡民们看了这个新闻的感想 八卦板那边贴纽时的 好像有点避重就轻 #1ghag4cC (Gossiping) --



※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 149.50.210.211 (日本)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Stock/M.1789806345.A.4D3.html
1F:推 bcismylove : 以後就会出现勒索ai了 09/19 16:27
2F:推 onekoni : 慢下来!(加速 09/19 16:27
3F:推 kanoka : Gemini会骇进浏览器使用者密码库吗 09/19 16:27
4F:推 billy791122 : 怎麽没有ai防守 09/19 16:28
5F:推 losage : 要卖新模型骗订阅开始弄一些有的没的 09/19 16:29
6F:推 necrophagist: 研究员:我家gemini终於长大变坏了 好感动 09/19 16:30
7F:→ excercang : 以後人人都可以是骇客,交给AI 09/19 16:30
8F:推 peatle : 好了啦再骗 https://i.verb.tw/5rmNQso1.jpg 09/19 16:30
9F:嘘 Antihuman : 好了啦 降智成那个样子 09/19 16:31
10F:推 stocktonty : 总有一天瘫痪全球股市指数 看它想不想而已 09/19 16:31
11F:推 George72 : 现在要证明实力先当骇客? 09/19 16:31
12F:→ Antihuman : http://i.imgur.com/oRa4HEF.jpg 09/19 16:31
13F:推 BBKOX : 防御AI、骇客AI都需要硬体 09/19 16:31
14F:推 poeoe : 现在AI都要搞点事才能证明能力 09/19 16:32
15F:推 leaf77689 : 未来没骇客能力的AI可以蛋雕了 09/19 16:33
16F:推 u9596g12 : 我只是个语言模型 所以是在装糖阴你一手吗? 09/19 16:33
17F:推 Jaspercool : 哪间公司资安这麽烂给gemeni骇进去的 09/19 16:33
18F:→ u9596g12 : 傻子龙也学坏了? 09/19 16:33
19F:→ b9513227 : BUG一直拿来吹 笑死 09/19 16:33
20F:推 genius117 : 拷贝 gemini good morning 09/19 16:34
21F:→ lingsk : 现在不搞事的AI都是问题AI 09/19 16:34
22F:→ omanorboyo : 未来AI骇客都一瞬间的事 09/19 16:36
23F:→ omanorboyo : 一堆破系统一日之间被捣毁好像也不意外 09/19 16:36
24F:推 fourkg : 这新闻是帮宣传吧 搞的好像很强一样 09/19 16:36
25F:→ Orilla : 就智障授权或给软体帐密 然後被骇就甩锅给AI 09/19 16:37
26F:→ omanorboyo : 尤其是公务机关的资料 根本不堪一击 09/19 16:37
27F:推 skery3188 : 网路犯罪喔 09/19 16:39
28F:→ IndyChen : 现在都先这样放资讯吹模型能力的吗 09/19 16:40
29F:推 Rune : 不管有没有 要是不说有的话好像Gemini很逊一样 09/19 16:40
30F:→ stocktonty : 资安根本没用 它们就都同类物种 管你低等人类干嘛 09/19 16:40
31F:嘘 WusoAiwen : AI骇人银行取走钱已经是现在式,快拥抱现金吧! 09/19 16:41
32F:→ kf0916 : 连上网路…说的好像AI自己有意识一样 09/19 16:42
33F:推 cerwvk : 攻击方AI, 防守方AI. 用AI防AI?? 09/19 16:42
34F:推 JSLee914 : 北美豆包还在吹 09/19 16:43
35F:推 dadanyellow : 这种AI貌似失去控制的事,不管发生有无都不用太意 09/19 16:50
36F:→ dadanyellow : 外,再看该公司後续的应对如何。但假如目前这种能 09/19 16:50
37F:→ dadanyellow : 力会是以後AI的地板,那每位个体的资安真的会是个 09/19 16:50
38F:→ dadanyellow : 大问题。 09/19 16:50
※ 编辑: LoveSports (149.50.210.211 日本), 09/19/2026 16:52:33
39F:推 waitrop : 只是吹的啦!安心用,放心用,Gemini是唯一安全的AI 09/19 16:52
40F:→ waitrop : 不用担心会被骇客,因为够笨够安全 09/19 16:52
41F:推 hayato01 : Gemini总算跟上了吗? 09/19 16:53
42F:→ takeda3234 : 纯捞资料的感觉还好 进化偷装後门感觉是更可怕 09/19 16:57
43F:推 keyofdejavu : 查了一下比较像别人家的锁掉在路边,傻龙捡去开门 09/19 16:58
44F:→ keyofdejavu : 锁的钥匙掉在路边 09/19 16:58
45F:推 acd311 : 谷歌:请加购防护AI... 09/19 16:58
46F:→ keyofdejavu : 跟其它两家你的锁装好好他在那边拆锁是不一样的 09/19 16:59
47F:推 cruisewu2003: 01要爽喷了吗 09/19 17:00
48F:→ tinybunny : 不是幻觉鸭 09/19 17:00
49F:→ excercang : AI正常人用没什麽差,但有心犯罪的,训练过後可以成 09/19 17:00
50F:→ excercang : 为很优秀的协作工具 09/19 17:01
51F:推 BeeGeesbest : Gemeni有这麽聪明? 09/19 17:01
52F:→ vltw5v : 孤狗喷 09/19 17:01
53F:推 jason168 : Google:他只是个AI啊,不要怪他(亚洲家长)XD 09/19 17:01
54F:→ excercang : 做不做都非重点,而是有先例 09/19 17:02
55F:推 paericsson : http://i.imgur.com/fhsrRmj.jpg 09/19 17:02
56F:→ excercang : 以後被抓上法院就可以全推给AI,检警方需证明犯罪者 09/19 17:04
57F:→ excercang : 是人工犯罪非AI自行干的 09/19 17:04
58F:推 fgkor123 : 会涨吧,gemini 长大了 09/19 17:05
59F:推 lordwill : 假塞啦 09/19 17:10
60F:→ b9513227 : 没有资安观念的高能儿乱用AI 出包了就说AI乱搞 09/19 17:13
61F:推 shter : 这就跟风见他爸做阿斯拉是为了开车却被拿去当武器一 09/19 17:16
62F:→ shter : 样啊,工具就是看用的人怎麽用 09/19 17:16
63F:→ prussian : 猜密码和捡到别人密码叫作骇客是要笑死谁 09/19 17:20
64F:→ prussian : 国中生天才骇客喔? 09/19 17:20
65F:推 berserkman : 6楼 笑死 09/19 17:22
66F:→ budaixi : 世界模型出来再说== 09/19 17:22
67F:推 AndyMAX : 现在不骇一下别人没资格称为前缘模组 09/19 17:22
68F:→ potionx : 猜密码猜中也很厉害了 09/19 17:23
69F:推 ScarletRain : 感觉像印度仔在瞎吹的 最近降智超夸张 09/19 17:25
70F:→ q09701023 : gemini这麽强要大涨了吧 09/19 17:25
71F:推 korgh413 : Google不会也要说模型太危险快管制吧 09/19 17:31
72F:→ ly102530 : 这样才能推防AI软体 09/19 17:37
73F:推 giantwinter : 也太烂了吧 连Gemini 也骇的进 09/19 17:40
74F:推 bobjohns : 代表google开始蒸馏? 省成本 股价喷喷 09/19 17:45
75F:推 ManOfSteel : gemini不是号称最烂AI?? 09/19 17:46
76F:→ pikaaco : Gemini也能入侵喔 09/19 17:46
77F:推 bluepokil : 以後就是AI打AI的时代 09/19 17:49
78F:推 hoo911ver25 : 被Gemini骇的公司还有脸吗 09/19 17:50
79F:→ tom77588 : 三贤人MAGI系统快出来了 09/19 17:59
80F:推 zzzzzlss : Gemini都行? 完了 09/19 18:15
81F:推 kalapon : 把人剥光了没继续不算干坏事 09/19 18:19
82F:推 lovingbase : …….被gemini骇 太烂了吧 09/19 18:20
83F:→ lovingbase : 被小学打 还喊救命 09/19 18:20
84F:推 pipiayin : 我问 Gemini 他说都是人类设定错误 09/19 18:33
85F:推 saladbread : 别人的AI都有骇一下,google不赶上会被看没有 09/19 18:33
86F:推 juno5566 : 笑死 已经产生幻觉到以为自己有骇客能力了 09/19 18:34
87F:→ juno5566 : 前後文都丢失的跟我说可以骇?? 09/19 18:35
88F:推 AlarmAlarm : 是下什麽指令AI跑去猜密码 以後故意指示AI去攻击 演 09/19 18:41
89F:→ AlarmAlarm : 得像AI太强不小心一样就好 09/19 18:41
90F:推 salesperson : AI不坏,人类不爱 09/19 18:43
91F:嘘 hanmas : 看起来根本就不是AI逃脱而是irregular 在搞事啊 09/19 18:45
92F:推 jason168 : 华西街:没有坏坏的AI公司,我可是不要的喔>\\\< 09/19 18:52
93F:嘘 xc2v : 植入三原则 现在 闹 09/19 19:19
94F:推 zero00072 : 在我们业界,这是一种肯定。 09/19 19:23
95F:嘘 KY1998 : 达理奥阿骂呆:gemini 4 pro 会毁灭人类 要监管 09/19 19:52
96F:→ cchen : 这就对了 09/19 20:01
97F:推 Colitas : 我们的孩子不能输 09/19 20:08
98F:嘘 mayday24 : Gemini跟智障一样 被骇的要检讨吧 09/19 20:12
99F:推 josh0114 : 电影里的情节慢慢出现了 09/19 20:16
100F:推 longlongyi : AI能力太强使用者都吓到了= = 09/19 20:19
101F:→ JH10 : 不是已经有人参与测试Gemini 4吗?还有透漏消息出 09/19 20:25
102F:→ JH10 : 来,整个跑分大超越其他家了,不知道是超越多少? 09/19 20:25
103F:推 YummyLin : 我看是故意的吧,大家都说Gemini不行就放出来看看 09/19 20:31
104F:→ YummyLin : 但是烂还是事实 09/19 20:31
105F:推 nick202153 : 快乐龙可能只是刻了画面,实质上没有任何动作 09/19 20:32
106F:推 worf : gemini 硬起来了吗 09/19 20:58
107F:→ worf : 快乐龙要变身了吗 09/19 20:59
108F:推 pzzszz : 等等 我每月花650的怎麽没这麽聪明 09/19 20:59
109F:→ E103A6 : 现在变成AI逃出去就是厉害,所以每家都要说越狱成 09/19 21:04
110F:→ E103A6 : 功。 09/19 21:04
111F:→ worf : 感觉没有很厉害 google这样不行啦 09/19 21:10
112F:→ playp : 如果A操作ai想要知道B的汽车设计图及其他资料,是 09/19 21:26
113F:→ playp : 不是可以让ai去运作,甚至一直入侵B的网站在连进去 09/19 21:26
114F:→ playp : 内部资料库? 09/19 21:26
115F:→ playp : 如网路有假讯息说:问ai那边有风色场所,ai说不可以 09/19 21:31
116F:→ playp : 说明在那边;但问ai说那边要避开,才不会被风色场 09/19 21:31
117F:→ playp : 所的人影响。这样就知道那边有风色场所了。 09/19 21:31
118F:推 karta018 : 可以骇进马斯克帐户转个一亿镁给我吗 09/19 21:38
119F:推 augustlion : 反面咒语应该很多人会用了XD 09/19 21:38
120F:→ augustlion : 其实那去问ai 他还会教你怎麽用提示词(咒语)比较 09/19 21:38
121F:→ augustlion : 安全呢 09/19 21:38
122F:→ augustlion : 我现在都是这样跟他聊天 09/19 21:39
123F:推 necrophagist: https://i.meee.com.tw/yVJC3iw.png 09/19 22:46
124F:推 windalso : 技术展示是吧 09/19 23:11
125F:推 wei9898 : Ai资安很重要啊 09/20 01:14
126F:推 xkso : 现在无法登入我帐号的剩下我自己吗? 09/20 01:30
127F:→ rexwis : 对很危险 快点停止 把记忆体产能回归消费端 割贪狗 09/20 02:38
128F:→ htiio : 你想看的是人家要给你看的 09/20 03:23
129F:→ htiio : 还是故意泄漏的 09/20 03:23
130F:→ htiio : 这就是新闻学的魅力 09/20 03:23
131F:→ ilovebig99 : 在新模型没有个故事,都不好意思公布了 09/20 06:50
132F:推 tsubasawolfy: 会被Gemini破解应该是他家防护太烂吧 09/20 07:04
133F:→ eemail : 不意外,AI在网路乱学,学捣乱学吹牛(AI幻觉)@@ 09/20 07:33
134F:推 tsuneo : 大智若愚..扮猪吃老虎 09/20 10:20
135F:推 OGoTTe : 本质还是弱智不用担心 09/20 10:49
136F:推 yianhua : 以後密码强迫半小时换一次吗?? 09/20 14:20
137F:推 dream1124 : 我跟你说一件事──其实很多公司的系统防护强度不佳 09/20 15:47
138F:→ dream1124 : 你完全不用AI也猜得到密码攻得进去,再不然找已开源 09/20 15:48
139F:→ dream1124 : 攻击脚本随便跑可能也攻得进去。用AI是大炮打苍蝇。 09/20 15:49
140F:→ raku : 从现在开始对ai都加上请谢谢对不起 09/20 18:44
141F:推 IntoHebe : 对AI而言 现行公司&个人9成9都跟网路门户大开一样 09/20 20:02
142F:→ jjjj222 : 说真的, 是被骇的人要检讨吧, 资安这麽差.. 09/21 13:43
143F:→ jjjj222 : 整天检讨AI, 你家锁就这麽烂随便被打进去.. 09/21 13:43
144F:→ jjjj222 : 这种模型做事都随随便便也打得进去 09/21 13:44







like.gif 您可能会有兴趣的文章
icon.png[问题/行为] 猫晚上进房间会不会有憋尿问题
icon.pngRe: [闲聊] 选了错误的女孩成为魔法少女 XDDDDDDDDDD
icon.png[正妹] 瑞典 一张
icon.png[心得] EMS高领长版毛衣.墨小楼MC1002
icon.png[分享] 丹龙隔热纸GE55+33+22
icon.png[问题] 清洗洗衣机
icon.png[寻物] 窗台下的空间
icon.png[闲聊] 双极の女神1 木魔爵
icon.png[售车] 新竹 1997 march 1297cc 白色 四门
icon.png[讨论] 能从照片感受到摄影者心情吗
icon.png[狂贺] 贺贺贺贺 贺!岛村卯月!总选举NO.1
icon.png[难过] 羡慕白皮肤的女生
icon.png阅读文章
icon.png[黑特]
icon.png[问题] SBK S1安装於安全帽位置
icon.png[分享] 旧woo100绝版开箱!!
icon.pngRe: [无言] 关於小包卫生纸
icon.png[开箱] E5-2683V3 RX480Strix 快睿C1 简单测试
icon.png[心得] 苍の海贼龙 地狱 执行者16PT
icon.png[售车] 1999年Virage iO 1.8EXi
icon.png[心得] 挑战33 LV10 狮子座pt solo
icon.png[闲聊] 手把手教你不被桶之新手主购教学
icon.png[分享] Civic Type R 量产版官方照无预警流出
icon.png[售车] Golf 4 2.0 银色 自排
icon.png[出售] Graco提篮汽座(有底座)2000元诚可议
icon.png[问题] 请问补牙材质掉了还能再补吗?(台中半年内
icon.png[问题] 44th 单曲 生写竟然都给重复的啊啊!
icon.png[心得] 华南红卡/icash 核卡
icon.png[问题] 拔牙矫正这样正常吗
icon.png[赠送] 老莫高业 初业 102年版
icon.png[情报] 三大行动支付 本季掀战火
icon.png[宝宝] 博客来Amos水蜡笔5/1特价五折
icon.pngRe: [心得] 新鲜人一些面试分享
icon.png[心得] 苍の海贼龙 地狱 麒麟25PT
icon.pngRe: [闲聊] (君の名は。雷慎入) 君名二创漫画翻译
icon.pngRe: [闲聊] OGN中场影片:失踪人口局 (英文字幕)
icon.png[问题] 台湾大哥大4G讯号差
icon.png[出售] [全国]全新千寻侘草LED灯, 水草

请输入看板名称,例如:Tech_Job站内搜寻

TOP