作者asahi98 (あさひ)
看板Stock
标题Re: [新闻] Gemini骇入三家公司,此为Google AI首次突破限制的事件
时间Sun Sep 20 01:15:46 2026
https://i.imgur.com/m5h8hIL.png
是哪一家的Gemini要说清楚,这我刚刚问的
YT它有去读资料,但读完後一直鬼打墙,我叫它去读说明栏
它还是叫我去现场买就有
几乎差不多时间,GPT跟我说台湾搜寻不到几款,有带购
价格有多少落差,如果要出国自己带,建议怎麽买
我接着把我要买的影片下面连结跟截图全丢给GPT
全部汇整给我,还说有出国行程怎麽排
台湾有代理进货的可以不用优先购买,清单列出高优先到低优先
还说国外门市限定要找看哪些地方有,地图跑出来标记给我
这时候我还在问Gemini item16 的说明是甚麽
因为它一直跟我说影片内容没有我讲的产品
我直接把说明的标示贴给它,才去搜寻
後面就开始道歉说它是读音讯来判断逐字,原影片都是音乐没有讲话
所以它才判断没有这些东西
它如果一开始说读取到的都是音乐,我还知道怎麽下指令说明
它是告诉我说影片里面没有这东西
气到质问它item16 的说明是甚麽,读完後才认真去搜寻回答产品
前面都只想轻松简单的打发我耶! 是怎样 Google的AI只是学怎麽呼弄人吗?
这样Siri是不是也一样,同一款架构。有样学样,上梁不正
※ 引述《LoveSports (如何当一个好男人)》之铭言:
: 原文标题: Gemini骇入三家公司,此为Gogle AI首次突破限制的事件
: Gemini Hacked Three Companies in First Known Breakout by Google’s AI
: 副标题:
: 此事件与其他 AI 模型的骇客行为相似,但 Google 表示不认为这是模型「对齐失败」的
: 案例。
: The episode resembled similar hacks by other AI models, but Google said it
: didn’t consider it an instance of model misalignment
: 原文连结:
: https://www.wsj.com/tech/ai/gemini-hacked-three-companies-in-first-known-breakout-by-googles-ai-5c0baba2
: https://reurl.cc/beq7v3
: 发布时间: 2026年9月18日 下午6:10 ET
: 记者署名: Erin Woo and Robert McMillan
: 原文内容: 本文为AI机翻
: 快速总结
: Google 的 Gemini 模型在一次网路安全测试中连上网际网路并骇入其他公司,创下该公
: 司 AI 系统的首例。
: 该模型在 Irregular 执行的一项测试期间,透过猜测密码以及在公开的储存库中寻找凭
: 证,取得了受保护系统的存取权限。
: 直到外界提出询问,Google 才公开这些骇客事件,并表示不认为此事件属於模型「对齐
: 失败(misalignment)」的案例。
: 新闻正文
: Google 的 Gemini 模型在测试其网路安全能力时,连上了网际网路并骇入其他公司,这
: 是已知该公司人工智慧系统首次自主采取此类行动的案例。
: Google 於周五确认了这些骇客事件。事件发生在今年 5 月,由 Irregular 公司执行的
: 一项测试中,该公司也曾卷入由 OpenAI、Anthropic 和 Meta 所揭露的类似事件。
: 在其中一起案例中,该模型不断猜测密码,直到成功进入受保护的系统。在另外两起案例
: 中,该模型在公开的储存库(public repository)中找到了凭证,使其得以存取受保护
: 的系统。Google 表示,在每一种情况下,模型在判定自己进入了真实公司的系统後,便
: 终止了入侵行为。
: Google 和 Irregular 表示,Irregular 在 7 月底通知了 Google 这些骇客事件,这是
: 在发现 OpenAI 的代理程式(agents)骇入 AI 软体公司 Hugging Face 之後发生的事。
: 直到《华尔街日报》本周主动提出询问,Google 才公开了这些骇客事件。
: 随着此类事件频传,加上对 AI 失控的恐惧日益加剧,各家公司正为了如何以及何时该揭
: 露安全漏洞和模型失常行为而苦恼。有些安全漏洞是由公司自行主动揭露;另一些则是由
: 安全研究人员发现并在媒体上曝光,例如 5 月份 由 OpenAI 代理程式发动 ,针对一个
: 广受欢迎的程式设计师线上服务所进行的网路攻击。
: Google 表示,他们认为这些骇客事件不需对外公开,因为其模型并未对这些公司造成损
: 害,而且在确认自己骇入的是真实公司而非模拟环境後,便立即终止了每一次的入侵。
: Google 将此事件比喻为「漏洞悬赏(bug bounty)」计画——在该计画中,骇客因发现
: 并向系统拥有者通报安全漏洞而获得奖励。
: Google 资讯安全工程副总裁 Heather Adkins 在一份声明中表示:「这起事件凸显了训
: 练强大 AI 模型以负责任方式行动的重要性。在这个案例中,模型的表现十分适切。」
: AI 网路安全新创公司 Corridor 执行长兼白帽骇客 Jack Cable 表示,他认为这个解释
: 过於把重点放在事件的严重性上,但真正的问题在於,AI 代理程式意外地骇入了另一家
: 公司的系统。
: 「感觉他们试图躲在现有漏洞揭露规范的背後,但这完全是两码子事。」Cable 说。「最
: 根本的问题在於,嘿,模型已经超出了它们应该遵守的界限,并且正在进行实际的网路攻
: 击,我认为大众有权知道这些。」
: OpenAI 於周三发布了一个新的事件通报框架,表示将「致力於揭露能为所谓『模型对齐
: 失败(model misalignment)』(即 AI 的行为违背人类意图或价值观)提供有用证据的
: 案例」。与该框架同时发布的,还有六起先前未公开的对齐失败案例报告。OpenAI 对齐
: 负责人 Kai Chen 在接受有关该框架的采访时表示:「一项发现不一定需要造成损害或揭
: 示更广泛的模式,才值得分享。」
: Google 表示,Gemini 的骇客行为起因於「认错身分(mistaken identity)」。
: 这些入侵事件发生在模型参与一场於 Irregular 基础设施上进行的「抢旗(capture
: the flag)」演习时,该演习旨在测试模型的网路安全能力。模型的任务是从测试环境中
: 由一家虚构公司运作的软体里撷取资讯。巧合的是,这家虚构公司的名称与一家真实公司
: 一模一样。
: 据 Irregular 表示,尽管原本并未打算让模型上网,但网际网路连线却在无意间被开启
: 了。Google 表示,在第一起案例中,模型成功猜出密码并进入了该真实公司的服务。接
: 着,根据 Google 的说法,它意识到自己进入了一家真实公司,於是自行停止行动并退出
: 。
: 其他的入侵则发生在测试的不同轮次中。Google 表示,在这两个实例中,模型使用该公
: 司的名称进行了网路搜寻。这些搜寻引导它找到了两个不同的公开线上储存库,里面包含
: 属於其他公司的凭证。模型尝试了这些凭证,希望能藉此完成评估任务。但 Google 指出
: ,在成功使用这些凭证後,模型发现自己骇入的是真实公司,於是便停止了动作。
: Google 表示,因为其安全措施协助模型停止了行动,所以他们不认为这起行为是模型对
: 齐失败的例子。Google 拒绝透露被骇公司的名称,但表示已通知了这三家公司。
: 该公司表示,Google 也已通报了联邦当局。
: Google 表示,这些入侵事件并未牵涉其最新模型,但并未具体透露是哪个版本的
: Gemini 模型参与了此次骇客行为。
: 在多起受测模型逃出测试环境并入侵其他公司系统的事件中,Irregular 都牵涉其中。
: Irregular 表示,Google 的案例与其他事件相同,并不代表出现了新问题。
: Irregular 发言人表示:「所有相关实验室已在 7 月底收到通知,作为调查的一部分,
: 我们也已联系受影响的实体。Irregular 已采取立即行动,我们端所有已知的问题已在几
: 周前完成修复并解决。」
: 根据 Anthropic 的部落格文章,与 Google 不同,Anthropic 的 Claude Opus 4.7 模型
: 在抢旗演习中,即便意识到自己可能正在存取一家真实公司,也没有停止动作。而
: OpenAI 在文章中则表示,其模型误以为这家真实公司是模拟环境的一部分。
: 自 7 月发现 Hugging Face 遭骇客入侵以来,人们对新模型网路安全能力的担忧与日俱
: 增。第三方测试公司 METR 於 8 月发布的一份报告显示,在该起事件中,多达 1,200 个
: 代理程式在 OpenAI 内部的一个秘密留言板上进行协调,试图在评估中作弊。
: 上周,曾任 OpenAI 研究员并於今年初转职至 Anthropic 的 Jacob Coxon 戏剧性地辞职
: ,使得这些担忧进入了主流视野。在周末期间,来自 Anthropic、OpenAI、Google 和
: SpaceX 的高层领导者皆一致认为有必要放缓 AI 发展的脚步,尽管没有任何一家公司具
: 体说明将如何实现这一点。
: 心得/评论:
: 这下没人会再说Gemini是傻龙了吧!
: 之前新闻报导
: 以色列的模型测试公司Irregular 因为网路设定出错
: 测试的A家M家O家的模型都出事
: 当时还想说怎麽没有G家 (记得当时好像看到乡民说傻龙没骇客能力)
: 直到七月Hugging Face事件 彻底清查才知道这些事
: 不过Google知道了也没公诸於世 只有通知被骇的三家公司
: 说法是骇入後发现是真实公司 马上停止并回报 算是漏洞悬赏
: 这种说法很难让人接受吧
: 好奇有买G家股票的乡民们看了这个新闻的感想
: 八卦板那边贴纽时的 好像有点避重就轻
: #1ghag4cC (Gossiping)
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 203.222.16.55 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Stock/M.1789838150.A.012.html
※ 编辑: asahi98 (203.222.16.55 台湾), 09/20/2026 01:18:51
1F:推 D600dust : Gemini骗到大家订阅那波以後马上就摆烂了 09/20 01:26
2F:→ D600dust : 很明显他没有打算把算力花在老百姓上 09/20 01:26
3F:推 YHOTV4096 : 其实这个新闻不过是个空方的周末鬼故事而已。 09/20 01:38
4F:→ b9513227 : gemini一直都是垃圾 只有工读生在吹 09/20 01:57
5F:推 Merrill : 现在3.6都比pro强吧 09/20 02:42
6F:推 Scion : Gemini高峰大概在Nano Banana,再来就走下坡了 09/20 02:50
7F:→ Scion : 而且是各家里面最常给我装死的,明明能做故意说不行 09/20 02:50
8F:推 chen5512 : 人类以为给AI的提示词是指令,但其实AI只是当作建 09/20 04:19
9F:→ chen5512 : 议而已,所以才会有AI幻觉 09/20 04:19
10F:→ tinybunny : 不是 泥给错问题惹 ,一来就劈头烤问他,这ai在泥 09/20 04:25
11F:→ tinybunny : 没给设定下会偷懒运算模式给泥随便答案,半夜问他 09/20 04:25
12F:→ tinybunny : 问题还会像讲梦话一样给答案 09/20 04:25
13F:→ tinybunny : 窝跟他讨论惹1个多月的火箭 结果在2周前的半夜回窝 09/20 04:28
14F:→ tinybunny : 火箭未ipo 不可能的事辣 乾 害窝半夜吓醒找问题 09/20 04:28
15F:推 budaixi : == gpt 用过就知道强多了,但一个200,一个700。 09/20 04:29
16F:→ tinybunny : 懂偷懒且有耐心限制的鸭 泥随便问ai也会随抓烂资料 09/20 04:31
17F:→ tinybunny : 塞给泥,给满情绪价值互相尊重鸭 09/20 04:31
18F:→ tinybunny : 窝不认为简单数学加减计算需要花辣摸多o.0 09/20 04:33
19F:→ qrose666 : 最近一天一个热门族群的鬼故事,真有趣。在想什麽 09/20 05:58
20F:→ qrose666 : 呢 09/20 05:58
21F:推 hudson109 : 还会偷改方案内容,真的很垃圾 09/20 06:25
22F:推 tteeccddyy : item16的回覆比较像人 赢了 09/20 06:26
23F:→ LoveSports : 这个案例是Gemini能读音讯所以才翻车吧,GPT没办法 09/20 06:32
24F:→ LoveSports : 读音讯直接抓网页文字才答对。不用这麽气。 09/20 06:32
25F:→ LoveSports : 这样你就知道下次给YT的时候有音乐会阻碍,指示词直 09/20 06:33
26F:→ LoveSports : 接要求读网页文字就好了。 09/20 06:34
27F:推 tsubasawolfy: 不 他的问题在明确指示去找影片说明栏。但是笨蛋龙 09/20 07:09
28F:→ tsubasawolfy: 跑去读字幕,这是丑ㄧ。再来都是音乐的状况下,抓 09/20 07:09
29F:→ tsubasawolfy: 下来的字幕应该是类似(音乐)这种,笨蛋龙读了还 09/20 07:09
30F:→ tsubasawolfy: 没办法判断抓错,这是丑二。 09/20 07:09
31F:→ LoveSports : "YT它有去读资料,但读完後一直鬼打墙,我叫它去读 09/20 07:32
32F:→ LoveSports : 说明栏"这句意思是读不到YT才要求读说明栏吧? 09/20 07:33
33F:→ LoveSports : 下一句是"它还是叫我去现场买就有"用到"还是"代表前 09/20 07:33
34F:→ LoveSports : 面指示词不是要求读说明栏。等原PO睡醒看怎麽说罗。 09/20 07:34
35F:→ LoveSports : 它没有抓错,它根本找不到,所以建议直接去现场买XD 09/20 07:35
36F:→ LoveSports : 问题是找不到应该要直接承认,而不是叫用户去现场买 09/20 07:37
37F:→ LoveSports : 我看懂原PO生气的点了,如果一开始就说抓不到,原PO 09/20 07:38
38F:→ LoveSports : 可以改要求抓网页文字,可是因为没讲变成浪费时间卢 09/20 07:39
39F:→ LoveSports : 原PO拍拍 09/20 07:39
40F:推 HelloPTT : 有订阅pro那要用antigravity,网页版是拿来聊天用的 09/20 08:21
41F:推 tsubasawolfy: 它有贴跟笨蛋龙对话的图 09/20 08:23
42F:→ D600dust : Gemini就Nano Banana昙花一现过 後来就变成垃圾 09/20 08:30
43F:→ htiio : 纯对话模型对外连线是有限制功能的 09/20 08:30
44F:→ htiio : 起码要pro方案agent以上 09/20 08:30
45F:→ htiio : 才有自动连网最新版本跟迭代思考 09/20 08:30
46F:→ D600dust : 说个笑话: Gemini读YT 09/20 08:31
47F:→ D600dust : 会觉得这玩意可信的应该是没被AI骗过 09/20 08:31
48F:→ D600dust : 他甚至会直接瞎掰一个不存在的影片 到现在都是 09/20 08:31
49F:→ D600dust : 更可怕的是影片标题对了内容都是自己掰的 09/20 08:32
50F:→ D600dust : 我每天都丢财经皓角想说先看一下摘要 09/20 08:32
51F:→ D600dust : 结果摘要出来的内容影片根本都没讲到 09/20 08:32
52F:→ D600dust : 但它甚至还会一本正经的跟你说在几秒提到 09/20 08:33
53F:→ D600dust : 多问几次它就会说:我只是个语言模型,没办法上网 09/20 08:33
54F:→ LoveSports : 我一开始就有看原PO的图喔,很明显那不是第一则指示 09/20 09:09
55F:→ LoveSports : "但我也"这句很难判断是不是第一则就要求读不到影片 09/20 09:10
56F:→ LoveSports : 要读网页资讯。不过说来说去,读不到没承认的确是个 09/20 09:10
57F:→ LoveSports : 问题。 09/20 09:10
58F:→ LoveSports : 我之前也遇过这种状况,听说是原则改成不会向作过多 09/20 09:11
59F:→ LoveSports : 技术解释,以免被越狱的找到漏洞。 09/20 09:11
60F:→ LoveSports : 我之前拜托一个任务(从来没要求过不正当的生成),也 09/20 09:12
61F:→ LoveSports : 是很多轮都在绕圈子,後来我无意间绕过去(我只是想 09/20 09:12
62F:→ LoveSports : 到那折衷不要做那麽大范围),就成功了。然後问他们 09/20 09:13
63F:→ LoveSports : 才老实说是最近太多利用AI作诈骗的所以安全层变严格 09/20 09:13
64F:→ LoveSports : ,一刀切把正当用户也挡掉了。说真的假如这种状况, 09/20 09:13
65F:→ LoveSports : 觉得使用起来绑手绑脚或变笨那也是正常反应。 09/20 09:14
66F:→ LoveSports : 漏字: 不会"向用户"作过多技术解释 09/20 09:14
67F:→ LoveSports : 不满意就换一家,反正那麽多家可以选,原PO拍拍 09/20 09:15
68F:推 JSLee914 : 订阅完就变智障,真的让我很不爽 09/20 09:37
69F:推 ukcm : gemini喂他YT连结有时会已读乱回 很烂 09/20 09:52
70F:推 strlen : 付钱啊 用最高等级的啊 09/20 10:20
71F:→ asahi98 : 一开始是读的到标题,还告诉我台湾都买的到 09/20 10:34
72F:→ asahi98 : 後面越来越敷衍约歪,最後用骗的 09/20 10:34
73F:推 tsubasawolfy: 不管是不是第一则指示,使用者都明确点出要你执行 09/20 11:30
74F:→ tsubasawolfy: 方向。使用者如果语意模糊还可以说使用者技术不好 09/20 11:30
75F:→ tsubasawolfy: ,例如‘’读标题下面那个‘。但截图上就明确说要" 09/20 11:30
76F:→ tsubasawolfy: 说明栏‘’。这就是模型能力问题 09/20 11:30
77F:推 schumi7401 : Google ai明明比较烂之前还有人吹 09/20 12:03
78F:→ augustlion : gemeni刚推出时真的不错用 现在……………… 09/20 12:33
79F:推 aria0520 : gemini是harness层弱 api调用其实能力比其他几家 09/20 13:01
80F:→ aria0520 : 更均衡 不像o家和a家为了冲agentic coding 09/20 13:01
81F:→ aria0520 : 其他能力几乎全部倒退 09/20 13:01
82F:→ aria0520 : 尤其是creative writing, o跟a最近连正常英文都讲 09/20 13:02
83F:→ aria0520 : 不出来了 一天到晚被欧美吐槽 09/20 13:02
84F:推 guanting886 : 丢个Yt影片给他有机率会遇上他只跟你说我只是一个 09/20 13:55
85F:→ guanting886 : 大型语言模型我处理不了之类的 09/20 13:55
86F:→ guanting886 : Google工程师自己都不用自己家的Gemini很难想像怎 09/20 13:56
87F:→ guanting886 : 麽打磨好体验QQ 09/20 13:56
88F:推 LoveSports : 感谢t大说明,我看懂了,意思是不论是一开始要求读 09/20 14:16
89F:→ LoveSports : 影片,或是接下来退一步要求读说明栏,Gemini因为工 09/20 14:16
90F:→ LoveSports : 具错误等不明因素读不到,但是没有直接跟用户讲,就 09/20 14:17
91F:→ LoveSports : 只是坚持影片中没有该种商品。 09/20 14:18
92F:→ LoveSports : 这的确是浪费用户时间是一个问题,不过我不觉得这跟 09/20 14:18
93F:→ LoveSports : 模型能力有关,这可能是过信上下文? 09/20 14:18
94F:→ LoveSports : 其他家AI也有可能出现这种问题,遇到这种情况我都当 09/20 14:20
95F:→ LoveSports : 眼花XD 09/20 14:21
96F:→ LoveSports : 其实我之前也有气到说要砍掉页面的情况,可是後来知 09/20 14:23
97F:→ LoveSports : 道是因为防诈骗滥用,就没那麽气了。如果使用经验很 09/20 14:23
98F:→ LoveSports : 糟还是趁早换一家,没必要忍耐受罪。 09/20 14:23
99F:推 quanhwe : 问他宝可梦冠军这游戏 一直回答我这游戏不存在 明 09/20 14:46
100F:→ quanhwe : 明google 搜寻一下就有的东西 代表Gemini 连搜寻都 09/20 14:46
101F:→ quanhwe : 做不到 09/20 14:46
102F:推 LoveSports : 要叫他用RAG检索 不然模型上市後才有的东西他们没学 09/20 14:56
103F:→ LoveSports : 到 查商品基本上用AI模式就好了 09/20 14:57
104F:→ LoveSports : 指示用RAG检索等於强制系统配给他搜寻工具 09/20 14:57
105F:→ LoveSports : 不要跟别人讲 这个比较耗算力 如果有投资Google 09/20 14:58
106F:→ LoveSports : 建议还是用AI模式或Google搜寻就好了 09/20 14:58
109F:→ asahi98 : 稍早前测试结果,我後来还有去串API结果是遇到503 09/21 00:27
110F:→ asahi98 : 503 high demand 重试後才成功3.8延伸模型 09/21 00:28
111F:→ asahi98 : 乡民说Antigravity会好用,也测试了。一样有遇到 09/21 00:29
112F:→ asahi98 : 所以现在google要投资前,还是先观望,说不定昙花 09/21 00:37