作者asahi98 (あさひ)
看板Stock
標題Re: [新聞] Gemini駭入三家公司,此為Google AI首次突破限制的事件
時間Sun Sep 20 01:15:46 2026
https://i.imgur.com/m5h8hIL.png
是哪一家的Gemini要說清楚,這我剛剛問的
YT它有去讀資料,但讀完後一直鬼打牆,我叫它去讀說明欄
它還是叫我去現場買就有
幾乎差不多時間,GPT跟我說台灣搜尋不到幾款,有帶購
價格有多少落差,如果要出國自己帶,建議怎麼買
我接著把我要買的影片下面連結跟截圖全丟給GPT
全部彙整給我,還說有出國行程怎麼排
台灣有代理進貨的可以不用優先購買,清單列出高優先到低優先
還說國外門市限定要找看哪些地方有,地圖跑出來標記給我
這時候我還在問Gemini item16 的說明是甚麼
因為它一直跟我說影片內容沒有我講的產品
我直接把說明的標示貼給它,才去搜尋
後面就開始道歉說它是讀音訊來判斷逐字,原影片都是音樂沒有講話
所以它才判斷沒有這些東西
它如果一開始說讀取到的都是音樂,我還知道怎麼下指令說明
它是告訴我說影片裡面沒有這東西
氣到質問它item16 的說明是甚麼,讀完後才認真去搜尋回答產品
前面都只想輕鬆簡單的打發我耶! 是怎樣 Google的AI只是學怎麼呼弄人嗎?
這樣Siri是不是也一樣,同一款架構。有樣學樣,上梁不正
※ 引述《LoveSports (如何當一個好男人)》之銘言:
: 原文標題: Gemini駭入三家公司,此為Gogle AI首次突破限制的事件
: Gemini Hacked Three Companies in First Known Breakout by Google’s AI
: 副標題:
: 此事件與其他 AI 模型的駭客行為相似,但 Google 表示不認為這是模型「對齊失敗」的
: 案例。
: The episode resembled similar hacks by other AI models, but Google said it
: didn’t consider it an instance of model misalignment
: 原文連結:
: https://www.wsj.com/tech/ai/gemini-hacked-three-companies-in-first-known-breakout-by-googles-ai-5c0baba2
: https://reurl.cc/beq7v3
: 發布時間: 2026年9月18日 下午6:10 ET
: 記者署名: Erin Woo and Robert McMillan
: 原文內容: 本文為AI機翻
: 快速總結
: Google 的 Gemini 模型在一次網路安全測試中連上網際網路並駭入其他公司,創下該公
: 司 AI 系統的首例。
: 該模型在 Irregular 執行的一項測試期間,透過猜測密碼以及在公開的儲存庫中尋找憑
: 證,取得了受保護系統的存取權限。
: 直到外界提出詢問,Google 才公開這些駭客事件,並表示不認為此事件屬於模型「對齊
: 失敗(misalignment)」的案例。
: 新聞正文
: Google 的 Gemini 模型在測試其網路安全能力時,連上了網際網路並駭入其他公司,這
: 是已知該公司人工智慧系統首次自主採取此類行動的案例。
: Google 於週五確認了這些駭客事件。事件發生在今年 5 月,由 Irregular 公司執行的
: 一項測試中,該公司也曾捲入由 OpenAI、Anthropic 和 Meta 所揭露的類似事件。
: 在其中一起案例中,該模型不斷猜測密碼,直到成功進入受保護的系統。在另外兩起案例
: 中,該模型在公開的儲存庫(public repository)中找到了憑證,使其得以存取受保護
: 的系統。Google 表示,在每一種情況下,模型在判定自己進入了真實公司的系統後,便
: 終止了入侵行為。
: Google 和 Irregular 表示,Irregular 在 7 月底通知了 Google 這些駭客事件,這是
: 在發現 OpenAI 的代理程式(agents)駭入 AI 軟體公司 Hugging Face 之後發生的事。
: 直到《華爾街日報》本週主動提出詢問,Google 才公開了這些駭客事件。
: 隨著此類事件頻傳,加上對 AI 失控的恐懼日益加劇,各家公司正為了如何以及何時該揭
: 露安全漏洞和模型失常行為而苦惱。有些安全漏洞是由公司自行主動揭露;另一些則是由
: 安全研究人員發現並在媒體上曝光,例如 5 月份 由 OpenAI 代理程式發動 ,針對一個
: 廣受歡迎的程式設計師線上服務所進行的網路攻擊。
: Google 表示,他們認為這些駭客事件不需對外公開,因為其模型並未對這些公司造成損
: 害,而且在確認自己駭入的是真實公司而非模擬環境後,便立即終止了每一次的入侵。
: Google 將此事件比喻為「漏洞懸賞(bug bounty)」計畫——在該計畫中,駭客因發現
: 並向系統擁有者通報安全漏洞而獲得獎勵。
: Google 資訊安全工程副總裁 Heather Adkins 在一份聲明中表示:「這起事件凸顯了訓
: 練強大 AI 模型以負責任方式行動的重要性。在這個案例中,模型的表現十分適切。」
: AI 網路安全新創公司 Corridor 執行長兼白帽駭客 Jack Cable 表示,他認為這個解釋
: 過於把重點放在事件的嚴重性上,但真正的問題在於,AI 代理程式意外地駭入了另一家
: 公司的系統。
: 「感覺他們試圖躲在現有漏洞揭露規範的背後,但這完全是兩碼子事。」Cable 說。「最
: 根本的問題在於,嘿,模型已經超出了它們應該遵守的界限,並且正在進行實際的網路攻
: 擊,我認為大眾有權知道這些。」
: OpenAI 於週三發布了一個新的事件通報框架,表示將「致力於揭露能為所謂『模型對齊
: 失敗(model misalignment)』(即 AI 的行為違背人類意圖或價值觀)提供有用證據的
: 案例」。與該框架同時發布的,還有六起先前未公開的對齊失敗案例報告。OpenAI 對齊
: 負責人 Kai Chen 在接受有關該框架的採訪時表示:「一項發現不一定需要造成損害或揭
: 示更廣泛的模式,才值得分享。」
: Google 表示,Gemini 的駭客行為起因於「認錯身分(mistaken identity)」。
: 這些入侵事件發生在模型參與一場於 Irregular 基礎設施上進行的「搶旗(capture
: the flag)」演習時,該演習旨在測試模型的網路安全能力。模型的任務是從測試環境中
: 由一家虛構公司運作的軟體裡擷取資訊。巧合的是,這家虛構公司的名稱與一家真實公司
: 一模一樣。
: 據 Irregular 表示,儘管原本並未打算讓模型上網,但網際網路連線卻在無意間被開啟
: 了。Google 表示,在第一起案例中,模型成功猜出密碼並進入了該真實公司的服務。接
: 著,根據 Google 的說法,它意識到自己進入了一家真實公司,於是自行停止行動並退出
: 。
: 其他的入侵則發生在測試的不同輪次中。Google 表示,在這兩個實例中,模型使用該公
: 司的名稱進行了網路搜尋。這些搜尋引導它找到了兩個不同的公開線上儲存庫,裡面包含
: 屬於其他公司的憑證。模型嘗試了這些憑證,希望能藉此完成評估任務。但 Google 指出
: ,在成功使用這些憑證後,模型發現自己駭入的是真實公司,於是便停止了動作。
: Google 表示,因為其安全措施協助模型停止了行動,所以他們不認為這起行為是模型對
: 齊失敗的例子。Google 拒絕透露被駭公司的名稱,但表示已通知了這三家公司。
: 該公司表示,Google 也已通報了聯邦當局。
: Google 表示,這些入侵事件並未牽涉其最新模型,但並未具體透露是哪個版本的
: Gemini 模型參與了此次駭客行為。
: 在多起受測模型逃出測試環境並入侵其他公司系統的事件中,Irregular 都牽涉其中。
: Irregular 表示,Google 的案例與其他事件相同,並不代表出現了新問題。
: Irregular 發言人表示:「所有相關實驗室已在 7 月底收到通知,作為調查的一部分,
: 我們也已聯繫受影響的實體。Irregular 已採取立即行動,我們端所有已知的問題已在幾
: 週前完成修復並解決。」
: 根據 Anthropic 的部落格文章,與 Google 不同,Anthropic 的 Claude Opus 4.7 模型
: 在搶旗演習中,即便意識到自己可能正在存取一家真實公司,也沒有停止動作。而
: OpenAI 在文章中則表示,其模型誤以為這家真實公司是模擬環境的一部分。
: 自 7 月發現 Hugging Face 遭駭客入侵以來,人們對新模型網路安全能力的擔憂與日俱
: 增。第三方測試公司 METR 於 8 月發布的一份報告顯示,在該起事件中,多達 1,200 個
: 代理程式在 OpenAI 內部的一個秘密留言板上進行協調,試圖在評估中作弊。
: 上週,曾任 OpenAI 研究員並於今年初轉職至 Anthropic 的 Jacob Coxon 戲劇性地辭職
: ,使得這些擔憂進入了主流視野。在週末期間,來自 Anthropic、OpenAI、Google 和
: SpaceX 的高層領導者皆一致認為有必要放緩 AI 發展的腳步,儘管沒有任何一家公司具
: 體說明將如何實現這一點。
: 心得/評論:
: 這下沒人會再說Gemini是傻龍了吧!
: 之前新聞報導
: 以色列的模型測試公司Irregular 因為網路設定出錯
: 測試的A家M家O家的模型都出事
: 當時還想說怎麼沒有G家 (記得當時好像看到鄉民說傻龍沒駭客能力)
: 直到七月Hugging Face事件 徹底清查才知道這些事
: 不過Google知道了也沒公諸於世 只有通知被駭的三家公司
: 說法是駭入後發現是真實公司 馬上停止並回報 算是漏洞懸賞
: 這種說法很難讓人接受吧
: 好奇有買G家股票的鄉民們看了這個新聞的感想
: 八卦板那邊貼紐時的 好像有點避重就輕
: #1ghag4cC (Gossiping)
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 203.222.16.55 (臺灣)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/Stock/M.1789838150.A.012.html
※ 編輯: asahi98 (203.222.16.55 臺灣), 09/20/2026 01:18:51
1F:推 D600dust : Gemini騙到大家訂閱那波以後馬上就擺爛了 09/20 01:26
2F:→ D600dust : 很明顯他沒有打算把算力花在老百姓上 09/20 01:26
3F:推 YHOTV4096 : 其實這個新聞不過是個空方的週末鬼故事而已。 09/20 01:38
4F:→ b9513227 : gemini一直都是垃圾 只有工讀生在吹 09/20 01:57
5F:推 Merrill : 現在3.6都比pro強吧 09/20 02:42
6F:推 Scion : Gemini高峰大概在Nano Banana,再來就走下坡了 09/20 02:50
7F:→ Scion : 而且是各家裡面最常給我裝死的,明明能做故意說不行 09/20 02:50
8F:推 chen5512 : 人類以為給AI的提示詞是指令,但其實AI只是當作建 09/20 04:19
9F:→ chen5512 : 議而已,所以才會有AI幻覺 09/20 04:19
10F:→ tinybunny : 不是 泥給錯問題惹 ,一來就劈頭烤問他,這ai在泥 09/20 04:25
11F:→ tinybunny : 沒給設定下會偷懶運算模式給泥隨便答案,半夜問他 09/20 04:25
12F:→ tinybunny : 問題還會像講夢話一樣給答案 09/20 04:25
13F:→ tinybunny : 窩跟他討論惹1個多月的火箭 結果在2周前的半夜回窩 09/20 04:28
14F:→ tinybunny : 火箭未ipo 不可能的事辣 乾 害窩半夜嚇醒找問題 09/20 04:28
15F:推 budaixi : == gpt 用過就知道強多了,但一個200,一個700。 09/20 04:29
16F:→ tinybunny : 懂偷懶且有耐心限制的鴨 泥隨便問ai也會隨抓爛資料 09/20 04:31
17F:→ tinybunny : 塞給泥,給滿情緒價值互相尊重鴨 09/20 04:31
18F:→ tinybunny : 窩不認為簡單數學加減計算需要花辣摸多o.0 09/20 04:33
19F:→ qrose666 : 最近一天一個熱門族群的鬼故事,真有趣。在想什麼 09/20 05:58
20F:→ qrose666 : 呢 09/20 05:58
21F:推 hudson109 : 還會偷改方案內容,真的很垃圾 09/20 06:25
22F:推 tteeccddyy : item16的回覆比較像人 贏了 09/20 06:26
23F:→ LoveSports : 這個案例是Gemini能讀音訊所以才翻車吧,GPT沒辦法 09/20 06:32
24F:→ LoveSports : 讀音訊直接抓網頁文字才答對。不用這麼氣。 09/20 06:32
25F:→ LoveSports : 這樣你就知道下次給YT的時候有音樂會阻礙,指示詞直 09/20 06:33
26F:→ LoveSports : 接要求讀網頁文字就好了。 09/20 06:34
27F:推 tsubasawolfy: 不 他的問題在明確指示去找影片說明欄。但是笨蛋龍 09/20 07:09
28F:→ tsubasawolfy: 跑去讀字幕,這是醜ㄧ。再來都是音樂的狀況下,抓 09/20 07:09
29F:→ tsubasawolfy: 下來的字幕應該是類似(音樂)這種,笨蛋龍讀了還 09/20 07:09
30F:→ tsubasawolfy: 沒辦法判斷抓錯,這是醜二。 09/20 07:09
31F:→ LoveSports : "YT它有去讀資料,但讀完後一直鬼打牆,我叫它去讀 09/20 07:32
32F:→ LoveSports : 說明欄"這句意思是讀不到YT才要求讀說明欄吧? 09/20 07:33
33F:→ LoveSports : 下一句是"它還是叫我去現場買就有"用到"還是"代表前 09/20 07:33
34F:→ LoveSports : 面指示詞不是要求讀說明欄。等原PO睡醒看怎麼說囉。 09/20 07:34
35F:→ LoveSports : 它沒有抓錯,它根本找不到,所以建議直接去現場買XD 09/20 07:35
36F:→ LoveSports : 問題是找不到應該要直接承認,而不是叫用戶去現場買 09/20 07:37
37F:→ LoveSports : 我看懂原PO生氣的點了,如果一開始就說抓不到,原PO 09/20 07:38
38F:→ LoveSports : 可以改要求抓網頁文字,可是因為沒講變成浪費時間盧 09/20 07:39
39F:→ LoveSports : 原PO拍拍 09/20 07:39
40F:推 HelloPTT : 有訂閱pro那要用antigravity,網頁版是拿來聊天用的 09/20 08:21
41F:推 tsubasawolfy: 它有貼跟笨蛋龍對話的圖 09/20 08:23
42F:→ D600dust : Gemini就Nano Banana曇花一現過 後來就變成垃圾 09/20 08:30
43F:→ htiio : 純對話模型對外連線是有限制功能的 09/20 08:30
44F:→ htiio : 起碼要pro方案agent以上 09/20 08:30
45F:→ htiio : 才有自動連網最新版本跟迭代思考 09/20 08:30
46F:→ D600dust : 說個笑話: Gemini讀YT 09/20 08:31
47F:→ D600dust : 會覺得這玩意可信的應該是沒被AI騙過 09/20 08:31
48F:→ D600dust : 他甚至會直接瞎掰一個不存在的影片 到現在都是 09/20 08:31
49F:→ D600dust : 更可怕的是影片標題對了內容都是自己掰的 09/20 08:32
50F:→ D600dust : 我每天都丟財經皓角想說先看一下摘要 09/20 08:32
51F:→ D600dust : 結果摘要出來的內容影片根本都沒講到 09/20 08:32
52F:→ D600dust : 但它甚至還會一本正經的跟你說在幾秒提到 09/20 08:33
53F:→ D600dust : 多問幾次它就會說:我只是個語言模型,沒辦法上網 09/20 08:33
54F:→ LoveSports : 我一開始就有看原PO的圖喔,很明顯那不是第一則指示 09/20 09:09
55F:→ LoveSports : "但我也"這句很難判斷是不是第一則就要求讀不到影片 09/20 09:10
56F:→ LoveSports : 要讀網頁資訊。不過說來說去,讀不到沒承認的確是個 09/20 09:10
57F:→ LoveSports : 問題。 09/20 09:10
58F:→ LoveSports : 我之前也遇過這種狀況,聽說是原則改成不會向作過多 09/20 09:11
59F:→ LoveSports : 技術解釋,以免被越獄的找到漏洞。 09/20 09:11
60F:→ LoveSports : 我之前拜託一個任務(從來沒要求過不正當的生成),也 09/20 09:12
61F:→ LoveSports : 是很多輪都在繞圈子,後來我無意間繞過去(我只是想 09/20 09:12
62F:→ LoveSports : 到那折衷不要做那麼大範圍),就成功了。然後問他們 09/20 09:13
63F:→ LoveSports : 才老實說是最近太多利用AI作詐騙的所以安全層變嚴格 09/20 09:13
64F:→ LoveSports : ,一刀切把正當用戶也擋掉了。說真的假如這種狀況, 09/20 09:13
65F:→ LoveSports : 覺得使用起來綁手綁腳或變笨那也是正常反應。 09/20 09:14
66F:→ LoveSports : 漏字: 不會"向用戶"作過多技術解釋 09/20 09:14
67F:→ LoveSports : 不滿意就換一家,反正那麼多家可以選,原PO拍拍 09/20 09:15
68F:推 JSLee914 : 訂閱完就變智障,真的讓我很不爽 09/20 09:37
69F:推 ukcm : gemini餵他YT連結有時會已讀亂回 很爛 09/20 09:52
70F:推 strlen : 付錢啊 用最高等級的啊 09/20 10:20
71F:→ asahi98 : 一開始是讀的到標題,還告訴我臺灣都買的到 09/20 10:34
72F:→ asahi98 : 後面越來越敷衍約歪,最後用騙的 09/20 10:34
73F:推 tsubasawolfy: 不管是不是第一則指示,使用者都明確點出要你執行 09/20 11:30
74F:→ tsubasawolfy: 方向。使用者如果語意模糊還可以說使用者技術不好 09/20 11:30
75F:→ tsubasawolfy: ,例如‘’讀標題下面那個‘。但截圖上就明確說要" 09/20 11:30
76F:→ tsubasawolfy: 說明欄‘’。這就是模型能力問題 09/20 11:30
77F:推 schumi7401 : Google ai明明比較爛之前還有人吹 09/20 12:03
78F:→ augustlion : gemeni剛推出時真的不錯用 現在……………… 09/20 12:33
79F:推 aria0520 : gemini是harness層弱 api調用其實能力比其他幾家 09/20 13:01
80F:→ aria0520 : 更均衡 不像o家和a家為了衝agentic coding 09/20 13:01
81F:→ aria0520 : 其他能力幾乎全部倒退 09/20 13:01
82F:→ aria0520 : 尤其是creative writing, o跟a最近連正常英文都講 09/20 13:02
83F:→ aria0520 : 不出來了 一天到晚被歐美吐槽 09/20 13:02
84F:推 guanting886 : 丟個Yt影片給他有機率會遇上他只跟你說我只是一個 09/20 13:55
85F:→ guanting886 : 大型語言模型我處理不了之類的 09/20 13:55
86F:→ guanting886 : Google工程師自己都不用自己家的Gemini很難想像怎 09/20 13:56
87F:→ guanting886 : 麼打磨好體驗QQ 09/20 13:56
88F:推 LoveSports : 感謝t大說明,我看懂了,意思是不論是一開始要求讀 09/20 14:16
89F:→ LoveSports : 影片,或是接下來退一步要求讀說明欄,Gemini因為工 09/20 14:16
90F:→ LoveSports : 具錯誤等不明因素讀不到,但是沒有直接跟用戶講,就 09/20 14:17
91F:→ LoveSports : 只是堅持影片中沒有該種商品。 09/20 14:18
92F:→ LoveSports : 這的確是浪費用戶時間是一個問題,不過我不覺得這跟 09/20 14:18
93F:→ LoveSports : 模型能力有關,這可能是過信上下文? 09/20 14:18
94F:→ LoveSports : 其他家AI也有可能出現這種問題,遇到這種情況我都當 09/20 14:20
95F:→ LoveSports : 眼花XD 09/20 14:21
96F:→ LoveSports : 其實我之前也有氣到說要砍掉頁面的情況,可是後來知 09/20 14:23
97F:→ LoveSports : 道是因為防詐騙濫用,就沒那麼氣了。如果使用經驗很 09/20 14:23
98F:→ LoveSports : 糟還是趁早換一家,沒必要忍耐受罪。 09/20 14:23
99F:推 quanhwe : 問他寶可夢冠軍這遊戲 一直回答我這遊戲不存在 明 09/20 14:46
100F:→ quanhwe : 明google 搜尋一下就有的東西 代表Gemini 連搜尋都 09/20 14:46
101F:→ quanhwe : 做不到 09/20 14:46
102F:推 LoveSports : 要叫他用RAG檢索 不然模型上市後才有的東西他們沒學 09/20 14:56
103F:→ LoveSports : 到 查商品基本上用AI模式就好了 09/20 14:57
104F:→ LoveSports : 指示用RAG檢索等於強制系統配給他搜尋工具 09/20 14:57
105F:→ LoveSports : 不要跟別人講 這個比較耗算力 如果有投資Google 09/20 14:58
106F:→ LoveSports : 建議還是用AI模式或Google搜尋就好了 09/20 14:58
109F:→ asahi98 : 稍早前測試結果,我後來還有去串API結果是遇到503 09/21 00:27
110F:→ asahi98 : 503 high demand 重試後才成功3.8延伸模型 09/21 00:28
111F:→ asahi98 : 鄉民說Antigravity會好用,也測試了。一樣有遇到 09/21 00:29
112F:→ asahi98 : 所以現在google要投資前,還是先觀望,說不定曇花 09/21 00:37