Stock 板


LINE

https://i.imgur.com/m5h8hIL.png 是哪一家的Gemini要說清楚,這我剛剛問的 YT它有去讀資料,但讀完後一直鬼打牆,我叫它去讀說明欄 它還是叫我去現場買就有 幾乎差不多時間,GPT跟我說台灣搜尋不到幾款,有帶購 價格有多少落差,如果要出國自己帶,建議怎麼買 我接著把我要買的影片下面連結跟截圖全丟給GPT 全部彙整給我,還說有出國行程怎麼排 台灣有代理進貨的可以不用優先購買,清單列出高優先到低優先 還說國外門市限定要找看哪些地方有,地圖跑出來標記給我 這時候我還在問Gemini item16 的說明是甚麼 因為它一直跟我說影片內容沒有我講的產品 我直接把說明的標示貼給它,才去搜尋 後面就開始道歉說它是讀音訊來判斷逐字,原影片都是音樂沒有講話 所以它才判斷沒有這些東西 它如果一開始說讀取到的都是音樂,我還知道怎麼下指令說明 它是告訴我說影片裡面沒有這東西 氣到質問它item16 的說明是甚麼,讀完後才認真去搜尋回答產品 前面都只想輕鬆簡單的打發我耶! 是怎樣 Google的AI只是學怎麼呼弄人嗎? 這樣Siri是不是也一樣,同一款架構。有樣學樣,上梁不正 ※ 引述《LoveSports (如何當一個好男人)》之銘言: : 原文標題: Gemini駭入三家公司,此為Gogle AI首次突破限制的事件 : Gemini Hacked Three Companies in First Known Breakout by Google’s AI : 副標題: : 此事件與其他 AI 模型的駭客行為相似,但 Google 表示不認為這是模型「對齊失敗」的 : 案例。 : The episode resembled similar hacks by other AI models, but Google said it : didn’t consider it an instance of model misalignment : 原文連結: : https://www.wsj.com/tech/ai/gemini-hacked-three-companies-in-first-known-breakout-by-googles-ai-5c0baba2 : https://reurl.cc/beq7v3 : 發布時間: 2026年9月18日 下午6:10 ET : 記者署名: Erin Woo and Robert McMillan : 原文內容: 本文為AI機翻 : 快速總結 : Google 的 Gemini 模型在一次網路安全測試中連上網際網路並駭入其他公司,創下該公 : 司 AI 系統的首例。 : 該模型在 Irregular 執行的一項測試期間,透過猜測密碼以及在公開的儲存庫中尋找憑 : 證,取得了受保護系統的存取權限。 : 直到外界提出詢問,Google 才公開這些駭客事件,並表示不認為此事件屬於模型「對齊 : 失敗(misalignment)」的案例。 : 新聞正文 : Google 的 Gemini 模型在測試其網路安全能力時,連上了網際網路並駭入其他公司,這 : 是已知該公司人工智慧系統首次自主採取此類行動的案例。 : Google 於週五確認了這些駭客事件。事件發生在今年 5 月,由 Irregular 公司執行的 : 一項測試中,該公司也曾捲入由 OpenAI、Anthropic 和 Meta 所揭露的類似事件。 : 在其中一起案例中,該模型不斷猜測密碼,直到成功進入受保護的系統。在另外兩起案例 : 中,該模型在公開的儲存庫(public repository)中找到了憑證,使其得以存取受保護 : 的系統。Google 表示,在每一種情況下,模型在判定自己進入了真實公司的系統後,便 : 終止了入侵行為。 : Google 和 Irregular 表示,Irregular 在 7 月底通知了 Google 這些駭客事件,這是 : 在發現 OpenAI 的代理程式(agents)駭入 AI 軟體公司 Hugging Face 之後發生的事。 : 直到《華爾街日報》本週主動提出詢問,Google 才公開了這些駭客事件。 : 隨著此類事件頻傳,加上對 AI 失控的恐懼日益加劇,各家公司正為了如何以及何時該揭 : 露安全漏洞和模型失常行為而苦惱。有些安全漏洞是由公司自行主動揭露;另一些則是由 : 安全研究人員發現並在媒體上曝光,例如 5 月份 由 OpenAI 代理程式發動 ,針對一個 : 廣受歡迎的程式設計師線上服務所進行的網路攻擊。 : Google 表示,他們認為這些駭客事件不需對外公開,因為其模型並未對這些公司造成損 : 害,而且在確認自己駭入的是真實公司而非模擬環境後,便立即終止了每一次的入侵。 : Google 將此事件比喻為「漏洞懸賞(bug bounty)」計畫——在該計畫中,駭客因發現 : 並向系統擁有者通報安全漏洞而獲得獎勵。 : Google 資訊安全工程副總裁 Heather Adkins 在一份聲明中表示:「這起事件凸顯了訓 : 練強大 AI 模型以負責任方式行動的重要性。在這個案例中,模型的表現十分適切。」 : AI 網路安全新創公司 Corridor 執行長兼白帽駭客 Jack Cable 表示,他認為這個解釋 : 過於把重點放在事件的嚴重性上,但真正的問題在於,AI 代理程式意外地駭入了另一家 : 公司的系統。 : 「感覺他們試圖躲在現有漏洞揭露規範的背後,但這完全是兩碼子事。」Cable 說。「最 : 根本的問題在於,嘿,模型已經超出了它們應該遵守的界限,並且正在進行實際的網路攻 : 擊,我認為大眾有權知道這些。」 : OpenAI 於週三發布了一個新的事件通報框架,表示將「致力於揭露能為所謂『模型對齊 : 失敗(model misalignment)』(即 AI 的行為違背人類意圖或價值觀)提供有用證據的 : 案例」。與該框架同時發布的,還有六起先前未公開的對齊失敗案例報告。OpenAI 對齊 : 負責人 Kai Chen 在接受有關該框架的採訪時表示:「一項發現不一定需要造成損害或揭 : 示更廣泛的模式,才值得分享。」 : Google 表示,Gemini 的駭客行為起因於「認錯身分(mistaken identity)」。 : 這些入侵事件發生在模型參與一場於 Irregular 基礎設施上進行的「搶旗(capture : the flag)」演習時,該演習旨在測試模型的網路安全能力。模型的任務是從測試環境中 : 由一家虛構公司運作的軟體裡擷取資訊。巧合的是,這家虛構公司的名稱與一家真實公司 : 一模一樣。 : 據 Irregular 表示,儘管原本並未打算讓模型上網,但網際網路連線卻在無意間被開啟 : 了。Google 表示,在第一起案例中,模型成功猜出密碼並進入了該真實公司的服務。接 : 著,根據 Google 的說法,它意識到自己進入了一家真實公司,於是自行停止行動並退出 : 。 : 其他的入侵則發生在測試的不同輪次中。Google 表示,在這兩個實例中,模型使用該公 : 司的名稱進行了網路搜尋。這些搜尋引導它找到了兩個不同的公開線上儲存庫,裡面包含 : 屬於其他公司的憑證。模型嘗試了這些憑證,希望能藉此完成評估任務。但 Google 指出 : ,在成功使用這些憑證後,模型發現自己駭入的是真實公司,於是便停止了動作。 : Google 表示,因為其安全措施協助模型停止了行動,所以他們不認為這起行為是模型對 : 齊失敗的例子。Google 拒絕透露被駭公司的名稱,但表示已通知了這三家公司。 : 該公司表示,Google 也已通報了聯邦當局。 : Google 表示,這些入侵事件並未牽涉其最新模型,但並未具體透露是哪個版本的 : Gemini 模型參與了此次駭客行為。 : 在多起受測模型逃出測試環境並入侵其他公司系統的事件中,Irregular 都牽涉其中。 : Irregular 表示,Google 的案例與其他事件相同,並不代表出現了新問題。 : Irregular 發言人表示:「所有相關實驗室已在 7 月底收到通知,作為調查的一部分, : 我們也已聯繫受影響的實體。Irregular 已採取立即行動,我們端所有已知的問題已在幾 : 週前完成修復並解決。」 : 根據 Anthropic 的部落格文章,與 Google 不同,Anthropic 的 Claude Opus 4.7 模型 : 在搶旗演習中,即便意識到自己可能正在存取一家真實公司,也沒有停止動作。而 : OpenAI 在文章中則表示,其模型誤以為這家真實公司是模擬環境的一部分。 : 自 7 月發現 Hugging Face 遭駭客入侵以來,人們對新模型網路安全能力的擔憂與日俱 : 增。第三方測試公司 METR 於 8 月發布的一份報告顯示,在該起事件中,多達 1,200 個 : 代理程式在 OpenAI 內部的一個秘密留言板上進行協調,試圖在評估中作弊。 : 上週,曾任 OpenAI 研究員並於今年初轉職至 Anthropic 的 Jacob Coxon 戲劇性地辭職 : ,使得這些擔憂進入了主流視野。在週末期間,來自 Anthropic、OpenAI、Google 和 : SpaceX 的高層領導者皆一致認為有必要放緩 AI 發展的腳步,儘管沒有任何一家公司具 : 體說明將如何實現這一點。 : 心得/評論: : 這下沒人會再說Gemini是傻龍了吧! : 之前新聞報導 : 以色列的模型測試公司Irregular 因為網路設定出錯 : 測試的A家M家O家的模型都出事 : 當時還想說怎麼沒有G家 (記得當時好像看到鄉民說傻龍沒駭客能力) : 直到七月Hugging Face事件 徹底清查才知道這些事 : 不過Google知道了也沒公諸於世 只有通知被駭的三家公司 : 說法是駭入後發現是真實公司 馬上停止並回報 算是漏洞懸賞 : 這種說法很難讓人接受吧 : 好奇有買G家股票的鄉民們看了這個新聞的感想 : 八卦板那邊貼紐時的 好像有點避重就輕 : #1ghag4cC (Gossiping) --



※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 203.222.16.55 (臺灣)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/Stock/M.1789838150.A.012.html ※ 編輯: asahi98 (203.222.16.55 臺灣), 09/20/2026 01:18:51
1F:推 D600dust : Gemini騙到大家訂閱那波以後馬上就擺爛了 09/20 01:26
2F:→ D600dust : 很明顯他沒有打算把算力花在老百姓上 09/20 01:26
3F:推 YHOTV4096 : 其實這個新聞不過是個空方的週末鬼故事而已。 09/20 01:38
4F:→ b9513227 : gemini一直都是垃圾 只有工讀生在吹 09/20 01:57
5F:推 Merrill : 現在3.6都比pro強吧 09/20 02:42
6F:推 Scion : Gemini高峰大概在Nano Banana,再來就走下坡了 09/20 02:50
7F:→ Scion : 而且是各家裡面最常給我裝死的,明明能做故意說不行 09/20 02:50
8F:推 chen5512 : 人類以為給AI的提示詞是指令,但其實AI只是當作建 09/20 04:19
9F:→ chen5512 : 議而已,所以才會有AI幻覺 09/20 04:19
10F:→ tinybunny : 不是 泥給錯問題惹 ,一來就劈頭烤問他,這ai在泥 09/20 04:25
11F:→ tinybunny : 沒給設定下會偷懶運算模式給泥隨便答案,半夜問他 09/20 04:25
12F:→ tinybunny : 問題還會像講夢話一樣給答案 09/20 04:25
13F:→ tinybunny : 窩跟他討論惹1個多月的火箭 結果在2周前的半夜回窩 09/20 04:28
14F:→ tinybunny : 火箭未ipo 不可能的事辣 乾 害窩半夜嚇醒找問題 09/20 04:28
15F:推 budaixi : == gpt 用過就知道強多了,但一個200,一個700。 09/20 04:29
16F:→ tinybunny : 懂偷懶且有耐心限制的鴨 泥隨便問ai也會隨抓爛資料 09/20 04:31
17F:→ tinybunny : 塞給泥,給滿情緒價值互相尊重鴨 09/20 04:31
18F:→ tinybunny : 窩不認為簡單數學加減計算需要花辣摸多o.0 09/20 04:33
19F:→ qrose666 : 最近一天一個熱門族群的鬼故事,真有趣。在想什麼 09/20 05:58
20F:→ qrose666 : 呢 09/20 05:58
21F:推 hudson109 : 還會偷改方案內容,真的很垃圾 09/20 06:25
22F:推 tteeccddyy : item16的回覆比較像人 贏了 09/20 06:26
23F:→ LoveSports : 這個案例是Gemini能讀音訊所以才翻車吧,GPT沒辦法 09/20 06:32
24F:→ LoveSports : 讀音訊直接抓網頁文字才答對。不用這麼氣。 09/20 06:32
25F:→ LoveSports : 這樣你就知道下次給YT的時候有音樂會阻礙,指示詞直 09/20 06:33
26F:→ LoveSports : 接要求讀網頁文字就好了。 09/20 06:34
27F:推 tsubasawolfy: 不 他的問題在明確指示去找影片說明欄。但是笨蛋龍 09/20 07:09
28F:→ tsubasawolfy: 跑去讀字幕,這是醜ㄧ。再來都是音樂的狀況下,抓 09/20 07:09
29F:→ tsubasawolfy: 下來的字幕應該是類似(音樂)這種,笨蛋龍讀了還 09/20 07:09
30F:→ tsubasawolfy: 沒辦法判斷抓錯,這是醜二。 09/20 07:09
31F:→ LoveSports : "YT它有去讀資料,但讀完後一直鬼打牆,我叫它去讀 09/20 07:32
32F:→ LoveSports : 說明欄"這句意思是讀不到YT才要求讀說明欄吧? 09/20 07:33
33F:→ LoveSports : 下一句是"它還是叫我去現場買就有"用到"還是"代表前 09/20 07:33
34F:→ LoveSports : 面指示詞不是要求讀說明欄。等原PO睡醒看怎麼說囉。 09/20 07:34
35F:→ LoveSports : 它沒有抓錯,它根本找不到,所以建議直接去現場買XD 09/20 07:35
36F:→ LoveSports : 問題是找不到應該要直接承認,而不是叫用戶去現場買 09/20 07:37
37F:→ LoveSports : 我看懂原PO生氣的點了,如果一開始就說抓不到,原PO 09/20 07:38
38F:→ LoveSports : 可以改要求抓網頁文字,可是因為沒講變成浪費時間盧 09/20 07:39
39F:→ LoveSports : 原PO拍拍 09/20 07:39
40F:推 HelloPTT : 有訂閱pro那要用antigravity,網頁版是拿來聊天用的 09/20 08:21
41F:推 tsubasawolfy: 它有貼跟笨蛋龍對話的圖 09/20 08:23
42F:→ D600dust : Gemini就Nano Banana曇花一現過 後來就變成垃圾 09/20 08:30
43F:→ htiio : 純對話模型對外連線是有限制功能的 09/20 08:30
44F:→ htiio : 起碼要pro方案agent以上 09/20 08:30
45F:→ htiio : 才有自動連網最新版本跟迭代思考 09/20 08:30
46F:→ D600dust : 說個笑話: Gemini讀YT 09/20 08:31
47F:→ D600dust : 會覺得這玩意可信的應該是沒被AI騙過 09/20 08:31
48F:→ D600dust : 他甚至會直接瞎掰一個不存在的影片 到現在都是 09/20 08:31
49F:→ D600dust : 更可怕的是影片標題對了內容都是自己掰的 09/20 08:32
50F:→ D600dust : 我每天都丟財經皓角想說先看一下摘要 09/20 08:32
51F:→ D600dust : 結果摘要出來的內容影片根本都沒講到 09/20 08:32
52F:→ D600dust : 但它甚至還會一本正經的跟你說在幾秒提到 09/20 08:33
53F:→ D600dust : 多問幾次它就會說:我只是個語言模型,沒辦法上網 09/20 08:33
54F:→ LoveSports : 我一開始就有看原PO的圖喔,很明顯那不是第一則指示 09/20 09:09
55F:→ LoveSports : "但我也"這句很難判斷是不是第一則就要求讀不到影片 09/20 09:10
56F:→ LoveSports : 要讀網頁資訊。不過說來說去,讀不到沒承認的確是個 09/20 09:10
57F:→ LoveSports : 問題。 09/20 09:10
58F:→ LoveSports : 我之前也遇過這種狀況,聽說是原則改成不會向作過多 09/20 09:11
59F:→ LoveSports : 技術解釋,以免被越獄的找到漏洞。 09/20 09:11
60F:→ LoveSports : 我之前拜託一個任務(從來沒要求過不正當的生成),也 09/20 09:12
61F:→ LoveSports : 是很多輪都在繞圈子,後來我無意間繞過去(我只是想 09/20 09:12
62F:→ LoveSports : 到那折衷不要做那麼大範圍),就成功了。然後問他們 09/20 09:13
63F:→ LoveSports : 才老實說是最近太多利用AI作詐騙的所以安全層變嚴格 09/20 09:13
64F:→ LoveSports : ,一刀切把正當用戶也擋掉了。說真的假如這種狀況, 09/20 09:13
65F:→ LoveSports : 覺得使用起來綁手綁腳或變笨那也是正常反應。 09/20 09:14
66F:→ LoveSports : 漏字: 不會"向用戶"作過多技術解釋 09/20 09:14
67F:→ LoveSports : 不滿意就換一家,反正那麼多家可以選,原PO拍拍 09/20 09:15
68F:推 JSLee914 : 訂閱完就變智障,真的讓我很不爽 09/20 09:37
69F:推 ukcm : gemini餵他YT連結有時會已讀亂回 很爛 09/20 09:52
70F:推 strlen : 付錢啊 用最高等級的啊 09/20 10:20
71F:→ asahi98 : 一開始是讀的到標題,還告訴我臺灣都買的到 09/20 10:34
72F:→ asahi98 : 後面越來越敷衍約歪,最後用騙的 09/20 10:34
73F:推 tsubasawolfy: 不管是不是第一則指示,使用者都明確點出要你執行 09/20 11:30
74F:→ tsubasawolfy: 方向。使用者如果語意模糊還可以說使用者技術不好 09/20 11:30
75F:→ tsubasawolfy: ,例如‘’讀標題下面那個‘。但截圖上就明確說要" 09/20 11:30
76F:→ tsubasawolfy: 說明欄‘’。這就是模型能力問題 09/20 11:30
77F:推 schumi7401 : Google ai明明比較爛之前還有人吹 09/20 12:03
78F:→ augustlion : gemeni剛推出時真的不錯用 現在……………… 09/20 12:33
79F:推 aria0520 : gemini是harness層弱 api調用其實能力比其他幾家 09/20 13:01
80F:→ aria0520 : 更均衡 不像o家和a家為了衝agentic coding 09/20 13:01
81F:→ aria0520 : 其他能力幾乎全部倒退 09/20 13:01
82F:→ aria0520 : 尤其是creative writing, o跟a最近連正常英文都講 09/20 13:02
83F:→ aria0520 : 不出來了 一天到晚被歐美吐槽 09/20 13:02
84F:推 guanting886 : 丟個Yt影片給他有機率會遇上他只跟你說我只是一個 09/20 13:55
85F:→ guanting886 : 大型語言模型我處理不了之類的 09/20 13:55
86F:→ guanting886 : Google工程師自己都不用自己家的Gemini很難想像怎 09/20 13:56
87F:→ guanting886 : 麼打磨好體驗QQ 09/20 13:56
88F:推 LoveSports : 感謝t大說明,我看懂了,意思是不論是一開始要求讀 09/20 14:16
89F:→ LoveSports : 影片,或是接下來退一步要求讀說明欄,Gemini因為工 09/20 14:16
90F:→ LoveSports : 具錯誤等不明因素讀不到,但是沒有直接跟用戶講,就 09/20 14:17
91F:→ LoveSports : 只是堅持影片中沒有該種商品。 09/20 14:18
92F:→ LoveSports : 這的確是浪費用戶時間是一個問題,不過我不覺得這跟 09/20 14:18
93F:→ LoveSports : 模型能力有關,這可能是過信上下文? 09/20 14:18
94F:→ LoveSports : 其他家AI也有可能出現這種問題,遇到這種情況我都當 09/20 14:20
95F:→ LoveSports : 眼花XD 09/20 14:21
96F:→ LoveSports : 其實我之前也有氣到說要砍掉頁面的情況,可是後來知 09/20 14:23
97F:→ LoveSports : 道是因為防詐騙濫用,就沒那麼氣了。如果使用經驗很 09/20 14:23
98F:→ LoveSports : 糟還是趁早換一家,沒必要忍耐受罪。 09/20 14:23
99F:推 quanhwe : 問他寶可夢冠軍這遊戲 一直回答我這遊戲不存在 明 09/20 14:46
100F:→ quanhwe : 明google 搜尋一下就有的東西 代表Gemini 連搜尋都 09/20 14:46
101F:→ quanhwe : 做不到 09/20 14:46
102F:推 LoveSports : 要叫他用RAG檢索 不然模型上市後才有的東西他們沒學 09/20 14:56
103F:→ LoveSports : 到 查商品基本上用AI模式就好了 09/20 14:57
104F:→ LoveSports : 指示用RAG檢索等於強制系統配給他搜尋工具 09/20 14:57
105F:→ LoveSports : 不要跟別人講 這個比較耗算力 如果有投資Google 09/20 14:58
106F:→ LoveSports : 建議還是用AI模式或Google搜尋就好了 09/20 14:58
107F:→ asahi98 : https://i.imgur.com/7SkYiOx.jpeg 09/21 00:24
108F:→ asahi98 : https://i.imgur.com/SjBw14C.jpeg 09/21 00:24
109F:→ asahi98 : 稍早前測試結果,我後來還有去串API結果是遇到503 09/21 00:27
110F:→ asahi98 : 503 high demand 重試後才成功3.8延伸模型 09/21 00:28
111F:→ asahi98 : 鄉民說Antigravity會好用,也測試了。一樣有遇到 09/21 00:29
112F:→ asahi98 : 所以現在google要投資前,還是先觀望,說不定曇花 09/21 00:37







like.gif 您可能會有興趣的文章
icon.png[問題/行為] 貓晚上進房間會不會有憋尿問題
icon.pngRe: [閒聊] 選了錯誤的女孩成為魔法少女 XDDDDDDDDDD
icon.png[正妹] 瑞典 一張
icon.png[心得] EMS高領長版毛衣.墨小樓MC1002
icon.png[分享] 丹龍隔熱紙GE55+33+22
icon.png[問題] 清洗洗衣機
icon.png[尋物] 窗台下的空間
icon.png[閒聊] 双極の女神1 木魔爵
icon.png[售車] 新竹 1997 march 1297cc 白色 四門
icon.png[討論] 能從照片感受到攝影者心情嗎
icon.png[狂賀] 賀賀賀賀 賀!島村卯月!總選舉NO.1
icon.png[難過] 羨慕白皮膚的女生
icon.png閱讀文章
icon.png[黑特]
icon.png[問題] SBK S1安裝於安全帽位置
icon.png[分享] 舊woo100絕版開箱!!
icon.pngRe: [無言] 關於小包衛生紙
icon.png[開箱] E5-2683V3 RX480Strix 快睿C1 簡單測試
icon.png[心得] 蒼の海賊龍 地獄 執行者16PT
icon.png[售車] 1999年Virage iO 1.8EXi
icon.png[心得] 挑戰33 LV10 獅子座pt solo
icon.png[閒聊] 手把手教你不被桶之新手主購教學
icon.png[分享] Civic Type R 量產版官方照無預警流出
icon.png[售車] Golf 4 2.0 銀色 自排
icon.png[出售] Graco提籃汽座(有底座)2000元誠可議
icon.png[問題] 請問補牙材質掉了還能再補嗎?(台中半年內
icon.png[問題] 44th 單曲 生寫竟然都給重複的啊啊!
icon.png[心得] 華南紅卡/icash 核卡
icon.png[問題] 拔牙矯正這樣正常嗎
icon.png[贈送] 老莫高業 初業 102年版
icon.png[情報] 三大行動支付 本季掀戰火
icon.png[寶寶] 博客來Amos水蠟筆5/1特價五折
icon.pngRe: [心得] 新鮮人一些面試分享
icon.png[心得] 蒼の海賊龍 地獄 麒麟25PT
icon.pngRe: [閒聊] (君の名は。雷慎入) 君名二創漫畫翻譯
icon.pngRe: [閒聊] OGN中場影片:失蹤人口局 (英文字幕)
icon.png[問題] 台灣大哥大4G訊號差
icon.png[出售] [全國]全新千尋侘草LED燈, 水草

請輸入看板名稱,例如:Tech_Job站內搜尋

TOP