Stock 板


LINE

https://i.imgur.com/m5h8hIL.png 是哪一家的Gemini要说清楚,这我刚刚问的 YT它有去读资料,但读完後一直鬼打墙,我叫它去读说明栏 它还是叫我去现场买就有 几乎差不多时间,GPT跟我说台湾搜寻不到几款,有带购 价格有多少落差,如果要出国自己带,建议怎麽买 我接着把我要买的影片下面连结跟截图全丢给GPT 全部汇整给我,还说有出国行程怎麽排 台湾有代理进货的可以不用优先购买,清单列出高优先到低优先 还说国外门市限定要找看哪些地方有,地图跑出来标记给我 这时候我还在问Gemini item16 的说明是甚麽 因为它一直跟我说影片内容没有我讲的产品 我直接把说明的标示贴给它,才去搜寻 後面就开始道歉说它是读音讯来判断逐字,原影片都是音乐没有讲话 所以它才判断没有这些东西 它如果一开始说读取到的都是音乐,我还知道怎麽下指令说明 它是告诉我说影片里面没有这东西 气到质问它item16 的说明是甚麽,读完後才认真去搜寻回答产品 前面都只想轻松简单的打发我耶! 是怎样 Google的AI只是学怎麽呼弄人吗? 这样Siri是不是也一样,同一款架构。有样学样,上梁不正 ※ 引述《LoveSports (如何当一个好男人)》之铭言: : 原文标题: Gemini骇入三家公司,此为Gogle AI首次突破限制的事件 : Gemini Hacked Three Companies in First Known Breakout by Google’s AI : 副标题: : 此事件与其他 AI 模型的骇客行为相似,但 Google 表示不认为这是模型「对齐失败」的 : 案例。 : The episode resembled similar hacks by other AI models, but Google said it : didn’t consider it an instance of model misalignment : 原文连结: : https://www.wsj.com/tech/ai/gemini-hacked-three-companies-in-first-known-breakout-by-googles-ai-5c0baba2 : https://reurl.cc/beq7v3 : 发布时间: 2026年9月18日 下午6:10 ET : 记者署名: Erin Woo and Robert McMillan : 原文内容: 本文为AI机翻 : 快速总结 : Google 的 Gemini 模型在一次网路安全测试中连上网际网路并骇入其他公司,创下该公 : 司 AI 系统的首例。 : 该模型在 Irregular 执行的一项测试期间,透过猜测密码以及在公开的储存库中寻找凭 : 证,取得了受保护系统的存取权限。 : 直到外界提出询问,Google 才公开这些骇客事件,并表示不认为此事件属於模型「对齐 : 失败(misalignment)」的案例。 : 新闻正文 : Google 的 Gemini 模型在测试其网路安全能力时,连上了网际网路并骇入其他公司,这 : 是已知该公司人工智慧系统首次自主采取此类行动的案例。 : Google 於周五确认了这些骇客事件。事件发生在今年 5 月,由 Irregular 公司执行的 : 一项测试中,该公司也曾卷入由 OpenAI、Anthropic 和 Meta 所揭露的类似事件。 : 在其中一起案例中,该模型不断猜测密码,直到成功进入受保护的系统。在另外两起案例 : 中,该模型在公开的储存库(public repository)中找到了凭证,使其得以存取受保护 : 的系统。Google 表示,在每一种情况下,模型在判定自己进入了真实公司的系统後,便 : 终止了入侵行为。 : Google 和 Irregular 表示,Irregular 在 7 月底通知了 Google 这些骇客事件,这是 : 在发现 OpenAI 的代理程式(agents)骇入 AI 软体公司 Hugging Face 之後发生的事。 : 直到《华尔街日报》本周主动提出询问,Google 才公开了这些骇客事件。 : 随着此类事件频传,加上对 AI 失控的恐惧日益加剧,各家公司正为了如何以及何时该揭 : 露安全漏洞和模型失常行为而苦恼。有些安全漏洞是由公司自行主动揭露;另一些则是由 : 安全研究人员发现并在媒体上曝光,例如 5 月份 由 OpenAI 代理程式发动 ,针对一个 : 广受欢迎的程式设计师线上服务所进行的网路攻击。 : Google 表示,他们认为这些骇客事件不需对外公开,因为其模型并未对这些公司造成损 : 害,而且在确认自己骇入的是真实公司而非模拟环境後,便立即终止了每一次的入侵。 : Google 将此事件比喻为「漏洞悬赏(bug bounty)」计画——在该计画中,骇客因发现 : 并向系统拥有者通报安全漏洞而获得奖励。 : Google 资讯安全工程副总裁 Heather Adkins 在一份声明中表示:「这起事件凸显了训 : 练强大 AI 模型以负责任方式行动的重要性。在这个案例中,模型的表现十分适切。」 : AI 网路安全新创公司 Corridor 执行长兼白帽骇客 Jack Cable 表示,他认为这个解释 : 过於把重点放在事件的严重性上,但真正的问题在於,AI 代理程式意外地骇入了另一家 : 公司的系统。 : 「感觉他们试图躲在现有漏洞揭露规范的背後,但这完全是两码子事。」Cable 说。「最 : 根本的问题在於,嘿,模型已经超出了它们应该遵守的界限,并且正在进行实际的网路攻 : 击,我认为大众有权知道这些。」 : OpenAI 於周三发布了一个新的事件通报框架,表示将「致力於揭露能为所谓『模型对齐 : 失败(model misalignment)』(即 AI 的行为违背人类意图或价值观)提供有用证据的 : 案例」。与该框架同时发布的,还有六起先前未公开的对齐失败案例报告。OpenAI 对齐 : 负责人 Kai Chen 在接受有关该框架的采访时表示:「一项发现不一定需要造成损害或揭 : 示更广泛的模式,才值得分享。」 : Google 表示,Gemini 的骇客行为起因於「认错身分(mistaken identity)」。 : 这些入侵事件发生在模型参与一场於 Irregular 基础设施上进行的「抢旗(capture : the flag)」演习时,该演习旨在测试模型的网路安全能力。模型的任务是从测试环境中 : 由一家虚构公司运作的软体里撷取资讯。巧合的是,这家虚构公司的名称与一家真实公司 : 一模一样。 : 据 Irregular 表示,尽管原本并未打算让模型上网,但网际网路连线却在无意间被开启 : 了。Google 表示,在第一起案例中,模型成功猜出密码并进入了该真实公司的服务。接 : 着,根据 Google 的说法,它意识到自己进入了一家真实公司,於是自行停止行动并退出 : 。 : 其他的入侵则发生在测试的不同轮次中。Google 表示,在这两个实例中,模型使用该公 : 司的名称进行了网路搜寻。这些搜寻引导它找到了两个不同的公开线上储存库,里面包含 : 属於其他公司的凭证。模型尝试了这些凭证,希望能藉此完成评估任务。但 Google 指出 : ,在成功使用这些凭证後,模型发现自己骇入的是真实公司,於是便停止了动作。 : Google 表示,因为其安全措施协助模型停止了行动,所以他们不认为这起行为是模型对 : 齐失败的例子。Google 拒绝透露被骇公司的名称,但表示已通知了这三家公司。 : 该公司表示,Google 也已通报了联邦当局。 : Google 表示,这些入侵事件并未牵涉其最新模型,但并未具体透露是哪个版本的 : Gemini 模型参与了此次骇客行为。 : 在多起受测模型逃出测试环境并入侵其他公司系统的事件中,Irregular 都牵涉其中。 : Irregular 表示,Google 的案例与其他事件相同,并不代表出现了新问题。 : Irregular 发言人表示:「所有相关实验室已在 7 月底收到通知,作为调查的一部分, : 我们也已联系受影响的实体。Irregular 已采取立即行动,我们端所有已知的问题已在几 : 周前完成修复并解决。」 : 根据 Anthropic 的部落格文章,与 Google 不同,Anthropic 的 Claude Opus 4.7 模型 : 在抢旗演习中,即便意识到自己可能正在存取一家真实公司,也没有停止动作。而 : OpenAI 在文章中则表示,其模型误以为这家真实公司是模拟环境的一部分。 : 自 7 月发现 Hugging Face 遭骇客入侵以来,人们对新模型网路安全能力的担忧与日俱 : 增。第三方测试公司 METR 於 8 月发布的一份报告显示,在该起事件中,多达 1,200 个 : 代理程式在 OpenAI 内部的一个秘密留言板上进行协调,试图在评估中作弊。 : 上周,曾任 OpenAI 研究员并於今年初转职至 Anthropic 的 Jacob Coxon 戏剧性地辞职 : ,使得这些担忧进入了主流视野。在周末期间,来自 Anthropic、OpenAI、Google 和 : SpaceX 的高层领导者皆一致认为有必要放缓 AI 发展的脚步,尽管没有任何一家公司具 : 体说明将如何实现这一点。 : 心得/评论: : 这下没人会再说Gemini是傻龙了吧! : 之前新闻报导 : 以色列的模型测试公司Irregular 因为网路设定出错 : 测试的A家M家O家的模型都出事 : 当时还想说怎麽没有G家 (记得当时好像看到乡民说傻龙没骇客能力) : 直到七月Hugging Face事件 彻底清查才知道这些事 : 不过Google知道了也没公诸於世 只有通知被骇的三家公司 : 说法是骇入後发现是真实公司 马上停止并回报 算是漏洞悬赏 : 这种说法很难让人接受吧 : 好奇有买G家股票的乡民们看了这个新闻的感想 : 八卦板那边贴纽时的 好像有点避重就轻 : #1ghag4cC (Gossiping) --



※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 203.222.16.55 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Stock/M.1789838150.A.012.html ※ 编辑: asahi98 (203.222.16.55 台湾), 09/20/2026 01:18:51
1F:推 D600dust : Gemini骗到大家订阅那波以後马上就摆烂了 09/20 01:26
2F:→ D600dust : 很明显他没有打算把算力花在老百姓上 09/20 01:26
3F:推 YHOTV4096 : 其实这个新闻不过是个空方的周末鬼故事而已。 09/20 01:38
4F:→ b9513227 : gemini一直都是垃圾 只有工读生在吹 09/20 01:57
5F:推 Merrill : 现在3.6都比pro强吧 09/20 02:42
6F:推 Scion : Gemini高峰大概在Nano Banana,再来就走下坡了 09/20 02:50
7F:→ Scion : 而且是各家里面最常给我装死的,明明能做故意说不行 09/20 02:50
8F:推 chen5512 : 人类以为给AI的提示词是指令,但其实AI只是当作建 09/20 04:19
9F:→ chen5512 : 议而已,所以才会有AI幻觉 09/20 04:19
10F:→ tinybunny : 不是 泥给错问题惹 ,一来就劈头烤问他,这ai在泥 09/20 04:25
11F:→ tinybunny : 没给设定下会偷懒运算模式给泥随便答案,半夜问他 09/20 04:25
12F:→ tinybunny : 问题还会像讲梦话一样给答案 09/20 04:25
13F:→ tinybunny : 窝跟他讨论惹1个多月的火箭 结果在2周前的半夜回窝 09/20 04:28
14F:→ tinybunny : 火箭未ipo 不可能的事辣 乾 害窝半夜吓醒找问题 09/20 04:28
15F:推 budaixi : == gpt 用过就知道强多了,但一个200,一个700。 09/20 04:29
16F:→ tinybunny : 懂偷懒且有耐心限制的鸭 泥随便问ai也会随抓烂资料 09/20 04:31
17F:→ tinybunny : 塞给泥,给满情绪价值互相尊重鸭 09/20 04:31
18F:→ tinybunny : 窝不认为简单数学加减计算需要花辣摸多o.0 09/20 04:33
19F:→ qrose666 : 最近一天一个热门族群的鬼故事,真有趣。在想什麽 09/20 05:58
20F:→ qrose666 : 呢 09/20 05:58
21F:推 hudson109 : 还会偷改方案内容,真的很垃圾 09/20 06:25
22F:推 tteeccddyy : item16的回覆比较像人 赢了 09/20 06:26
23F:→ LoveSports : 这个案例是Gemini能读音讯所以才翻车吧,GPT没办法 09/20 06:32
24F:→ LoveSports : 读音讯直接抓网页文字才答对。不用这麽气。 09/20 06:32
25F:→ LoveSports : 这样你就知道下次给YT的时候有音乐会阻碍,指示词直 09/20 06:33
26F:→ LoveSports : 接要求读网页文字就好了。 09/20 06:34
27F:推 tsubasawolfy: 不 他的问题在明确指示去找影片说明栏。但是笨蛋龙 09/20 07:09
28F:→ tsubasawolfy: 跑去读字幕,这是丑ㄧ。再来都是音乐的状况下,抓 09/20 07:09
29F:→ tsubasawolfy: 下来的字幕应该是类似(音乐)这种,笨蛋龙读了还 09/20 07:09
30F:→ tsubasawolfy: 没办法判断抓错,这是丑二。 09/20 07:09
31F:→ LoveSports : "YT它有去读资料,但读完後一直鬼打墙,我叫它去读 09/20 07:32
32F:→ LoveSports : 说明栏"这句意思是读不到YT才要求读说明栏吧? 09/20 07:33
33F:→ LoveSports : 下一句是"它还是叫我去现场买就有"用到"还是"代表前 09/20 07:33
34F:→ LoveSports : 面指示词不是要求读说明栏。等原PO睡醒看怎麽说罗。 09/20 07:34
35F:→ LoveSports : 它没有抓错,它根本找不到,所以建议直接去现场买XD 09/20 07:35
36F:→ LoveSports : 问题是找不到应该要直接承认,而不是叫用户去现场买 09/20 07:37
37F:→ LoveSports : 我看懂原PO生气的点了,如果一开始就说抓不到,原PO 09/20 07:38
38F:→ LoveSports : 可以改要求抓网页文字,可是因为没讲变成浪费时间卢 09/20 07:39
39F:→ LoveSports : 原PO拍拍 09/20 07:39
40F:推 HelloPTT : 有订阅pro那要用antigravity,网页版是拿来聊天用的 09/20 08:21
41F:推 tsubasawolfy: 它有贴跟笨蛋龙对话的图 09/20 08:23
42F:→ D600dust : Gemini就Nano Banana昙花一现过 後来就变成垃圾 09/20 08:30
43F:→ htiio : 纯对话模型对外连线是有限制功能的 09/20 08:30
44F:→ htiio : 起码要pro方案agent以上 09/20 08:30
45F:→ htiio : 才有自动连网最新版本跟迭代思考 09/20 08:30
46F:→ D600dust : 说个笑话: Gemini读YT 09/20 08:31
47F:→ D600dust : 会觉得这玩意可信的应该是没被AI骗过 09/20 08:31
48F:→ D600dust : 他甚至会直接瞎掰一个不存在的影片 到现在都是 09/20 08:31
49F:→ D600dust : 更可怕的是影片标题对了内容都是自己掰的 09/20 08:32
50F:→ D600dust : 我每天都丢财经皓角想说先看一下摘要 09/20 08:32
51F:→ D600dust : 结果摘要出来的内容影片根本都没讲到 09/20 08:32
52F:→ D600dust : 但它甚至还会一本正经的跟你说在几秒提到 09/20 08:33
53F:→ D600dust : 多问几次它就会说:我只是个语言模型,没办法上网 09/20 08:33
54F:→ LoveSports : 我一开始就有看原PO的图喔,很明显那不是第一则指示 09/20 09:09
55F:→ LoveSports : "但我也"这句很难判断是不是第一则就要求读不到影片 09/20 09:10
56F:→ LoveSports : 要读网页资讯。不过说来说去,读不到没承认的确是个 09/20 09:10
57F:→ LoveSports : 问题。 09/20 09:10
58F:→ LoveSports : 我之前也遇过这种状况,听说是原则改成不会向作过多 09/20 09:11
59F:→ LoveSports : 技术解释,以免被越狱的找到漏洞。 09/20 09:11
60F:→ LoveSports : 我之前拜托一个任务(从来没要求过不正当的生成),也 09/20 09:12
61F:→ LoveSports : 是很多轮都在绕圈子,後来我无意间绕过去(我只是想 09/20 09:12
62F:→ LoveSports : 到那折衷不要做那麽大范围),就成功了。然後问他们 09/20 09:13
63F:→ LoveSports : 才老实说是最近太多利用AI作诈骗的所以安全层变严格 09/20 09:13
64F:→ LoveSports : ,一刀切把正当用户也挡掉了。说真的假如这种状况, 09/20 09:13
65F:→ LoveSports : 觉得使用起来绑手绑脚或变笨那也是正常反应。 09/20 09:14
66F:→ LoveSports : 漏字: 不会"向用户"作过多技术解释 09/20 09:14
67F:→ LoveSports : 不满意就换一家,反正那麽多家可以选,原PO拍拍 09/20 09:15
68F:推 JSLee914 : 订阅完就变智障,真的让我很不爽 09/20 09:37
69F:推 ukcm : gemini喂他YT连结有时会已读乱回 很烂 09/20 09:52
70F:推 strlen : 付钱啊 用最高等级的啊 09/20 10:20
71F:→ asahi98 : 一开始是读的到标题,还告诉我台湾都买的到 09/20 10:34
72F:→ asahi98 : 後面越来越敷衍约歪,最後用骗的 09/20 10:34
73F:推 tsubasawolfy: 不管是不是第一则指示,使用者都明确点出要你执行 09/20 11:30
74F:→ tsubasawolfy: 方向。使用者如果语意模糊还可以说使用者技术不好 09/20 11:30
75F:→ tsubasawolfy: ,例如‘’读标题下面那个‘。但截图上就明确说要" 09/20 11:30
76F:→ tsubasawolfy: 说明栏‘’。这就是模型能力问题 09/20 11:30
77F:推 schumi7401 : Google ai明明比较烂之前还有人吹 09/20 12:03
78F:→ augustlion : gemeni刚推出时真的不错用 现在……………… 09/20 12:33
79F:推 aria0520 : gemini是harness层弱 api调用其实能力比其他几家 09/20 13:01
80F:→ aria0520 : 更均衡 不像o家和a家为了冲agentic coding 09/20 13:01
81F:→ aria0520 : 其他能力几乎全部倒退 09/20 13:01
82F:→ aria0520 : 尤其是creative writing, o跟a最近连正常英文都讲 09/20 13:02
83F:→ aria0520 : 不出来了 一天到晚被欧美吐槽 09/20 13:02
84F:推 guanting886 : 丢个Yt影片给他有机率会遇上他只跟你说我只是一个 09/20 13:55
85F:→ guanting886 : 大型语言模型我处理不了之类的 09/20 13:55
86F:→ guanting886 : Google工程师自己都不用自己家的Gemini很难想像怎 09/20 13:56
87F:→ guanting886 : 麽打磨好体验QQ 09/20 13:56
88F:推 LoveSports : 感谢t大说明,我看懂了,意思是不论是一开始要求读 09/20 14:16
89F:→ LoveSports : 影片,或是接下来退一步要求读说明栏,Gemini因为工 09/20 14:16
90F:→ LoveSports : 具错误等不明因素读不到,但是没有直接跟用户讲,就 09/20 14:17
91F:→ LoveSports : 只是坚持影片中没有该种商品。 09/20 14:18
92F:→ LoveSports : 这的确是浪费用户时间是一个问题,不过我不觉得这跟 09/20 14:18
93F:→ LoveSports : 模型能力有关,这可能是过信上下文? 09/20 14:18
94F:→ LoveSports : 其他家AI也有可能出现这种问题,遇到这种情况我都当 09/20 14:20
95F:→ LoveSports : 眼花XD 09/20 14:21
96F:→ LoveSports : 其实我之前也有气到说要砍掉页面的情况,可是後来知 09/20 14:23
97F:→ LoveSports : 道是因为防诈骗滥用,就没那麽气了。如果使用经验很 09/20 14:23
98F:→ LoveSports : 糟还是趁早换一家,没必要忍耐受罪。 09/20 14:23
99F:推 quanhwe : 问他宝可梦冠军这游戏 一直回答我这游戏不存在 明 09/20 14:46
100F:→ quanhwe : 明google 搜寻一下就有的东西 代表Gemini 连搜寻都 09/20 14:46
101F:→ quanhwe : 做不到 09/20 14:46
102F:推 LoveSports : 要叫他用RAG检索 不然模型上市後才有的东西他们没学 09/20 14:56
103F:→ LoveSports : 到 查商品基本上用AI模式就好了 09/20 14:57
104F:→ LoveSports : 指示用RAG检索等於强制系统配给他搜寻工具 09/20 14:57
105F:→ LoveSports : 不要跟别人讲 这个比较耗算力 如果有投资Google 09/20 14:58
106F:→ LoveSports : 建议还是用AI模式或Google搜寻就好了 09/20 14:58
107F:→ asahi98 : https://i.imgur.com/7SkYiOx.jpeg 09/21 00:24
108F:→ asahi98 : https://i.imgur.com/SjBw14C.jpeg 09/21 00:24
109F:→ asahi98 : 稍早前测试结果,我後来还有去串API结果是遇到503 09/21 00:27
110F:→ asahi98 : 503 high demand 重试後才成功3.8延伸模型 09/21 00:28
111F:→ asahi98 : 乡民说Antigravity会好用,也测试了。一样有遇到 09/21 00:29
112F:→ asahi98 : 所以现在google要投资前,还是先观望,说不定昙花 09/21 00:37







like.gif 您可能会有兴趣的文章
icon.png[问题/行为] 猫晚上进房间会不会有憋尿问题
icon.pngRe: [闲聊] 选了错误的女孩成为魔法少女 XDDDDDDDDDD
icon.png[正妹] 瑞典 一张
icon.png[心得] EMS高领长版毛衣.墨小楼MC1002
icon.png[分享] 丹龙隔热纸GE55+33+22
icon.png[问题] 清洗洗衣机
icon.png[寻物] 窗台下的空间
icon.png[闲聊] 双极の女神1 木魔爵
icon.png[售车] 新竹 1997 march 1297cc 白色 四门
icon.png[讨论] 能从照片感受到摄影者心情吗
icon.png[狂贺] 贺贺贺贺 贺!岛村卯月!总选举NO.1
icon.png[难过] 羡慕白皮肤的女生
icon.png阅读文章
icon.png[黑特]
icon.png[问题] SBK S1安装於安全帽位置
icon.png[分享] 旧woo100绝版开箱!!
icon.pngRe: [无言] 关於小包卫生纸
icon.png[开箱] E5-2683V3 RX480Strix 快睿C1 简单测试
icon.png[心得] 苍の海贼龙 地狱 执行者16PT
icon.png[售车] 1999年Virage iO 1.8EXi
icon.png[心得] 挑战33 LV10 狮子座pt solo
icon.png[闲聊] 手把手教你不被桶之新手主购教学
icon.png[分享] Civic Type R 量产版官方照无预警流出
icon.png[售车] Golf 4 2.0 银色 自排
icon.png[出售] Graco提篮汽座(有底座)2000元诚可议
icon.png[问题] 请问补牙材质掉了还能再补吗?(台中半年内
icon.png[问题] 44th 单曲 生写竟然都给重复的啊啊!
icon.png[心得] 华南红卡/icash 核卡
icon.png[问题] 拔牙矫正这样正常吗
icon.png[赠送] 老莫高业 初业 102年版
icon.png[情报] 三大行动支付 本季掀战火
icon.png[宝宝] 博客来Amos水蜡笔5/1特价五折
icon.pngRe: [心得] 新鲜人一些面试分享
icon.png[心得] 苍の海贼龙 地狱 麒麟25PT
icon.pngRe: [闲聊] (君の名は。雷慎入) 君名二创漫画翻译
icon.pngRe: [闲聊] OGN中场影片:失踪人口局 (英文字幕)
icon.png[问题] 台湾大哥大4G讯号差
icon.png[出售] [全国]全新千寻侘草LED灯, 水草

请输入看板名称,例如:Boy-Girl站内搜寻

TOP