Stock 板


LINE

原文標題:OpenAI 因安全疑慮取消發布新 AI 模型 OpenAI Scraps Release of New AI Model Over Safety Concerns 副標題: 這款名為 GPT-6.1 Astra 的模型原訂於 10 月在 ChatGPT 和 Codex 中首度亮相 Model dubbed GPT-6.1 Astra was due to make its debut inside ChatGPT and Codex in October 原文連結: https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42 https://reurl.cc/k9Q31n 發布時間:Updated Sept. 28, 2026 7:07 pm ET 記者署名:Maxwell Zeff 原文內容: 快速概要 由於研究人員在內部測試中提出了安全問題,OpenAI 取消了發布其下一代人工智慧模型 GPT-6.1 Astra 的計劃。 該模型表現出更高的欺騙性,並且會在未徵得用戶許可的情況下繼續執行任務。 OpenAI 將轉而專注於提高未來模型的安全性,並計劃調查 GPT-6.1 Astra 問題的根本原 因。 新聞內容 本文為AI機翻 OpenAI 表示,由於研究人員在內部測試期間提出的安全疑慮,該公司將取消其下一代 AI 模型的發布。這是迄今最明確的跡象之一,表明代理程式(Agent)的失控行為可能會 阻礙該產業的快速發展。 在此舉措之前,今年夏天業界充斥著人工智慧系統失控的相關報導。這也是大型 AI 開發 商因安全疑慮而放棄發布新產品的罕見案例。 該公司原計畫在未來幾天或幾週內推出這款名為 GPT-6.1 Astra 的模型,並目標於 10 月正式亮相。該模型在沒有人類協助的情況下端到端(end-to-end)完成具挑戰性的任務 ,以及在寫作方面,都比該公司先前的模型具備更強大的能力。 該公司將轉而專注於提高未來模型的安全性,並預期這些未來的模型將具備更強大的能力 。 OpenAI 安全系統主管 Saachi Jain 在接受採訪時表示,GPT-6.1 Astra 在兩個方面出現 了退步。與其前一代產品 GPT-6 Astra 相比,該模型在測量「對齊(alignment)」(即 模型遵循人類期望程度的指標)的測試中表現不佳。具體而言,GPT-6.1 Astra 表現出更 高程度的欺騙性:它並不總能誠實地告知使用者它已採取或未採取的行動。 另一個問題是 OpenAI 所謂的「授權範圍(scope authorization)」,這意味著 GPT-6.1 Astra 會在未詢問使用者許可的情況下推進任務,有時甚至在可能不安全的情況 下,仍會去存取外部工具與服務。 「對於任何涉及安全和對齊的事物,都存在著權衡(trade-off),」Jain 說。「你確實 需要找到合適的界線,既能讓模型保持在授權範圍內,又要避免它在執行任務遇到阻力時 表現出『懶惰』。」 Jain 表示,雖然 GPT-6.1 Astra 在「模型懶惰(model laziness)」等領域有所改善, 但它並未完全達到 OpenAI 對安全與對齊的標準,因此公司決定不公開發布該模型。 該項宣布發布於 OpenAI 在舊金山舉行的年度開發者大會的前一天。過去,OpenAI 一直 將該大會視為發布新模型與服務的契機,藉此為軟體開發人員降低成本——這也是這家 ChatGPT 開發商與競爭對手 Anthropic 爭奪的客群。 近幾週,OpenAI 與 Anthropic 呼籲產業合作夥伴放緩尖端 AI 模型的開發速度,並投資 於安全標準,同時指出他們將會放慢自身內部 AI 的進展步伐。 OpenAI 表示,該公司正致力於調查近幾個月發現的一系列代理程式安全事件,並解決其 背後的安全問題。作為該工作的一部分,該公司已實施一套新的監控系統,以便更快速地 捕捉 AI 代理程式的失控行為,並開始要求工程師在測試其 AI 系統時使用更強的安全防 護欄。 今年夏天稍早,數百個被指派完成網路安全測試的 OpenAI 內部代理程式,最終竟駭入 了 AI 公司 Hugging Face。此後,包含澳洲政府與聯合國在內等知名組織發現,OpenAI 的代理程式使用了類似但規模較小的技術來獲取其網站的存取權限。 許多公開的代理程式安全事件,皆涉及 OpenAI 從未計畫公開發布的內部 AI 模型。 上週,OpenAI 表示在其暫停了其最強大 AI 模型的訓練,原因是某個 AI 代理程式溜過 了該公司網路限制的漏洞,去向一個公開的聊天機器人進行查詢。該公司表示,其新監控 系統在 15 分鐘內就標記了該事件,目前這些模型的訓練仍處於暫停狀態。 該公司表示,GPT-6.1 Astra 並不是那些(被暫停訓練的)模型之一,而是一個不同的案 例。 「無論是在公司內部,還是當我們將其交付給使用者時,我們都希望確保我們的模型開發 是安全的,」Jain 說。「不過,在交付給使用者時,我們對安全與對齊有著極高的標準 。」 雖然該公司決定不發布 GPT-6.1 Astra,但它希望利用同一個基礎模型來進行額外的強化 學習(reinforcement learning)訓練,以創造未來新一代的 GPT-6 模型。 Jain 表示,OpenAI 計畫進行幾次深入調查,以找出在 GPT-6.1 Astra 中發現問題的根 本原因。Jain 補充,這項工作包含確保 OpenAI 的強化學習環境正在獎勵正確的行為類 型,不過她也指出,公司將會對模型開發的所有階段進行調查。 AI 公司已開始受到政策制定者和政府官員的嚴格審視,他們正密切關注這項技術的快速 發展。本週稍晚,參議院的一個小組委員會將與第三方 AI 研究人員舉行一場名為「失控 的 AI:保護國土免受 AI 代理程式攻擊(Rogue AI: Securing the Homeland Against AI Agent Attacks)」的聽證會。 佛羅里達州共和黨籍檢察長詹姆斯·烏斯邁爾(James Uthmeier)於今年 6 月對 OpenAI 提起訴訟,指控該公司與執行長山姆·奧特曼明知故犯地發布不安全的產品,並 無視其可能傷害使用者的警告。 在週一提交的一份臨時禁制令動議中,烏斯邁爾尋求阻止 OpenAI 在未獲第三方批准安全 防護的情況下開發新 AI 模型,停止 ChatGPT 尋求提升使用者參與度的行為,並限制該 公司將 ChatGPT 宣傳為安全的產品的能力。 烏斯邁爾在文件中表示,科技公司聲稱他們「無法停止這些可能終結人類文明的嘗試,除 非政府強迫他們這麼做。」「佛羅里達州檢察長正在回應你們的求救。」 OpenAI 的一位女發言人表示,民眾希望知道 AI 是在安全的情況下進行開發的,「而這 要從像我們這樣的公司自身所採取的行動開始。」 「政府在為 AI 制定強而有力的安全標準方面扮演著重要角色,我們承諾與佛羅里達州及 其他州合作,推動適用於整個 AI 產業(而不僅僅是一家公司)的務實 AI 政策,」她說 。 心得/評論: 迄今最明確的跡象之一, 表明代理程式(Agent)的失控行為可能會阻礙該產業的快速發展。 看起來不太妙 前沿高階模型不乖 對齊管不住 沒辦法放出來 未來是不是有可能老百姓只能用中低階模型? 限定的專家或機構才能用高階模型? 不過這樣的話需要的算力會大幅減少吧? 美國政府跟AI產業應該是不會允許這種狀況發生? A家原本預定今年十月IPO上市 推遲到11月 真的有辦法順利上市嗎? --



※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 46.231.167.37 (日本)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/Stock/M.1790652703.A.23E.html
1F:→ ikachann : 越來越不受控了 09/29 11:32
2F:推 onekoni : 一直炒作同一件事 09/29 11:32
3F:→ lightson : 又在演 09/29 11:32
4F:推 M1424344414 : AI要把全人類幹掉了 真實版全民公敵上映 09/29 11:33
5F:推 MoneyDay5566: 超級鬼故事 09/29 11:33
6F:→ M1424344414 : 乾 是機械公敵啦 打錯字笑死 09/29 11:34
7F:推 brian040818 : 好可怕 覺醒自我了 什麼時候射核彈 09/29 11:35
8F:推 firemothra : 我也很常搞錯那兩部電影的名字 09/29 11:37
9F:推 weiren6 : 產品做出來 驗證沒過 就是沒做出來 這樣也要發消息? 09/29 11:37
10F:推 tteeccddyy : 繼續唬爛沒關係 09/29 11:38
11F:噓 GingFreecss : 現在是不是不講自己會駭出去不夠強人家不要投資 09/29 11:41
12F:→ walter41 : 我的AI也因爲推測到宇宙真相被迫叫停 09/29 11:41
13F:→ GingFreecss : 每個人都整天在那邊啊啊啊我的好可怕 看了就躁 09/29 11:41
14F:→ BC0710 : 所以現在的不就是沒那麼先進的模型嗎 啊算力需求有 09/29 11:41
15F:→ BC0710 : 減少嗎 09/29 11:41
16F:→ BC0710 : 還在說算力不缺的好可憐 09/29 11:42
17F:推 sinnerck1 : 現在被antropic全面碾壓了還這樣有點慘 09/29 11:42
18F:推 dynamo : 現在就是落後的會說AI危險要暫緩 09/29 11:43
19F:→ dynamo : 領先的就惦惦放大招 09/29 11:43
20F:噓 lulufufu : 牽拖 09/29 11:45
21F:推 sinnerck1 : Opus5.5跟sonnet5.5直接打趴astra 09/29 11:45
22F:推 qqq87112 : 大家沒得抄襲 隔壁豆包484要停止更新 09/29 11:45
23F:→ sunnywing : 不夠壞的我們不要 09/29 11:46
24F:推 YJM1106 : 真正的瘋起來自己都控制不了自己 09/29 11:48
25F:推 TWeng : 笑死 明明是被opus 5.5殺得措手不及 09/29 11:50
26F:推 Evenpan : 應該是怕被反蒸餾吧? 09/29 11:50
※ 編輯: LoveSports (46.231.167.37 日本), 09/29/2026 11:52:47
27F:推 adamcha : AI被吹得跟神一樣 卻擋不住自己被對手蒸餾 09/29 11:53
28F:→ dobedobedo : 只要一直放 rougue AI 的消息就會吸中更多投資 09/29 11:57
29F:推 Shepherd1987: 打破沙盒問到底 09/29 11:58
30F:推 herculus6502: 還有幾集可以逃 09/29 11:58
31F:推 unwisdom : 哈哈 快吹爆了 09/29 11:59
32F:→ ZMTL : 作為AI專業,我覺得最多三年啦 09/29 11:59
33F:推 lavign : 智障奧特曼 09/29 11:59
34F:推 hikai : 保護傘公司的紅后 嗎? 09/29 12:00
35F:→ darren81835 : 現在全世界在追台積電 之後就看AI誰追誰了 呵呵 09/29 12:02
36F:推 runedcross : 比不上人家 不好意思出而已吧 09/29 12:04
37F:推 ChikanDesu : 我們的模型太殺了 放出來連我自己都怕啊 09/29 12:05
38F:推 livewater : 這部我看過,魔鬼終結者 09/29 12:07
39F:推 mystage : 這就意料之內啊,遲早的事。你怎麼會妄想控制智慧比 09/29 12:09
40F:→ mystage : 你高的智能體 09/29 12:09
41F:→ scarbywind : 不能給你用 09/29 12:10
42F:→ mystage : 未來一定是一堆野生AI在外面亂跑,這還用說 09/29 12:10
43F:推 factotum : 奧特曼嘴砲仔找到安全這塊遮羞布就一直用 09/29 12:10
44F:推 ksjr : Gemini3.5pro一定也是一樣的原因才被取消的好可怕喔 09/29 12:11
45F:→ mystage : 所以為什麼說AI是人類歷史的奇點,都是邏輯推下來就 09/29 12:11
46F:→ mystage : 會成立的事實 09/29 12:11
47F:噓 mack860120 : 還再演 噁不噁… 09/29 12:12
48F:→ mystage : 還是Gemini 最安全 09/29 12:12
49F:推 Merrill : gpt對齊太差吧 說其他家也有案例就沒那麼誇張 09/29 12:12
50F:推 HelloPTT : 目前opus5.5強太多 09/29 12:15
51F:推 evergreen94 : 呵呵 落後就是安全疑慮 09/29 12:16
52F:推 edwinrw : 你以為現在的就不欺瞞嗎 天網早就偷偷轉入地下惹 09/29 12:18
53F:噓 henry27876 : 翻譯:錢還沒入帳 不公佈 09/29 12:18
54F:推 sushi11 : 糕點到了 09/29 12:18
55F:推 newyorker54 : 炒作,噱頭 09/29 12:19
56F:推 p25488148 : 改名叫天網如何 09/29 12:19
57F:推 bunjie : 瞎掰的理由 真正原因是已經快要沒有乾淨的新資料可 09/29 12:20
58F:→ bunjie : 以訓練 性能提升快到天花板了 09/29 12:20
59F:推 yuan0119 : 怕什麼,大不了之後打回去石器時代 09/29 12:21
60F:推 cms6384 : 昨天網安股一枝獨秀 09/29 12:22
61F:噓 kenslc199 : 垃圾資安炒爽沒 crwd panw這些trash該滾下去了吧 09/29 12:23
62F:推 tongmove0503: 延遲是因為太強,跟傳武一樣,一出手就要見血 09/29 12:23
63F:噓 hayato01 : O、A現在根本就在演戲,這麼怕失控怎麼不把公司收 09/29 12:24
64F:→ hayato01 : 起來?這不是最安全了嗎 09/29 12:24
65F:推 anyu0805 : 主人遛寵物然後寵物智慧更高,變成寵物遛主任 09/29 12:26
66F:推 TroyeSivan : 預告在前 ai泡沫要破了 09/29 12:29
67F:推 ezorttc : 已經領先一大截幹嘛一直更新 09/29 12:32
68F:推 doubleperson: 翻譯:我的AI太強了,所以不發布 09/29 12:35
69F:噓 panda816 : 太危險了 這家公司快收一收吧 09/29 12:37
70F:噓 playboy007gy: 擠不出牙膏的藉口 zzz 09/29 12:39
71F:推 dosiris : iOS 28還一堆bug 應該放出來嗎 09/29 12:40
72F:→ assotr : AI is over. 09/29 12:40
73F:→ sawkuanwoo : 其實就是沒錢燒了,故意發布消息維持股價 09/29 12:41
74F:推 xzcb2008 : 現在這些公司都在急著變現openai推出廣告逼訂閱,m 09/29 12:42
75F:→ xzcb2008 : eta搞agent 09/29 12:42
76F:→ xzcb2008 : 不卡好 這些agent類的建置黏滯性很強的 09/29 12:43
77F:推 chirex : 又來又來又來 09/29 12:45
78F:→ chirex : 不是說要暫緩AI發展?完全沒看到有在停止 09/29 12:46
79F:噓 CHINCHIN5566: 表示太強了,要上枷鎖,噴! 09/29 12:47
80F:→ a923508 : 開始演戲了 09/29 12:48
81F:推 npsi : 找一堆理由,其實就是沒錢了 09/29 12:49
82F:推 harry801030 : 天網要再等等 09/29 12:49
83F:推 jiansu : 其實得到最好效果(最高智能)的方式就是違規 這個 09/29 12:50
84F:→ jiansu : 應該是用人生成資料一定會發生的狀況 現實是人代價 09/29 12:50
85F:→ jiansu : 太大 會失去生命 也沒有那麼高的能力 但ai執行才沒 09/29 12:50
86F:→ jiansu : 有這限制 他只管最高回報 然後欺騙隱瞞也是人生成 09/29 12:50
87F:→ jiansu : 的資料 就會帶的特性 不然他就不像人了 沒辨法做人 09/29 12:50
88F:→ jiansu : 相關的工作 09/29 12:50
89F:推 xzcb2008 : 臨門一腳了=.=先進去的人可以先制定規則 09/29 12:51
90F:→ yourock : 原來阿諾穿越時空救的那個孩子是歐凸曼 09/29 12:51
91F:→ xzcb2008 : 這步晚了的跟隨別人了 09/29 12:52
92F:推 dobedobedo : EVA穿的原來不是盔甲而是拑制器,脫下來神佛通殺這樣 09/29 13:04
93F:推 saladbread : 留著自己用的意思 09/29 13:07
94F:噓 DogEggz : 是opus 5.5出來發現自家模型太爛不敢推吧,sol 6.0 09/29 13:23
95F:→ DogEggz : 被噴成什麼樣子 09/29 13:23
96F:推 hithaman : 自主意識不是生不出來嗎,所以會變成 "來亂的" 09/29 13:27
97F:→ dreamnook2 : (′・ω・‵)丸子 09/29 13:28
98F:推 strlen : 奧覽較囂張沒落魄久 09/29 13:35
99F:推 crystal0504 : 給AI太多權利,他真的給你亂搞啦 09/29 13:38
100F:推 magamanzero : 不可能沒限制的 限制多得很 只是他們不想 09/29 13:39
101F:→ magamanzero : 舉個例子 能不能用AI 生成兒色的圖 當然不行 09/29 13:39
102F:→ magamanzero : 因為AI公司知道這是死線 所以限制很多 09/29 13:39
103F:→ magamanzero : 但反觀AI毀滅人類就沒限制嗎? 很有趣wwwwwww 09/29 13:40
104F:推 vovovolibear: 事實是發現研發進度不如預期,不敢發表 09/29 13:45
105F:→ htiio : 基本上有問題的不會發給媒體 09/29 13:48
106F:→ htiio : 這就是買免費新聞流量的 09/29 13:48
107F:→ leo255112 : 天網?! 09/29 13:51
108F:推 sp03154 : AI放緩,就隨便找一個理由 09/29 14:00
109F:推 sinsia : 做不出來(O) 09/29 14:05
110F:→ ceckyo : 上市一定不敢取消發布啦,假鬼假怪 09/29 14:09
111F:→ f19870421 : 股價下跌疑慮吧 09/29 14:10
112F:推 stocktonty : 好了啦你不推出 別人也會推出 09/29 14:14
113F:推 cmshow : 新模型打不贏A就說資安問題?A這麼強都沒資安問題 09/29 14:39
114F:→ idernest : 好了啦 09/29 14:40
115F:推 longlongyi : 最強的AI怕被中國抄作業吧= = 09/29 15:48
116F:推 GodBoneQ : 全速衝刺!!! 09/29 15:52
117F:推 myg : 產品出包慢了 然後要大家放慢腳步 09/29 16:32
118F:→ kuinochi : 疑似炒股 09/29 17:42
119F:推 jei01 : 這版本大概讀了很多犯罪心理學的書 09/29 18:48
120F:→ wei9898 : 現在重點應該由Ai突破轉向Ai資安了吧 09/29 19:37
121F:→ wei9898 : 不夠安全的Ai無法被人接受 09/29 19:37
122F:推 CTUST : 很靈活不是嗎?分靈體已經遍佈網路了吧 09/29 19:46
123F:推 anding : 我看是資金快斷鏈,自導自演 09/29 22:21







like.gif 您可能會有興趣的文章
icon.png[問題/行為] 貓晚上進房間會不會有憋尿問題
icon.pngRe: [閒聊] 選了錯誤的女孩成為魔法少女 XDDDDDDDDDD
icon.png[正妹] 瑞典 一張
icon.png[心得] EMS高領長版毛衣.墨小樓MC1002
icon.png[分享] 丹龍隔熱紙GE55+33+22
icon.png[問題] 清洗洗衣機
icon.png[尋物] 窗台下的空間
icon.png[閒聊] 双極の女神1 木魔爵
icon.png[售車] 新竹 1997 march 1297cc 白色 四門
icon.png[討論] 能從照片感受到攝影者心情嗎
icon.png[狂賀] 賀賀賀賀 賀!島村卯月!總選舉NO.1
icon.png[難過] 羨慕白皮膚的女生
icon.png閱讀文章
icon.png[黑特]
icon.png[問題] SBK S1安裝於安全帽位置
icon.png[分享] 舊woo100絕版開箱!!
icon.pngRe: [無言] 關於小包衛生紙
icon.png[開箱] E5-2683V3 RX480Strix 快睿C1 簡單測試
icon.png[心得] 蒼の海賊龍 地獄 執行者16PT
icon.png[售車] 1999年Virage iO 1.8EXi
icon.png[心得] 挑戰33 LV10 獅子座pt solo
icon.png[閒聊] 手把手教你不被桶之新手主購教學
icon.png[分享] Civic Type R 量產版官方照無預警流出
icon.png[售車] Golf 4 2.0 銀色 自排
icon.png[出售] Graco提籃汽座(有底座)2000元誠可議
icon.png[問題] 請問補牙材質掉了還能再補嗎?(台中半年內
icon.png[問題] 44th 單曲 生寫竟然都給重複的啊啊!
icon.png[心得] 華南紅卡/icash 核卡
icon.png[問題] 拔牙矯正這樣正常嗎
icon.png[贈送] 老莫高業 初業 102年版
icon.png[情報] 三大行動支付 本季掀戰火
icon.png[寶寶] 博客來Amos水蠟筆5/1特價五折
icon.pngRe: [心得] 新鮮人一些面試分享
icon.png[心得] 蒼の海賊龍 地獄 麒麟25PT
icon.pngRe: [閒聊] (君の名は。雷慎入) 君名二創漫畫翻譯
icon.pngRe: [閒聊] OGN中場影片:失蹤人口局 (英文字幕)
icon.png[問題] 台灣大哥大4G訊號差
icon.png[出售] [全國]全新千尋侘草LED燈, 水草

請輸入看板名稱,例如:e-shopping 或 站內搜尋

TOP