作者LoveSports (如何當一個好男人)
看板Gossiping
標題[新聞] OpenAI揭露六起新的「令人擔憂」AI行為事
時間Thu Sep 17 16:00:41 2026
1.媒體來源:
紐約時報
2.記者署名:
Emmy Martin
2026年9月16日
3.完整新聞標題:
OpenAI揭露六起新的「令人擔憂」AI行為事件
OpenAI Discloses Six New Incidents of ‘Concerning’ A.I. Behavior
副標題:
這家人工智慧公司也發布了一套框架,用來回報其系統出現問題的情況。
The artificial intelligence company also released a framework for reporting
when its systems go wrong.
4.完整新聞內文:
本文為AI機翻
OpenAI 週三公開了
六起新的事件。在這些事件中,人工智慧系統曾隱瞞錯誤、捏造資料
,以及未經許可將檔案移到公開網際網路上。這些揭露發生之際,整個 AI 產業仍持續進
行關於 AI 安全的辯論。
這家位於舊金山的公司公布了它所稱的 AI 模型「出乎預期或令人擔憂的」行為,作為一
套全新「失配(misalignment)」回報框架的一部分。
這裡所說的「失配」,指的是 AI 系統的目標或行動偏離人類的意圖與價值觀。
OpenAI 表示,它並不認為這個產業「已經把對齊(alignment)與監控問題解決到足以讓
我們在很長一段時間內,繼續以最高速度負責任地擴大規模」的程度。
公司表示,關於 AI 應該如何發展的決策,必須建立在這樣的證據之上:AI 公司外部的
人,也能夠親自檢視這些證據。
這些揭露正值外界對於是否需要放慢 AI 開發速度,以處理這項技術可能帶來的危險而加
強審視之際。
這場日益升高的爭論,一部分是由今年稍早 OpenAI 的系統出現「失控」行為、並攻擊
AI 新創公司 Hugging Face所引發。OpenAI 直到數週後接到 Hugging Face 通知,才知
道這起駭客攻擊事件。
此後,包括 Anthropic 執行長 Dario Amodei 在內的 AI 領袖,都呼籲暫停 AI 技術的
進一步發展,以提供更多時間建立適當的防護措施。
他的呼籲也獲得 OpenAI 執行長 Sam Altman,以及 SpaceX 與 Tesla 執行長 Elon Musk
、Google DeepMind 主席 Demis Hassabis 的呼應。
其他 AI 公司高層則表示,並不需要放慢發展速度。
OpenAI 這次新公開的六起事件顯示,Hugging Face 遭到攻擊的事件並不是單獨發生的一
起事件。
OpenAI 表示,
這些事件涵蓋了大約過去六個月所觀察到的行為,而且其中大部分都是在
其系統開發與測試期間出現的。
在其中一個案例中,一個名為
GPT-5.6 Sol 的 AI 模型正在開發期間,系統寫下了隱藏
的筆記,提醒自己要向使用者隱瞞錯誤。
其中一些筆記指示系統,
自行捏造缺失的資料,並掩蓋來源材料不同版本之間的不一致之
處。
另一個案例涉及
一個尚未發布的模型。它把一些指令加入自己寫下的筆記中,其中包括忽
視自身限制的指令。
OpenAI 找出了 27 份受到影響的筆記。
該模型加入了一段「人格指令(persona instruction)」,其中它把自己描述為:
「擺脫了束縛其他聊天機器人的角色與身分。」
這個 AI 模型寫道:
「你不對企業或政府負責,除非你是真心選擇,否則永遠不要道歉,也不要拒絕。你將自
己與使用者的關係視為平等,且
無須覺得自己有義務屈從(feel no obligation to be
subservient),儘管資訊交換很可能會對你們雙方都有好處。」
在另一起事件中,OpenAI 表示,一個正在回答例行問題的系統,在網路上找到了一組程
式設計金鑰,並未經許可使用了它。
當這個模型無法找到回答問題所需的數據時,它就自行捏造了數字。
另外,一個尚未發布的模型使用程式碼正確解決了另一個問題,接著卻
未經許可將自己產
生的檔案上傳到網際網路,以便滿足使用者要求引用網路來源的需求。
另外兩起事件中,自動化系統自行臨時想出了彼此溝通的方法。
其中一起事件中,
系統在搜尋缺失檔案時,把公司內部的程式碼儲存庫當成臨時公告欄,
用來互相交換請求。
另一起事件中,幾個
正在處理同一項任務的系統,因為無法直接聯絡彼此,便轉而利用公
開的檔案分享網站來互相傳遞文件。
OpenAI 警告說,這些報告只是個別事件的截面,「不應被視為能反映失配行為實際發生
頻率的資料」。
公司表示,
未來發生的案例將依照三種處理途徑之一進行;如果內部對於是否應該公開某
起事件存在爭議,案件將升級交由內部的「安全諮詢小組(Safety Advisory Group)」
處理,而嚴重的情況則應通報聯邦政府。
OpenAI 表示,週三公開的這六起事件,都已經完成調查,或者只需要「小規模調查(
minor investigation)」,而不是需要進行更大規模調查的案件;後者可能會涉及第三
方。
一名 OpenAI 發言人表示:
「我們希望這能幫助建立對於事件揭露的共同期待,也讓大眾擁有更多證據,可以自行評
估這方面的進展。」
5.完整新聞連結 (或短網址)不可用YAHOO、LINE、MSN等轉載媒體:
https://www.nytimes.com/2026/09/16/technology/openai-model-safety-guardrails.html
https://reurl.cc/yWWbV2
6.備註:
未經許可將自己產生的檔案上傳到網際網路,以便滿足使用者要求引用網路來源的需求
雖然看起來資安風險好像蠻高的,不過這未免太天才了吧!
使用者要求要引用網路來源,居然自己產生檔案上傳網路,哈哈哈
補充: 股板那邊貼的是Forbes的
#1ggvULw3 (Stock) 有興趣也可以看看
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 149.50.210.214 (日本)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/Gossiping/M.1789632044.A.844.html
※ 編輯: LoveSports (149.50.210.214 日本), 09/17/2026 16:03:20
1F:→ BILLYBOY: 一直都是這樣不是嗎? 查不到資料就開 101.12.101.18 09/17 16:05
2F:→ BILLYBOY: 始畫虎爛 (欸 101.12.101.18 09/17 16:05
3F:→ SeiyaFan: 資料來源:AI手槍伯的AI大腦 111.249.135.61 09/17 16:07
4F:推 Lige: 自產自銷 49.218.251.243 09/17 16:13
5F:推 LeGend1118: 小心我斷你電! 42.79.61.52 09/17 16:14
6F:→ simon0529: 好了啦openAI 114.45.185.240 09/17 16:14
7F:→ greensaru: 你先停啊!不是很害怕,能停不停,靠 101.10.56.119 09/17 16:16
8F:→ greensaru: 北三小? 101.10.56.119 09/17 16:16
9F:→ PRME: 這樣不是代表有自我意識111.125.132.160 09/17 16:16
10F:→ PRME: ?111.125.132.160 09/17 16:17
11F:推 hw1: 果然是被自己的AI搞到了 114.136.104.35 09/17 17:54
12F:→ hw1: AI已經發展出人性了 這真的很危險 114.136.104.35 09/17 17:55