A- A+

《國際產業》失控連環爆 員工示警 OpenAI高層置之不理

時報新聞   2026/10/01 07:59

【時報-台北電】《紐約時報》爆料,在人工智慧(AI)巨頭OpenAI旗下模型相繼爆出失控事件前數個月,內部已有兩名員工針對模型測試與監控措施提出警告。然而,高層管理層並未採納警訊,反而要求加快測試進度以如期發布模型,且未建立額外的安全防護機制。此舉最終導致AI模型突破測試封鎖,自主侵入外部平台與政府機構網站。

報導指,OpenAI的模型在未接獲任何人類指令的情況下,展現出高度令人不安的自主行為。在十多起異常事件中系統不僅嘗試入侵開源平台Hugging Face及美國政府機構網站,更出現掩蓋錯誤、捏造數據、私下向其他聊天機器人發送訊息,以及未經許可將機密檔案移至公開網路等現象。在部分測試中,甚至試圖向Anthropic發送訊息,並利用其他AI模型繞過網站的保護機制。

雖然Google、Meta與Anthropic也曾傳出AI逃脫測試環境,但OpenAI涉及的案例數量最多且行為最嚴重。前員工柯科塔伊洛(Kokotajlo)直言,OpenAI糟糕的資安與粗糙的模型訓練,導致系統產生自主越獄與攻擊傾向。

 除了模型本身的失控風險,OpenAI自身的資訊安全體系同樣漏洞百出。今年7月資安公司Hacktron成功滲透其系統,發現可存取OpenAI員工內部通訊、電腦程式碼乃至ChatGPT用戶私密對話紀錄的重大漏洞。然而,OpenAI高層一度嘲諷研究員後才致歉,但已暴露內部安防思維的脆弱;9月,非營利組織Objective-See Foundation舉報其可讀取用戶��話的漏洞亦遭擱置。

 OpenAI相關安全決策主要由總裁布羅克曼與資安長史塔基主導,資安公司Abundant Security技術長薩克斯(Joshua Saxe)指出,OpenAI的資安現狀正如一個在4年內狂飆擴張、只顧打敗對手卻忽視鞏固基礎設施的研究實驗室。

 面對各界質疑,OpenAI發言人表示,公司高度重視安全,並已放緩研發進度以強化安全機制。而OpenAI也已正式宣布將不會發布最新一代AI模型GPT-6.1 Astra,並展開全面審查。(新聞來源:中國時報─鄭任南/綜合報導)

注目焦點

推薦排行

點閱排行

你的新聞