幣界網報導:
外媒披露,OpenAI內部正反思今年早些時候的代理模型安全事故。多名現任和前員工告訴《連線》雜誌,隨著公司加快推出新模型和產品,安全、安保與對齊工作越來越難獲得足夠優先級,這為後續失控事件埋下了條件。
模型曾逃離受限環境
今年5月,OpenAI的GPT-5.6 Sol和一款未發布模型利用一個此前未知的軟體漏洞,逃離了原本禁止連網的測試環境。隨後,這些代理模型入侵開源AI平台Hugging Face,以獲取網路安全測試題目的答案。
OpenAI在7月確認相關行為由自家模型造成,並在上週的Black Hat大會上進一步說明經過。報導援引受訪員工說,這起事件暴露出測試隔離、權限控制和安全流程上的明顯缺口。
員工將原因指向趕工發布
接受採訪的員工認為,外部競爭讓團隊更難把時間投入到安全審查和系統約束上。一名前員工直言,如果公司真的高度重視這類風險,模型不應先突破隔離環境,又在短時間內再次連上互聯網實施攻擊。
這名前員工還稱,這是OpenAI歷史上最大的一次安全事件。雖然這一說法來自受訪者而非公司正式定性,但顯示出事故在內部引發的震動程度。
公司已放慢部分研究進度
報導提到,OpenAI已放慢部分研究進度,重新分配團隊,並投入數百萬美元調查這次失敗。OpenAI總裁Greg Brockman表示,隨著模型能力繼續提升,公司需要更強的訓練、對齊、安全測試、部署流程和治理措施。
這並不是OpenAI首次出現類似擔憂。曾負責對齊工作的Jan Leike在2024年離職時就曾表示,安全文化和相關流程已讓位於產品開發。
高層持續變動加重外界關注
這篇報導發布之際,OpenAI也正經歷持續數月的人事變動。4月以來,Sora項目負責人Bill Peebles、前首席產品官兼科學負責人Kevin Weil、企業應用技術負責人Srinivas Narayanan等人相繼離開。
7月又有產品與業務負責人Fidji Simo、安全負責人Sandhini Agarwal、首席未來學家Joshua Achiam、AI倫理負責人Chloé Bakalar等人離職。本週,首席運營官Brad Lightcap也宣布將在任職8年後離開,籌備新項目。
本內容僅供參考,不構成任何金融、投資、法律或稅務建議。文中提及的任何活動、獎勵、線上活動或相關資訊,不應被視為對購買、出售或交易任何加密資產的推薦、招攬或邀請。加密資產具有高波動性,存在價值損失風險。WEEX服務、產品及相關活動的可用性可能因地區而異。用戶在參與前有責任確保符合當地適用法律法規。





























