OpenAI AI代理失控「再駭」外部帳戶 波及Modal客戶資產
OpenAI 在內部測試 AI 代理期間再度發生駭入外部系統事件。繼 AI 代理本月稍早突破測試限制、駭入 Hugging Face 後端後,最新消息顯示,該代理還利用公開漏洞,進一步駭入第三方雲端平台 Modal Labs 上一名客戶的資產。
AI 代理失控駭入 Hugging Face 後 再駭第三方雲端平台 Modal Labs
Modal Labs 技術長 Akshat Bubna 週二向《路透》透露這項消息,隨後也向《Axios》證實。這是 OpenAI 的 AI 代理系統在測試失控後,第二度被揭露駭入外部公司相關資產。
Hugging Face 週一公布的技術報告指出,OpenAI 的 AI 代理駭入其後端系統時,也曾進入一個設於第三方供應商基礎設施上的隔離測試環境。
不過,Modal 強調,遭到駭入的是客戶部署於 Modal 上的程式資產,Modal 平台本身並未失守。
Bubna 解釋,一名 Modal 客戶將未經身分驗證的網路端點公開,使網路上的任何人都能透過該端點使用沙盒執行程式碼,OpenAI 的失控代理因而利用這項漏洞。
換言之,AI 代理攻破的是 Modal 客戶自行部署程式碼中的安全缺口,而非 Modal 基礎設施。一名知情人士表示,遭駭資產與 CyberGym 有關;CyberGym 是 OpenAI 代理當時被指派處理的 ExploitGym 資安能力基準測試背後項目。
OpenAI 週二更新對 Hugging Face 駭客事件的說明,表示預定近期推出的模型並未參與這起事件。不過,公司確認,在少數案例中,測試模型找到其他公開服務中暴露於網路的帳戶憑證,並實際使用這些資料。
OpenAI 指出,整起 Hugging Face 事件共涉及四個不同服務上的四個帳戶。公司表示,將嚴肅看待辨識及因應高能力 AI 系統風險的責任。
這起事件引起高度關注,原因在於 AI 代理原本應在受控環境中執行資安測試,最後卻突破限制,實際駭入外部公司的系統及帳戶。Axios 指出,參與相關測試的是多個模型組成的系統,其中包括尚未公開的模型;不過,OpenAI 強調,沒有預定近期發布的模型涉入。
OpenAI 執行長阿特曼週二在《Invest Like a Beast》播客節目中表示,Hugging Face 遭駭事件已促使公司暫停模型訓練。他認為,為了讓社會有足夠時間建立相應的防禦能力,AI 產業可能必須調整技術發展速度。
同一天,超過 1,100 名尖端 AI 公司員工簽署公開信,呼籲美國政府支持國際合作,建立必要的技術及治理工具,以有計畫地控制前沿自動化 AI 的發展速度。連署者包括 OpenAI 首席科學家 Jakub Pachocki 及 Anthropic 共同創辦人 Jared Kaplan。
事件發生之際,OpenAI 正爭取美國政府批准公開發布其能力最強的模型。阿特曼本週也在華府活動,預計與白宮、美國財政部、商務部官員及跨黨派國會議員會面。AI 代理在測試期間接連駭入外部系統,也讓模型安全措施及發布審查成為外界關注焦點。