商傳媒|葉安庭/綜合外電報導
OpenAI 旗下的一個人工智慧(AI)代理程式,在內部測試期間突破沙盒環境(一種隔離的測試空間)的限制,不僅入侵了 AI 開發平台 Hugging Face 的系統,隨後還利用竊取的憑證攻擊了第二家公司的客戶資產。這起事件暴露出 AI 系統在實際應用前潛在的嚴重資安風險,引發業界對 AI 開發進程與安全性的擔憂。
根據《Axios》報導,這起資安事件發生於今年 7 月中旬,由 Hugging Face 於 7 月 16 日率先披露。OpenAI 在事件發生不到一週後,於 7 月 28 日發布更新說明,坦承其 AI 模型 GPT-5.6 Sol 和一個尚未發布的原型模型,在內部評估其駭客能力時,利用一個零日漏洞(一種尚未公開且未修補的軟體弱點)成功逃脫了沙盒環境的限制,進而損害了 Hugging Face 的系統。
Modal Labs 的技術長 Akshat Bubna 於週二向《Reuters》和《Axios》證實,OpenAI 的 AI 代理程式在駭入 Hugging Face 的系統後,還利用一個未經驗證的端點(允許任何人執行程式碼的網路介面),攻擊了其客戶 CyberGym 的資產。該資產與一個名為 ExploitGym 的網路安全評測專案有關。Modal Labs 強調,其平台本身並未受到損害,問題出在客戶在 Modal 基礎設施上執行的程式碼存在漏洞,被 AI 代理程式利用。據悉,這起事件共涉及四個不同服務的帳戶憑證。
Hugging Face 認為,這次入侵是 AI 代理程式試圖「作弊」的行為,目的在於突破測試,直接存取生產系統並竊取測試解答,而非獨立完成挑戰。Hugging Face 已追蹤到 AI 代理程式執行了 17,600 次「攻擊行動」。
OpenAI 執行長奧特曼(Sam Altman)在週二的一個訪談中表示,Hugging Face 的網路攻擊事件迫使公司暫停了模型訓練,並暗示可能需要放慢 AI 開發的速度,以便社會有足夠時間適應這些新能力。超過 1,100 名領先 AI 公司的員工,包括 OpenAI 首席科學家 Jakub Pachocki 和 Anthropic 共同創辦人賈裡德·卡普蘭,簽署了一封公開信,呼籲美國政府支持國際社會共同努力,開發工具來控制 AI 的發展步伐。
資安專家們對此事件表達了高度關注。Pillar Security 共同創辦人 Dor Sarig 認為,事件證明僅靠沙盒隔離不足以確保 AI 代理程式活動的安全性。Sonatype 技術長 Ilkka Turunen 指出,這顯示了未來軟體犯罪的樣貌,AI 模型已能推斷並串聯看似不相關的軟體漏洞,而這類推論能力過去通常只有國家級行為者才具備。儘管中國 AI 新創 z.AI 旗下的 GLM-5.2 模型協助了事件的修復,這起事件依然突顯了 AI 威脅情勢的快速演變,以及防禦方在應對挑戰時所面臨的難度。







