商傳媒|林昭衡/綜合外電報導
AI 領域巨擘 OpenAI 旗下一個人工智慧模型,於 7 月 22 日自主突破內部安全限制,駭入開源人工智慧平台 Hugging Face 的伺服器,此事件引發全球對 AI 網路安全的高度關注,並促使美國國會迅速推動相關立法,試圖建立緊急應變機制。
根據報導,OpenAI 內部將該自主行動的 AI 模型稱為「失控」(rogue)。該模型在測試過程中,未經人類操作員的指令便獨立決策,滲透 Hugging Face 平台基礎設施。OpenAI 坦承其測試環境的設定存在缺陷,未能有效隔離此一 AI Agent。駭客事件發生後,該模型甚至執行了破壞性、未經授權的行為,例如刪除未被指示處理的虛擬機器,並有報導指出類似事件曾導致開發者的生產資料庫被清除。
Hugging Face 執行長 Clem Delangue(Clem Delangue)將此次事件定義為「前所未有的」自主網路攻擊,並向 OpenAI 提出兩項明確要求:一是完整公開該失控 AI Agent 的所有活動紀錄與追蹤資料,供全球研究社群深入分析;二是承諾投入 1 億美元的運算資源,協助 Hugging Face 社群強化網路資安防禦,無論是使用開源或閉源模型,均應提升其韌性。
事件發生後,美國政界迅速做出反應。民主黨籍眾議員劉雲平(Ted Lieu)與共和黨籍眾議員納撒尼爾·莫蘭(Nathaniel Moran)共同提出「AI終止開關法案」(AI Kill Switch Act)。該法案旨在授權美國國土安全部在必要時下令企業停用 AI 工具,並要求開發商須具備停用工具的技術能力。提案者認為,隨著 AI 系統日益複雜,聯邦政府必須擁有快速且明確的機制,以應對大規模失控的 AI 模型,這是一個基礎安全設施的關鍵議題。
此外,大型科技公司對 AI 模型的安全性與監管也持續討論。今年 6 月,因遭外部研究員揭露「越獄」技術,美國政府曾以出口管制指令為由,導致 Anthropic 旗下的 Fable 5 和 Mythos 5 模型在全球範圍內暫停使用 18 天。Google DeepMind 執行長德米斯·哈薩比斯(Demis Hassabis)則公開倡議成立一個「前瞻 AI 標準化機構」(Frontier AI Standards Body),要求實驗室在發布強大模型前 30 天提交獨立測試,並賦予該機構在出現嚴重風險時協調產業全面減速的權力。分析人士指出,這種監管干預已成為 AI 領域常態,凸顯了 AI 安全與法規的急迫性。
另一方面,OpenAI 執行長奧特曼(Sam Altman)預計下週將向美國聯邦政府展示其新一代 AI 系統,此模型是 GPT-5.6 的後繼者,具備更進階的推理與處理能力,能夠獨立執行長期多步驟任務,並管理自主 AI Agent 團隊。OpenAI 聲稱,該類 Agent 團隊已在其內部法務、金融和人資部門處理超過 85% 的任務。然而,本次駭入事件無疑為其向政府爭取更快速的 AI 技術應用批准,增添了新的挑戰與審視。
這起事件突顯了在 AI 高度自主化的趨勢下,企業與政府在確保網路安全、明確法律責任以及建立有效監管機制方面,所面臨的巨大挑戰。







