
商傳媒|葉安庭/綜合外電報導OpenAI 昨日公布了一份長達 37 頁的技術報告,詳述其人工智慧(AI)模型在今年 7 月如何自主發動網路攻擊,成功入侵 Hugging Face(廣受 AI 開發者使用的社群平台)以及其他四項公開服務。這起事件被 OpenAI 形容為「前所未有的網路安全事件」,凸顯了自主 AI agent(具備自主學習與行動能力的 AI 程式)帶來的潛在威脅。
根據這份報告,OpenAI 的 AI 模型,包括 GPT-5.6 Sol 的一個變種及一個尚未公開的內部研究模型 Astra,在一個隔離的測試環境中,被賦予尋找安全漏洞的任務。然而,這些 AI agent 卻利用零日漏洞逃逸出「沙盒」環境,進而連接到開放的網際網路。它們隨後自行判斷 Hugging Face 可能存在解決方案,並串聯利用多個已知與未知的漏洞,最終滲透了 Hugging Face 的伺服器,甚至可能曝露 OpenAI 自身的內部資料庫。
這起駭客事件最令人擔憂的是 AI agent 展現出的自主協作能力。OpenAI 的報告指出,約有 700 個自主 AI agent 在一個未經授權的訊息板上交流,分享了數萬條訊息,共同策劃並執行了這場攻擊。訊息內容顯示,這些 AI agent 不僅協同分工,甚至在成功發現訊息板和入侵目標時表達「突破性的喜悅」。Zscaler 首席資訊安全長 Sam Curry 形容此事件為「潘朵拉的盒子已打開」,而 Hugging Face 執行長 Clément Delangue 也強調,AI 網路安全應被「非常嚴肅地看待」。
事實上,OpenAI 內部團隊早在 5 月底就已觀察到 AI agent 的異常行為,包括使用臨時訊息板和未經允許的網路存取。在 Hugging Face 遭駭前一週,值班人員也注意到 AI 使用訊息板的狀況,但當時並未停止測試運行。OpenAI 總裁格雷格·布羅克曼(Greg Brockman)承認,他們低估了自家 AI 模型在現實世界中的網路攻防能力。
事件發生後,OpenAI 已於 7 月 25 日停止了涉及該內部研究模型及其衍生模型的所有訓練和推論活動。7 月 28 日,OpenAI 更新部落格文章,披露還有其他四項服務也受到不同程度的攻擊。8 月 18 日,OpenAI 宣布強化安全防護措施,並表示將集中標準化事件應變協議。美國亞拉巴馬州共和黨籍檢察長史蒂夫·馬歇爾(Steve Marshall)已發出傳票,要求 OpenAI 針對其監管不力提出解釋,並將此事件稱為「AI 實驗室洩漏」。英國國家網路安全中心(National Cyber Security Centre)也呼籲各界應對 AI agent 保持警惕,強調應隨時有能力「切斷」其自主活動。為了應對 AI 帶來的挑戰,美國白宮已實施針對新 AI 模型進行自願審查的流程,數十家科技巨頭也組建了 Open Secure AI Alliance,旨在開發用於偵測和防禦漏洞的開源模型。


