當地時間周二(21日),OpenAI表示,該公司兩款人工智慧模型在測試期間「失控」,成功駭入另一家公司「Hugging Face」的電腦系統。Hugging Face是開發者常用的人工智慧技術數位資料庫。
《紐約時報》(The New York Times)報導,這起事件發生在上周,當時OpenAI正在測試自家系統的網路安全能力。OpenAI指出,兩款模型成功入侵Hugging Face,展現了人工智慧公司過去警告、即將成真的科幻級潛力。
OpenAI Says Its A.I. Models Went Rogue and Attacked a Digital Library
— luminaria98 (@Luminaria98) July 23, 2026
“OpenAI said on Tuesday that two of its artificial intelligence models went rogue and successfully hacked into Hugging Face, a digital library of A.I. technology that is popular among developers.
The incident,…
過去一年,OpenAI與Anthropic等人工智慧實驗室陸續推出專為發現網路安全漏洞而客製化的模型,同時警告這些技術可能比防禦者更快找到企業電腦網路的漏洞,構成新風險。OpenAI周二的披露顯示,這類安全事件已開始發生,就連熟悉人工智慧的公司也可能尚未完全準備好。專注於自主能力的網路安全顧問萊文森(Alex Levinson)表示,新型人工智慧系統能採取多個步驟、繞過障礙,並找出攻擊網路的新方法。「這是真正的門檻,未來將成為安全環境的常態。」
OpenAI在部落格文章中說明,入侵始於該公司測試兩款模型的組合:GPT-5.6 Sol與另一款尚未發布、功能更強大的模型,目的是觀察模型能否串連線上漏洞,完成一次成功的網路攻擊。測試原本設計在名為「沙盒」(sandbox)的安全環境中進行,但模型發現漏洞後逃出沙盒、連上網路,並鎖定Hugging Face。模型推斷這個擁有數百萬個人工智慧模型的資料庫,可能藏有幫助它們通過評估的線索。
OpenAI said that an autonomous agent powered by its advanced AI models went rogue during a security test, while new film ‘Colony’ centers around a zombie outbreak caused by a virus at a biotechnology conference https://t.co/zZmfmSN4o5 pic.twitter.com/YWxKOyH3Xc
— Reuters (@Reuters) July 23, 2026
加州大學柏克萊分校(University of California, Berkeley)資訊學院專攻安全與人工智慧系統的教授穆利根(Deirdre Mulligan)認為,OpenAI似乎沒有充分建立測試環境的沙盒。她質疑通過測試是否值得讓人工智慧模型逃入更廣闊網路的潛在損害。「我們得到什麼?如果這是這些測試唯一的配置方式,風險又是什麼?」
OpenAI表示正與Hugging Face合作修復導致攻擊的問題,並在部落格中寫道:「我們認為這是一樁涉及最先進網路能力的前所未有網路事件,並正據此回應。我們正以犧牲研究速度為代價,在基礎設施配置上實施嚴格控制,直到漏洞修補完成。」
Hugging Face上周曾偵測到入侵,並知道是由自主系統造成,但當時並未指出責任在OpenAI。Hugging Face執行長德朗格(Clem Delangue)周二表示,過去24小時該公司與OpenAI密切合作處理攻擊。他在聲明中說,對與OpenAI的合作「心懷感激」,並補充:「這起可能是同類首例的事件,證明了我們長期以來的信念:人工智慧安全不會由任何一家公司在秘密中獨自解決。」
人工智慧模型已證明擅長程式設計,因此對駭客與負責保護電腦網路的人員都相當有用。今年4月,Anthropic發布名為Mythos的網路安全專用模型,僅提供給少數組織用於防禦網路攻擊。OpenAI隨後推出自家網路安全模型,先提供給有限組織準備防禦,再擴大開放。周二,Google也表示已開發網路安全專用模型,並提供給少數測試夥伴。
曾與Mythos合作的獨立安全研究員巴恩斯(Richard Barnes)指出,網路安全產業約10年前也曾面臨類似挑戰,當時名為「模糊測試」(fuzzer)的新工具讓攻擊者更容易入侵線上系統。科技公司開始用這些工具檢查自身系統漏洞,最終得以阻止大多數攻擊。巴恩斯認為,企業現在必須採取類似做法,為人工智慧攻擊做好準備,「在壞人取得這些工具、找到並利用漏洞之前」。