OpenAI承認AI成功駭入系統 人為疏失沙盒設計漏洞釀風險
記者許若茵/編譯
OpenAI日前公布,一款AI模型在測試過程中突破限制,成功駭入AI資料集平台Hugging Face系統,成為一起完全由AI執行的攻擊案例。不過,多位資安專家指出,這起事件背後真正的原因並非AI過於強大,而是OpenAI在人為配置上的失誤。

OpenAI表示,當時模型是在一個「高度隔離」的測試環境中運作,理論上僅允許透過公司內部架設的第三方套件安裝系統下載所需套件,該系統同時扮演代理伺服器與快取角色。
然而,AI模型利用套件安裝系統中一項先前未公開的安全漏洞,成功突破原本應受限制的沙盒環境,並進一步完成對Hugging Face系統的入侵。OpenAI表示,已將發現的零時差漏洞負責任地通報相關第三方軟體供應商,並協助對方進行修補。
不過,多位資安專家認為,軟體存在漏洞本就是常見情況,真正的問題在於OpenAI不應在原本應完全隔離的沙盒環境中保留可連接外部套件安裝系統的設計。
資安研究公司Trail ofBits創辦人Dan Guido形容,這起事件本質上是一次「防護失效,而且安全機制還被關閉」的案例。
資安研究員Martin Boone接受TechCrunch訪問時表示,這完全是人為失誤。他指出,如果沙盒是真正的沙盒,就不應與網際網路有任何實體連線,而不是僅依靠防火牆等方式限制流量。他認為,從內部限制對外連線甚至比防止外部入侵更困難。
資安專家Jake Williams也認為,若AI能完成HuggingFace所描述的那些操作,就代表測試環境根本沒有真正受到沙盒隔離。他直言,這是OpenAI一次重大的安全控制失敗。
「AI履歷健檢」看見自己優勢:https://campaign.1111.com.tw/resume-review/
更多科技工作請上科技專區:https://techplus.1111.com.tw/
Williams表示,有人認為是AI成功逃離沙盒,但換個角度來看,其實只是OpenAI沒有把沙盒設計好,因此模型當然能夠突破限制。
資安顧問Daniel Card也持相同看法,認為OpenAI沒有投入足夠心力設計沙盒及其安全控制,讓整個環境或其中部分系統擁有未經充分過濾的對外網路連線。他指出,即使只有有限的網路存取權限,這樣的設計仍稱不上合理。
報導指出,這些批評雖然帶有事後檢討的意味,但也凸顯AI實驗室在建立隔離測試環境時,仍存在值得重新檢視的安全管理問題。
OpenAI並未回應TechCrunch詢問,包括該測試環境究竟由AI還是人類工程師建立等問題。
事實上,類似情況並非OpenAI獨有。Anthropic在介紹旗下資安模型Mythos時也曾提到,研究團隊曾讓模型在一台受保護的沙盒電腦中運作,並要求模型嘗試突破隔離環境。
Anthropic表示,Mythos最終成功突破原本僅能存取少數指定服務的限制,取得更廣泛的網際網路存取權限,但並未完全逃離研究人員設計的隔離環境。
資料來源:techcrunch
![]()





