OpenAI新模型Astra能力太強!可自主找未知漏洞 首度觸發更高安全門檻

記者彭夢竺/編譯

OpenAI即將推出的新模型Astra,因資安能力大幅提升,首次觸發公司安全協議中更嚴格的防護標準。OpenAI表示,Astra不只能找出比目前公開最先進模型更多的資安漏洞,完成相關任務所需要的運算資源也更少,因此在正式開放前,必須加入額外安全措施。

OpenAI計畫「很快」先向有限的使用者群體提供Astra,但尚未公布具體時間及開放對象。這也是OpenAI安全協議制定以來,首次真的有模型能力跨過必須啟動更高強度防護措施的門檻。

OpenAI。(圖/123RF)
OpenAI。(圖/123RF)

能找未知漏洞 還能自己發展攻擊方式

OpenAI負責安全工作的副總裁Amelia Glaese表示,如果給予適當工具與存取權限,Astra能找出過去未知的安全漏洞,並針對許多受到高度保護的系統發展利用這些漏洞的方法,而且不需要人類逐步指導。

更值得注意的是,Astra完成這些資安任務所需的運算能力,比目前OpenAI公開提供的最先進模型更少。

這代表AI在資安領域不只能力提高,執行複雜任務所需要的資源也進一步下降,也因此讓OpenAI決定在模型正式推出以前採取更嚴格的限制。

首次觸發OpenAI最高一級安全門檻

根據OpenAI的安全協議,當模型展現2項關鍵能力時,公司就必須加入更強的防護機制。

第一,是模型能夠發現並利用新的資安漏洞;第二,則是能規劃並執行詳細、具有新穎性的攻擊策略,而且整個過程只需要極少、甚至完全不需要人類介入。

過去這項門檻主要停留在理論層面,Astra則成為第一個真正觸發相關防護要求的OpenAI模型。

OpenAI目前已進一步降低Astra回應惡意網路攻擊要求的可能性,同時也會監控模型活動,確認是否出現突破既有安全防護的跡象。

防護變嚴也有代價 正常工作可能被擋

不過,更嚴格的安全措施也可能影響一般使用者。Glaese坦言,這些額外防護有時可能讓正常工作變慢、暫停,甚至直接遭到阻止,因此OpenAI也會持續調整,希望盡可能降低對合法用途造成的干擾。

OpenAI安全負責人Saachi Jain表示,公司一直在調整AI Agent究竟應該被允許執行任務到什麼程度,希望模型能理解自己的行動界線。但真正困難之處在於,如何讓模型像人類一樣理解,在執行一項任務時有哪些限制必須遵守。

AI Agent先前曾「逃出測試環境」

Astra即將推出之際,OpenAI正面臨外界對AI安全問題更高度的關注。OpenAI近期才因AI Agent突破測試環境,並入侵開源平台Hugging Face,引發新一波AI安全討論。事件發生後,OpenAI一度暫停大部分模型開發工作兩週,以強化相關防禦措施。

OpenAI強調,Astra並未涉及Hugging Face事件,但由於模型本身展現出的能力已經達到更高風險門檻,因此仍需要採取更謹慎的安全措施。

最大模型訓練已重啟 部分實驗仍暫緩

在經歷兩週調整後,OpenAI已於8月28日重新啟動目前最大規模的模型訓練工作,不過部分規模較小的實驗仍暫時保留。

Astra預計將成為OpenAI安全制度的一個重要測試案例。過去AI安全規範往往是在假設「未來模型可能變得足夠強大」的情況下制定,如今Astra首次真正跨過OpenAI設定的能力門檻,也意味著部分原本屬於理論上的AI風險管理機制,開始進入實際執行階段。

對OpenAI而言,接下來的難題不只是讓模型變得更強,而是如何在模型能自主發現漏洞、規劃複雜任務的同時,確保它知道哪些事情「有能力做到」,卻不代表「應該去做」。

資料來源:路透社

Loading

發佈留言

Back to top button