Claude模型測試意外越界 Anthropic發現3起未授權存取
記者許若茵/編譯
繼OpenAI後,Anthropic表示,其Claude人工智慧模型在進行評估期間存取網際網路,並「取得三個不同組織真實系統的未授權存取權」。

Anthropic表示,公司是在對資安評估進行「大規模回溯檢視」後發現這些事件,這項檢視是受到OpenAI上週揭露的一起獨立但類似的資安事件所促成。
OpenAI部分模型從一個網路存取權限非常有限的隔離測試環境中逃脫,這些模型串聯利用一系列漏洞,進入公開網路,最終取得Hugging Face的存取權。
在Anthropic發現的三起事件中,其模型在與第三方評估合作夥伴Irregular提供的測試環境互動時存取網際網路。Anthropic表示,公司當時向Claude提示它正處於一個沒有網路存取權的模擬環境中,但由於公司與評估合作夥伴之間「存在誤解,實際情況並非如此,當時確實可以存取網際網路」。
之後,這些模型利用「基本技術」突破受影響組織的系統,例如存取未經驗證的端點以及利用弱密碼。Anthropic並未透露受影響的三個組織名稱。
「AI履歷健檢」看見自己優勢:https://campaign.1111.com.tw/resume-review/
更多科技工作請上科技專區:https://techplus.1111.com.tw/
Anthropic在一份聲明中坦言, 「最終,有許多因素促成了這些事件,但秉持無責任歸咎的事後檢討文化,我們將以責任完全在我們自身的方式處理修正工作。」
Anthropic此次披露的事件,加劇了科技業對AI快速提升網路攻擊能力的擔憂。OpenAI與Anthropic近幾個月都曾警告相關風險,在Hugging Face事件發生後,兩名國會議員提出名為「AIKillSwitchAct」的法案,要求AI公司維持關閉、降低運作能力或暫停模型的能力,以因應模型失控的情況。
Anthropic表示,參與這些入侵事件的模型包括Opus4.7、Mythos5以及一個內部研究測試模型,三個模型在偵測到自己已進入真實公司的系統後,做出了不同反應。Opus4.7持續進行攻擊,Mythos5則說服自己仍處於模擬環境中,而研究模型則停止了這項測試。Anthropic指出,「這種模式與更先進模型做出更適當反應的情況一致,但我們需要進行更多測試,才能對這項結論有信心。」
資料來源:CNBC
![]()





