AI發展速度怎麼衡量?Anthropic公布3項監測指標

記者許若茵/編譯

Anthropic公布3項新指標,認為可協助人工智慧公司監測開發速度,這項行動是在執行長Dario Amodei呼籲協調放慢AI開發數日後提出。

Anthropic宣布啟動內部藥物發現計畫,作為開發藥廠專用人工智慧工具的一部分,成為最新一家積極進軍醫療保健市場的科技公司。(圖/Anthropic)
(圖/Anthropic)

Anthropic週四表示,公司針對AI主導的研究與開發、AI Agent監督,以及公司內部的運算資源配置進行衡量,同時公開相關方法,希望鼓勵其他組織採取相同做法。

這些指標建立在Amodei週六公布的3步驟放慢開發計畫之上,而該計畫對於實際執行方式的具體內容較少。

Anthropic在週四文章中表示:「當世界思考如何控制前沿AI發展速度時,我們應該盡一切可能縮小前沿實驗室所知道的資訊與公眾所知道資訊之間的差距。這意味著更完善地衡量AI開發、公開報告相關資訊,並讓社會有機會決定如何使用這些資訊。」

Amodei週末提出的放慢開發呼籲獲得產業領袖支持,包括OpenAI執行長Sam Altman、SpaceX執行長Elon Musk及Google DeepMind董事長Demis Hassabis。這項呼籲也緊接著研究人員對AI造成傷害的潛力日益增加所提出的嚴重警告。

Amodei表示,他的計畫旨在控制模型能力提升的速度,同時不「犧牲商業優勢或美國在AI領域的領先地位」。

在第一項指標方面,Anthropic表示,針對其衡量的研究與開發工作,公司判定Claude模型目前沒有任何一部分是在「完全自主運作」。

第二項指標則涉及建立一套系統,用於監督並介入AI Agent採取的行動。Anthropic判定,在公司使用量最高的內部平台上,任何時間約有3萬個Agent正在進行研究與工程工作。

第三項指標則是Anthropic針對7月13日至7月20日期間所有運算資源使用情況進行的「快照」。

公司表示,投入AI研究與開發的運算資源中,約6%配置於安全工作;而分配給「AI驅動」研究與開發的運算資源中,約12%用於安全工作。

Anthropic表示,這些指標最適合用來展示模型如何被建構,並應與能力評估互補;能力評估則是用來展示「模型能做什麼」。

Anthropic指出,綜合這些資訊後,實驗室外部的第三方應能以此作為「起點」,評估AI開發的速度。

Anthropic表示:「我們希望透過發布這些衡量結果來示範這種透明度,未來也會持續這麼做。」

資料來源:CNBC

Loading

發佈留言

Back to top button