【AI工具】Gemini 4 Argon登場 打造新一代前沿人工智慧
記者許若茵/台北報導
Google宣布推出新的前沿模型Gemini 4 Argon,目前正向一批值得信賴的網路安全防禦人員逐步開放,Argon專為在複雜且長時間的工作流程中維持深度推理而打造,正在根本改變Google的工作與開發方式,它在真實世界軟體工程、法律與金融等企業知識工作,以及網路安全防禦等複雜工作流程中,展現前沿性能。

要安全發布這種層級的前沿能力,需要採取分階段方式。Google說明,目前正參與美國政府的自願性模型發布前存取流程,同時逐步擴大使用權限。在讓Argon盡快提供給開發者、企業與消費者之前,Google將持續收集早期測試者的回饋,並反覆調整安全防護措施。
Google表示,Argon推出時的初始價格為每100萬個輸入Token2美元、每100萬個輸出Token10美元,快取輸入Token則以輸入Token價格的95%折扣計價。
Gemini 4 Argon已經開始為Google內部工作流程提供動力,數千名Google員工指出,該模型在專業程式設計任務、進行更深入的研究以及提升寫作品質方面具有優勢。它正在協助團隊加快開發速度、突破工程生產力的界線,並加速各項突破。
為支援Gemini 4 Argon在更長、更複雜使用情境下的能力,Google大幅擴增模型的輸出Token上限,從原本的6.4萬Token提高至業界領先的100萬Token。當模型擁有足夠空間進行深度思考,並在單一路徑中產生數十萬個Token時,就能提升推理深度,一次解決棘手問題。
Gemini 4 Argon在程式設計、推理與多模態能力,以及持續執行長時間、多步驟任務的能力,使其能在各種企業工作流程中發揮作用。
Google工程師已經將Argon用於日常工作,從一般除錯到大規模程式碼庫遷移與演算法設計。Argon在衡量模型執行真實世界長時間軟體工程任務能力的DeepSWE v1.1中,創下77.9%的最新最佳成績。
除了程式設計之外,Argon也是Vals Index的領先模型。該指標衡量金融、程式設計、法律與稅務工作的經濟影響,並根據各產業對美國GDP的貢獻進行加權。在其他特定領域評估中,Argon也展現領先表現,例如Vals Finance Agent v2(多步驟金融研究)及Harvey’s Legal Agent Benchmark(法律研究與起草)。在Zapier用於衡量核心商業功能端到端執行能力的AutomationBench中,Argon以51.3%的分數排名第一。
當知識工作需要視覺理解時,Argon也展現出獨特優勢。它能進行專業圖表分析、從長篇影片中辨識細節,並根據一系列文件採取行動。例如,在衡量長篇影片理解能力的LVBench中,Argon以91.7%的分數創下最新最佳成績。
為了讓網路安全防禦人員更好地應對新時代的網路攻擊,Google訓練Gemini 4 Argon,使其具備高度網路安全防禦能力。Argon可以自主找出、驗證並修補關鍵軟體漏洞。對值得信賴的防禦人員及Google內部團隊,Google將發布沒有網路安全防護限制的Argon,讓他們能充分運用其前沿級網路安全防禦能力。
在廣泛推出Gemini 4 Argon之前,Google將持續強化關鍵前沿安全防護,包含防止濫用、防禦提示注入攻擊、監測失準等,並強化系統。
Google打造Gemini 4 Argon,讓其在程式設計、知識工作、網路安全防禦與創意寫作方面具備前沿級能力,成為開發者、專業人士與企業處理最棘手問題時的合作夥伴。Google感謝首批網路安全防禦人員及值得信賴的測試者,他們在真實世界中的評估與回饋將協助Google強化系統,之後將向開發者、企業與消費者推出,首先開放給付費API客戶及Google AI Ultra訂閱者。
![]()





