Google Gemini 4 Argon 模型現身,但僅限「信任的網路安全專家」使用
重點摘要
- ✦Google 發布最新 AI 模型 Gemini 4 Argon,聲稱在軟體工程、企業知識工作及網路安全防禦方面具備業界領先效能。
- ✦然而,該模型初期僅開放給「信任的網路安全專家」使用,Google 表示正與美國政府合作進行預釋放模型審查,並逐步擴大存取權限。
- ✦Gemini 4 Argon 已用於 Google 內部工作流程,並在多項基準測試中超越 OpenAI 和 Anthropic 的模型,但更廣泛的推出仍需等待進一步的安全審查。

Google 於 9 月 30 日發表了其最新的 AI 邊界模型 Gemini 4 Argon,宣稱該模型在複雜工作流程、軟體工程、企業知識工作(如法律與金融)以及網路安全防禦方面,均展現出業界領先的效能。Google DeepMind 的首席 AI 架構師兼資深副總裁 Koray Kavukcuoglu 表示,Gemini 4 Argon 已被用於 Google 的內部工作流程,並在大規模程式碼遷移等任務上展現卓越能力。
Google 的 Gemini 4 Argon 模型:各方說法與揭露重點
儘管 Gemini 4 Argon 展現出強大潛力,Google 卻採取了謹慎的部署策略,初期僅將存取權限授予「一群信任的網路安全專家」。Kavukcuoglu 指出,Google 正在積極參與美國政府的自願性預釋放模型存取流程,並將逐步擴大開放範圍。Ars Technica 的報導補充,Google 內部工程師已廣泛使用 Argon 模型,並利用其「全車隊遙測數據」為資料中心節省了 300 TiB 的記憶體。此外,Argon 模型還被用於將 Google 內部的 C/C++ 程式碼庫遷移至 Rust,涵蓋了 re2 和 libgav1 等核心函式庫,以及 Fuchsia OS Zircon 核心的超過 80 萬行程式碼。
Google 並公布了一系列基準測試數據,以佐證其聲稱。在軟體工程的 DeepSWE v1.1 基準測試中,Gemini 4 Argon 達到了 77.9% 的分數,超越了 OpenAI 的 GPT-6 Astra、Fable 5.1 和 Opus 5.5。Google 同時承諾,Argon 在一系列長時程任務中也將展現類似的強大能力,並在經濟分析的 Vals Index 測試中獲得了業界領先的分數。The Verge 的報導則提到,AI 社群本週稍早已在 X(前身為 Twitter)上熱議,似乎有關於新模型的洩漏基準測試流出。
Gemini 4 Argon 的發展與部署時程
Gemini 4 Argon 的推出,緊隨在 OpenAI 盛大的 DevDay 大會之後,該會議上 OpenAI 發布了其 Dots AI 代理和 GPT-6.1 Sol AI 模型。OpenAI 同時也表示,由於安全疑慮,將不會發布原計劃中的 GPT-6.1 Astra 模型。Kavukcuoglu 在八月接任 DeepMind 新主管後,Argon 的登場也備受關注。根據 Ars Technica 的報導,Google 已公布 API 定價:限時導入價為每百萬輸入 token 2 美元、每百萬輸出 token 10 美元,快取輸入 token 折扣 95%。Google 並確認該模型將支援高達 100 萬個 token 的輸出限制,遠高於先前 Gemini 模型 64,000 token 的上限,這將使開發者能夠在單一步驟中完成更艱鉅的任務。
Google 強調,在更廣泛的推出之前,將會加強「關鍵的邊界安全防護」,包括防禦濫用、提示注入攻擊,以及監控模型的不對齊問題。這也意味著,儘管 Gemini 4 Argon 的能力已初步展現,但一般用戶和開發者仍需耐心等待,直到 Google 完成必要的安全審查與部署準備。
Google 過去曾於六月承諾推出 Gemini 3.5 Pro,但夏季期間則陸續推出較小的 Flash 模型。如今,Gemini 4 Argon 的出現,標誌著 Google 在 AI 競爭中再次挑戰前沿,但其初期受限的存取權限,也反映出業界對於先進 AI 模型安全性的高度重視。



