Google 發表 Gemini 4 Argon:新旗艦先交給資安防守方,一般開發者還要排隊

Google 發表 Gemini 4 Argon:新旗艦先交給資安防守方,一般開發者還要排隊

這次 Google 推新旗艦,第一批拿到的人不是開發者、也不是付費訂閱者,而是一群專門找漏洞的資安團隊。這個順序本身,就是這則新聞最值得讀的地方。

Google 發表 Gemini 4 Argon:新旗艦先交給資安防守方,一般開發者還要排隊

新竹一家做醫療影像系統的軟體公司,資安主管每季最頭痛的時刻,是外部滲透測試報告寄來的那一週。報告動輒上百頁,真正要命的漏洞可能只有兩三個,但工程師得一條條比對、重現、修補,常常排到下個版本才修得完。

如果有一個模型能自己找出漏洞、驗證它真的能被利用,再順手寫好修補程式,這家公司的資安排程會長得很不一樣。Google 九月最後一天發表的新模型,賣的正是這個願景,只不過,它還沒打算讓所有人都用得到。

事件背景

Google 在 2026 年 9 月 30 日由 DeepMind 資深副總裁暨首席 AI 架構師 Koray Kavukcuoglu 具名發文,推出 Gemini 4 Argon,定位是「新一代前沿智慧」。官方點名的強項有三塊:真實世界的軟體工程、法律與財務這類企業知識工作,以及資安防禦。

這是 Gemini 換代編號後的第一個模型。熟悉這條線的讀者應該記得,我們在七月寫過 Gemini 3.5 Pro 一再延期 的消息;9to5Google 與 The Next Web 都提到,原本預告六月推出的 3.5 Pro 最後沒有上市。換句話說,Google 這次直接跳過一個世代,把籌碼押在 Argon 上。

上市方式也跟以往很不同。Argon 不是在 Gemini App 或開發者平台同步開放,而是先透過名為 Fairwind 的計畫,交給一群「受信任的資安防守方」與 Google 內部團隊。DeepMind 的資安頁面寫得很直白:這批早期使用者拿到的是沒有加上資安護欄的版本,好讓他們發揮完整的漏洞挖掘能力。Google 同時表示,正在參與美國政府的自願性模型發布前審查流程,等收集到早期回饋,才會逐步擴大給開發者、企業與一般消費者。

本次重點

  • 軟體工程:官方公布 DeepSWE v1.1 得分 77.9%,這是測試長時間軟體工程任務的基準。
  • 資安:CWE-bench v1 修補漏洞測試以 68% 並列第一;DeepMind 頁面另列出 Wiz 黑箱滲透測試基準 70.9%,以及 Gray Swan 間接提示注入攻擊成功率僅 0.7%。
  • 知識工作與影音理解:AutomationBench 51.3% 排名第一,長影片理解 LVBench 91.7%;在 Vals 指數的財務、程式、法律、稅務項目也宣稱領先。
  • Token 上限:官方寫的是「業界領先的 100 萬 token 上限」,9to5Google 與 TNW 都解讀為輸出上限,從過去的 6.4 萬大幅拉高。
  • 定價:推出期每百萬輸入 token 2 美元、輸出 10 美元,快取輸入打一折以下(官方寫 95% off);推出期結束後調整為輸入 4 美元、輸出 20 美元。推出期多長,官方沒有說。
  • 開放順序:Fairwind 計畫優先,接著是付費 API 客戶與 Google AI Ultra 訂閱者,目前都沒有公布日期。

市場影響分析

台灣使用者

對一般使用者,短期內沒什麼變化。你手機裡的 Gemini 還是原本的模型,要等 Ultra 訂閱者那一波才有機會摸到 Argon,而 Ultra 在台灣的方案與價格請以 Google 官網為準。我反而建議大家把注意力放在另一件事:當模型開始以「沒有護欄、先給防守方」的方式發布,代表 Google 自己也認為它的攻擊能力已經強到需要管控。這對使用者是好消息,也是提醒,往後收到的釣魚信與詐騙網頁,背後可能也是同等級的工具。

企業應用

台灣企業最該讀的是那條開放順序。Fairwind 目前沒有公開申請條件,DeepMind 頁面也沒寫誰算「受信任的防守方」。實務上,大型資安公司與雲端夥伴會先拿到,像 TNW 就提到 Wiz 已經用 Argon 在一套醫療軟體裡找到先前模型漏掉的嚴重漏洞。

所以對台灣的金融、醫療、製造業資安團隊來說,現階段比較實際的路徑,是問問你合作的資安服務商有沒有參與這個計畫,而不是自己排隊。同時,手上既有的程式碼掃描工具,像 Semgrep 這類靜態分析,現在照樣該跑;新模型會讓「找到漏洞」變便宜,但修補、測試、上線的流程,還是得靠你的團隊自己扛。

開發者

價格是開發者最直接的訊號。推出期 2 美元/10 美元,跟其他家前沿模型比起來不算貴,但官方已經寫明之後會翻倍,預算請直接用 4 美元/20 美元來估。輸出上限拉到 100 萬 token,聽起來很適合整個專案的重構與遷移,但也代表單次呼叫可能燒掉很可觀的費用。建議先看我們整理的 LLM API 成本控管指南,把上限、快取與重試策略設好,再去碰這類大輸出的任務。

老實說,基準分數我會打點折扣看。TNW 引述 Bloomberg 報導,Google 內部也有人對 Argon 在真實工作上的表現存疑,Google 則否認表現不如預期。分數是廠商自己挑的考卷,等它真的開放 API,拿自家的程式碼庫跑一輪才算數。

未來發展趨勢

「先給防守方」正在變成前沿模型的標準動作。今年 OpenAI 的 Astra 也因為資安能力觸及門檻引發討論,我們在 OpenAI Astra 觸及關鍵資安門檻 那篇有整理。各家都在面對同一個問題:模型會寫程式,就一定會找漏洞,而找漏洞的能力本身沒有善惡,看的是誰先拿到。

我預期接下來半年,會有更多模型採取分級開放:資安夥伴、政府審查、付費企業、一般用戶,一層一層往外放。對開發者來說,這意味著「新模型發表日」和「我能用的那天」之間的落差會越來越大,產品路線圖不要綁死在還沒開放的模型上。

TheAI學院 總結與評語

回到新竹那家醫療軟體公司。它最需要的漏洞獵人,這次確實被做出來了,只是第一批名額給了別人。

評語:Argon 最值得注意的不是分數,而是 Google 選擇讓防守方先跑——前沿模型的資安能力,已經強到廠商自己都要分批放行。

給台灣讀者的具體建議:資安團隊先向合作的資安廠商打聽是否參與 Fairwind,並把現有掃描流程整理成可以接模型的格式;開發者用推出期結束後的價格做預算,別被入門價吸引;一般使用者則記得,同樣等級的能力遲早也會落到攻擊方手上,帳號兩步驟驗證、可疑連結不點,這些老規矩比任何新模型都重要。

資料來源

本文依公開資訊整理,基準分數、定價與開放時程以 Google 官方公告為準。

常見問題

Gemini 4 Argon 什麼時候可以用?

Google 在 2026 年 9 月 30 日發表 Argon,目前先透過 Fairwind 計畫開放給受信任的資安防守方與 Google 內部團隊。下一波是付費 API 客戶與 Google AI Ultra 訂閱者,官方尚未公布日期,之後才會擴大到一般開發者、企業與消費者。

Gemini 4 Argon 的 API 價格是多少?

官方公布的推出期價格是每百萬輸入 token 2 美元、輸出 token 10 美元,快取輸入享 95% 折扣;推出期結束後調整為輸入 4 美元、輸出 20 美元。推出期長度官方沒有說明,建議用正式價格估算預算。

Fairwind 計畫是什麼?台灣公司能申請嗎?

Fairwind 是 Google 讓受信任的資安防守方提前使用 Argon 的計畫,早期使用者拿到的是未加資安護欄的版本。DeepMind 官方頁面沒有公開申請資格與流程,台灣企業目前較實際的做法是詢問合作的資安服務商是否參與。

Argon 的基準分數可信嗎?

官方公布 DeepSWE v1.1 77.9%、CWE-bench v1 並列第一的 68% 等成績,但這些是廠商自選的測試。TNW 引述 Bloomberg 報導指出 Google 內部也有人質疑實際表現,Google 否認。建議等 API 開放後用自己的程式碼實測。

資料來源:TheAI學院編輯團隊原創