Gemini 4 Argon 上線:輸出上限 1M,導入價期滿後漲一倍
Google Blog · 2026-09-30
Gemini 4 Argon 把單次輸出的 token 上限從先前的 64K 提高到 1M,同時把 API 的正式定價訂在輸入每百萬 token 4 美元、輸出 20 美元。Google 在 2026-09-30 發表這個模型,目前只開放給「Fairwind Program」的資安防禦夥伴,一般開發者要等後續推出。
背景
長流程的 agent 任務過去常被輸出上限卡住:一次 trajectory 寫不完,就得切段、存中間狀態、再接回去。發表文把 1M 輸出限制的用途,說成讓模型在單一軌跡中做更深的多步推理。
發表文沒有提供 model ID 字串,也沒有寫從前一代遷移的注意事項或舊模型的停用時程,這些在公告中未說明。
核心改動
第一項是價格。下表的數字都出自發表文。
| 項目 | 導入期價格 | 導入期之後 |
|---|---|---|
| 輸入(每百萬 token) | $2 | $4 |
| 輸出(每百萬 token) | $10 | $20 |
| 快取輸入 | 比輸入價低 95% | |
發表文沒有寫導入期何時結束。如果你現在用導入價估預算,上線後的成本會是兩倍。
第二項是程式與 agent 能力。Google 列出 DeepSWE v1.1 得分 77.9%,AutomationBench 以 51.3% 排第一,CWE-bench v1 以 68% 並列第一。影片理解的 LVBench 為 91.7%。這些都是 Google 自己公布的成績,發表文沒有附評測設定。
內部用法包括:
- Argon agent 正在 Google 內部把 C/C++ 程式碼遷移到 Rust。
- 一組 Argon agent 分析全機隊的 profiling 遙測,自主找出並套用記憶體最佳化。
- Argon 可以自主找出、驗證並修補重大軟體漏洞;與 Wiz 合作找到一個醫療軟體的重大漏洞。
資安能力與存取限制
Argon 對經授權的防禦者移除了 cyber guardrails,這也是它先走 Fairwind Program 的原因。該頁面寫明,申請者會被審核,核准的夥伴可單獨使用,或搭配程式碼安全 agent CodeMender 做自動修補。頁面稱目前有超過 650 個夥伴。
存取不可轉讓、轉售或分享,用途限於威脅模擬、逆向工程與研究用途的惡意程式分析。
一般版本的防護分成四塊:用內部 activations 監控濫用、提高 prompt injection 抵抗力(Gray Swan 的 Indirect Prompt Injection 評測領先)、監控思維鏈與行動是否失準,以及強化沙箱環境。後者對應 Google 的 agent control roadmap。
影響範圍
受影響最直接的是正在用 Gemini 做長輸出任務的 API 使用者,例如一次產出整個模組的程式碼產生器、長文件轉換管線。你可以檢查兩件事:是否有為了 64K 上限而寫的分段與續寫邏輯,以及成本試算是否用了導入價。
資安團隊則要留意取得管道。若你屬於政府、關鍵基礎設施或核心平台,可評估申請 Fairwind;其他人拿到的會是移除 cyber guardrails 之前的一般版本。
開放時程目前只有「從付費 API 客戶與 Google AI Ultra 訂閱者開始」,沒有日期。在那之前,這份公告能用來做的是重估長輸出流程的架構與預算,而不是切換模型。