AI 前沿 2026 年 9 月 21 日

2026-09-21 — Gemini 3.8 Flash 分兩版,Cyber 版鎖進白名單

primary=https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/ primary=https://ai.google.dev/gemini-api/docs/models primary=https://deepmind.google/fairwind-program/

Gemini 3.8 Flash 分兩版,Cyber 版鎖進白名單

Google Blog · 2026-09-02

Gemini 3.8 Flash 把上一代 3.5 Flash 的定價直接調升,換來的是在 DeepSWE v1.1、Vals Finance Agent V2 等基準上超越多數規模更大的前沿模型;同一天發布的 Gemini 3.8 Flash Cyber,則是把資安漏洞挖掘與修補訓練成模型本身的核心能力,而不是靠外部規則堆出來的護欄,在 CyberGym 漏洞探索基準上的分數超越了上一代 3.5 Flash Cyber 與規模更大的競爭模型。兩者由 Google 於 2026 年 9 月 2 日同時發布,API 型號代號為 gemini-3.8-flash;Cyber 版則只透過 Fairwind Program 開放給受信任的政府單位與關鍵基礎設施維運者。

核心改動

一般版 Gemini 3.8 Flash 定位在「長時程軟體工程、自主代理與企業工作流」,在 HLE-Verified(跨 STEM、人文、專業領域的多步推理基準)拿下 54.9%;在法律代理基準 Harvey's Legal Agent Benchmark 與金融代理基準 Vals Finance Agent V2 上,Google 表示同樣超越 3.7 Flash 與其他前沿模型。

Cyber 版的差異不是換個名字重新包裝,而是把「防禦端」的訓練資料與評測直接塞進模型:在涵蓋 20 種程式語言的內部漏洞探索基準上,成功率超過 70%;在 CyberGym 上拿下 86.2%;在修補類的 CWE-Bench 上 pass@1 達 47.2%。對比 Chrome 資安團隊的測試,Cyber 版產出的正確修補數量是主流商用模型的 2.6 倍;在 Wiz 的漏洞偵測基準上,召回率高出 7.5%–9.7%,成本卻只要對手的 1/2.3 到 1/5.2。在抗提示注入的 Gray Swan 測試上,Google 只形容為「顯著躍進」,沒有給出具體分數。

規格細節

定價分兩階段:2026 年 12 月 31 日前為導入價,輸入每百萬 token US$0.75、輸出每百萬 token US$3.752027 年 1 月 1 日起調整為輸入 US$1.50、輸出 US$7.50,等於漲了一倍。

項目3.8 Flash3.8 Flash Cyber
HLE-Verified54.9%未公布
CyberGym未公布86.2%
CWE-Bench pass@1未公布47.2%
導入價(輸入 / 輸出,每百萬 token)US$0.75 / US$3.75US$0.75 / US$3.75
2027 起價(輸入 / 輸出)US$1.50 / US$7.50US$1.50 / US$7.50
取得管道Google AI Studio / API 公開Fairwind Program 審核制

官方文件並未列出 context window、最大輸出 token 數、延遲或吞吐量數字,這幾項規格截稿為止未公布,需要靠實測或等 API 參考文件補齊。一般版 3.8 Flash 已經上架 Google AI Studio、Android Studio、Gemini app、Google Search 的 AI Mode 與 Google Sheets,並可透過 Gemini Enterprise 存取。

影響範圍

先看錢:用 Gemini API 做推論成本估算的服務,現在的導入價還沒漲,但簽長約或做 2027 年預算的團隊要把單價乘以二重新算一次,不能沿用 3.5 Flash 的舊價位假設。呼叫端如果把模型字串寫死成舊版代號,也要改成 gemini-3.8-flash 才能吃到這次的基準提升。

Cyber 版則是另一套麻煩:它不是公開 API,只有政府與國家級資安單位、電力/電信/醫療/金融等關鍵基礎設施維運者、服務量大的核心技術平台、以及做防禦性評測的學術實驗室能申請。申請通過後還要自行導入使用者認證、防釣魚的 MFA 與存取控管,Google 會做背景審查,取得的存取權不能轉售或分享。用途也被鎖在經授權的威脅模擬、逆向工程與惡意程式分析,做防禦與研究之外的滲透測試不在允許範圍內。已經在用 CodeMender 這個自動修補代理的團隊,可以把 Cyber 版接上去做端到端的漏洞修補,但這也只限白名單內的機構。

原始來源:Google Blog:Introducing Gemini 3.8 Flash and 3.8 Flash CyberGemini API 模型文件Fairwind Program


End of article
0
Would love your thoughts, please comment.x
()
x