Gemini 3.8 Flash 來了!六週內第三次更新,還有資安專用的 3.8 Flash Cyber

Photo of author

By albert

發布:

Google 又更新了,而且距離上一代 Gemini 3.7 Flash,其實中間只隔了三個星期…… Google 在 9 月 2 日正式發表 Gemini 3.8 Flash,同時還帶來了一個比較少見的版本,專門給資安防禦人員使用的 Gemini 3.8 Flash Cyber。這已經是六週內的第三次 Flash 系列更新,很老實說,天天追科技新聞的我們有點跟不上了。官方同樣很直接說 3.8 Flash 是目前最聰明的主力型模型,速度和成本跟 3.7 Flash 一模一樣,但在軟體工程、AI Agent 任務,以及需要多步驟推理的專業領域上,全部都有明顯的進步。

Google 為何三週更新一次?

Gemini 3.6 Flash 在 7 月底登場之後,Google 幾乎維持著三週一版的頻率在推 Flash 模型,有分析認為這種做法其實是替 Gemini 3.5 Pro 爭取更多的時間,Gemini 3.5 這款模型在 2026 年 5 月的 I/O 大會上就先預告過了,但到現在都還沒有正式亮相,因此 Flash 系列正在扮演主力輸出的角色,它便宜、快、還可以大量部署,讓開發者先用起來再說。

這次兩個版本共使用同一套底層模型,差別在「安全邊界」與「誰可以使用」。Google 也提到這一代在編碼和推理上的進步,其實有一部分是來自資安這個高要求領域的密集訓練,以及所謂「長週期 Agent 迴圈」的機制,讓模型能反覆評估、修正自己的輸出。

跑分表現

在長週期軟體工程基準 DeepSWE v1.1 上,Google 表示 3.8 Flash 能自主完成端到端的複雜工程問題,表現勝過多數體量大得多的前沿模型,成本卻只是 $ 0.75 ,而分數約為 73.7%。在 Vals Finance Agent V2 這些類別的金融 Agent 測試、Harvey's Legal Agent Benchmark 法律 Agent 測試中,3.8 Flash 都超越了 3.7 Flash 和其他前沿模型。而在涵蓋理工、人文與專業領域的 HLE-Verified 多步驟推理測試上,它拿到 54.9%。

Gemini 3.8 Flash 登場!六週內第三次更新,價格不變但能力再進化

模型變得更勤力,但 Token 會燒得更多

面對複雜任務時,3.8 Flash 它會多跑幾步推理、並且反覆呼叫工具,直到覺得結果夠好為止。好處當然是準確度上來了,但相對地,它也可能吃掉更多 Token。所以如果你的應用場景是「運算效率優先」,Google 建議把努力等級調低,或者繼續使用 3.7 Flash, 官方表示 3.7 Flash 仍會完整支援。

價格不變

Gemini 3.8 Flash 沿用 3.7 Flash 的首發優惠價,每百萬輸入 Token 0.75 美元,而每百萬輸出 Token 3.75 美元 (依匯率換算約新台幣 24 元與 120 元,港幣約 5.9 元與 29 元)。同樣的錢但換到更強的模型,對開發者來說是當然是個好消息,但這個優惠價只到 2026 年 12 月 31 日為止。從 2027 年 1 月 1 日開始,價格會調整為每百萬輸入 Token 1.5 美元、每百萬輸出 Token 7.5 美元,也就是直接翻倍。

Gemini 3.8 Flash Cyber

這次發表會的另一個主角 Gemini 3.8 Flash Cyber,它被 Google 定位為目前最強的資安專用模型,它會自主發現漏洞、以及自動產生修補程式。在業界常用的漏洞發掘基準 CyberGym 上,Google 表示它達到前沿水準,超越了前一代 3.5 Flash Cyber,也超越體量大得多的其他前沿模型。

由於 CyberGym 主要集中在 C/C++ 程式碼,因此 Google 另外做了一套涵蓋 20 種程式語言的內部測試,結果顯示成功率超過 70%,比前幾代有明顯的跳躍。

在自動修補方面,在由 Collinear 執行的外部基準 CWE-Bench 上,3.8 Flash Cyber 拿下 47.2% 的 pass@1,跟領先的前沿模型 47.8% 幾乎打平,但成本卻低很多。

Gemini 3.8 Flash 登場!六週內第三次更新,價格不變但能力再進化

Google 自己先用了一輪

比起實驗室的數字,Google 公布內部的實戰紀錄:

Chrome 安全團隊:3.8 Flash Cyber 產出的正確漏洞修補數量,是那些體量大得多的最佳商用模型的 2.6 倍。

Wiz:在自家的滲透測試內部基準上,3.8 Flash Cyber 的召回率高出其他領先前沿模型 7.5% 到 9.7%,成本卻低了 2.3 到 5.2 倍。

Google 雲端漏洞研究團隊:用它在不到 2 小時內找出一個關鍵的基礎性漏洞 (這類漏洞通常要花上好幾個月才挖得出來)。

Fairwind Program 計畫

這麼強的能力,Google 並沒有直接對外開放,反而推出了 Fairwind Program 這個存取計畫,能進場的對象分三類,第一是政府與國家級資安機關、第二類是關鍵基礎設施營運商 (醫療、電信、能源、金融等),以及核心技術平台。目前全球已有超過 650 個合作夥伴參與,名單裡包括 CrowdStrike、Palo Alto Networks、Snowflake、Wiz 等資安圈的熟悉面孔。

實際運作上,Google 把 3.8 Flash Cyber 和自家的 CodeMender 工具組合在一起,讓防守方能在自己的安全雲端環境中,自主找出、驗證並修好漏洞。原本可能要花上好幾週的手動修補流程,官方說可以壓縮到幾分鐘內完成。當然,門檻也不是只有「申請」兩個字,參與的組織必須同意一套嚴格的操作規範,例如把存取權限制在內部資安、事件應變或滲透測試團隊的員工身上,並且要部署多因素驗證這類保護措施。

安全防護:CBRN、網路攻擊與提示詞注入

一般版的 3.8 Flash 依照自家的前沿安全框架,在化學、生物、放射性與核子 (CBRN) 以及網路攻擊這幾個領域都設有濫用防護,而 Cyber 版本因為工作性質特殊,防護設定相對寬鬆,這也正是它只開放給可信賴防禦者的原因,能力愈強,門就要關得愈緊。另外 Google 表示 3.8 系列在 Gray Swan 的相關測試中有顯著躍進,更有效地擋下惡意提示詞攻擊。

使用方式

開發者:可在 Google AntigravityGoogle AI StudioAndroid Studio 使用,也能透過 Gemini API 直接串接,另外 Stitch 也支援使用它生成介面。

企業用戶:透過 Gemini Enterprise 存取。

一般消費者:Google AI Pro 與 Ultra 訂閱者,可以在 Gemini 應用程式、Google 搜尋的 AI Mode,以及 Google Sheets 中用到 3.8 Flash。

資安防禦者:需要透過 Fairwind Program 提出申請,才能取得 3.8 Flash Cyber 的存取權。

短期內看不到休息的跡象

六週有三個版本,這個更新頻率可以說明現在 AI 模型競爭有多白熱化。對開發者和企業來說,3.8 Flash 的價格沒有上升,能力往前推了一大截,而且推理和編碼已經接近高階前沿模型。對於要大規模部署 AI Agent 的團隊,這種「效能與成本兼顧」的選項很難不動心。

如果喜歡這篇文章,並想持續收到更多限時免費優惠科技新聞、 Apple 資訊,以及 AI 、 WordPress 網頁教學資源分享,歡迎透過以下方式支持我,讓我更有動力創作:

按讚與追蹤:鎖定我的 FB專頁InstagramThreads 和 X,就不會錯過最新內容。

請我喝杯咖啡 ☕:如果內容對你有幫助,歡迎到 Ko-fi 小額支持,為我注入創作能量。

你的一個 Like追蹤或是一杯咖啡的鼓勵,都能激勵我持續分享更多實用文章。感謝大家。

發佈留言