返回首頁

模型與資安

Gemini 3.6 Flash 降低代理輸出 token,用輕量 Cyber 變體擴大漏洞搜尋

Google 同步推出 Gemini 3.6 Flash、3.5 Flash-Lite 與受限存取的 3.5 Flash Cyber。更新把代理系統的成本、延遲與專用資安模型視為同一套部署問題。

Gciriani · CC BY-SA 4.0 · Image source
zh-Hant

Google 將 Gemini Flash 產品線拆成三個工程定位:3.6 Flash 負責一般代理、程式設計與多模態工作;3.5 Flash-Lite 主打大量低延遲請求;3.5 Flash Cyber 則以 3.5 Flash 為基礎,針對尋找、驗證及修補漏洞微調。Google 引述 Artificial Analysis 指出,3.6 Flash 相較 3.5 Flash 平均少用 17% 輸出 token;Flash-Lite 的量測速度為每秒 350 個輸出 token。這些數字會直接影響長流程代理的總成本,但仍會隨提示、工具迴圈與供應區域改變。

Cyber 版本的設計重點不是以一次昂貴推理完成稽核,而是讓 CodeMender 並行或反覆呼叫較小模型,探索更多執行路徑,再彙整漏洞報告。Google 稱它在固定呼叫預算下,於 V8 找到 55 個經確認問題,其中 10 個未被對照模型發現;亦已用於 Chrome 的提交掃描。不過這些主要是 Google 內部、部分未公開的評測,外界無法完整重現。

部署限制同樣重要:3.5 Flash Cyber 初期只透過 CodeMender 提供給政府及可信任夥伴,不是一般 API 模型。工程團隊應分別驗證每項工作負載的成功率、完整流程 token、重試次數及首 token 延遲,不能只比較單次價格。資安團隊則應留意專用小模型能否在相同預算下增加程式路徑覆蓋,以及受限版本的能力何時下放至一般 Gemini API。

來源

  1. Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
  2. Introducing Gemini 3.5 Flash Cyber