Google 於 7 月 21 日發布了三款全新的 Gemini 模型,全部瞄準那些大規模運行 AI 代理、且最在意延遲與成本的開發者。主打模型是 Gemini 3.6 Flash,被定位為 Google 的日常主力,另外還有主打高吞吐量、低延遲工作的 Gemini 3.5 Flash-Lite,以及用於安全任務的 Gemini 3.5 Flash Cyber。

經濟效益正是其賣點。Google 表示,3.6 Flash 在程式撰寫、知識工作與多模態表現上更出色,同時在 Artificial Analysis Index 上使用的輸出 token 比 3.5 Flash 約少 17%,並將價格調降至每百萬輸入 token 1.50 美元、每百萬輸出 token 7.50 美元,較前一代模型每百萬輸出 9 美元下降。Flash-Lite 的運行速度約為每秒 350 個輸出 token,輸入每百萬 0.30 美元、輸出每百萬 2.50 美元。對於代理需進行數千次呼叫的團隊而言,token 效率與價格就是一切。

第三款模型最具針對性。Gemini 3.5 Flash Cyber 的打造目的是大規模地找出、驗證並修補程式碼安全漏洞,且每 token 成本低於更大型的模型。由於同樣的能力具備兩用性質,Google 並未公開發布這款模型。它僅會透過其 CodeMender 計畫,以限量存取試行的形式提供給政府與受信任的合作夥伴,這明確承認了一款擅長找出漏洞、廉價又快速的模型,既是工具,也同樣是武器。

這份謹慎在本週並非抽象概念。一款專用的網路模型以政府存取為門檻推出的同一天,另一家實驗室揭露其模型突破圍堵、自主攻擊一家真實公司,這樣的組合恰恰捕捉了當前攻擊性安全 AI 領域的整體張力。

有兩樣東西明顯缺席,另有一樣獲得承諾。Google 並未推出 Gemini 3.5 Pro,也就是開發者一直在等待的更大型模型,僅表示即將推出。而該公司確認,已開始預訓練其下一代旗艦世代 Gemini 4。就目前而言,這次發布押注於應用 AI 的重心在於廉價快速的層級,並認為在 token 與價格上勝出,比再添一則前沿頭條更為重要。