Google 21 日推出 Gemini 3.6 Flash 新模型,提供更好的程式設計、知識工作及多模態處理效能,同時減少輸出 token 用量,帶來成本效益;另有 Gemini 3.5 Flash-Lite,以及專門用於快速尋找並修補安全漏洞的 Gemini 3.5 Flash Cyber 新模型。對於日前導致股價波動的最高階 Gemini 3.5 Pro 動向,Google 也有說明。
3.6 Flash 能在複雜的代理式和多模態任務展現更強大的效能,精確度更高。與前一版 3.5 Flash 相比,3.6 Flash 在基準測試 Artificial Analysis Index 減少 17% token 用量,而在 Datacurve 的 DeepSWE 則減少多達 65% token 用量,花費可比前一版更低。
3.6 Flash 每百萬個輸入 token 收費 1.5 美元、每百萬個輸出 token 收費 7.5 美元,使得 AI Agent 的建置和運行更具成本效益,現在 3.6 Flash 已經成為 Gemini 應用程式的模型預設選項。

▲ 3.6 Flash 可減少每項任務的輸出 token 用量,成本更低 。(Source:Google Blog)
3.5 Flash-Lite 是 Gemini 3.5 系列目前速度最快、成本最低的模型,值得注意的是用於 Google 自家 CodeMender 的 3.5 Flash Cyber,以 3.5 Flash 為基礎建構而成的網路安全模型,率先向各國政府以及值得信任的合作夥伴開放使用。如 Google 所述,CodeMender 能以高速度、低成本多次呼叫 3.5 Flash Cyber,得以掃描更多程式碼路徑,找出其中漏洞。
Anthropic 和 OpenAI 近幾個月皆推出網路安全模型,尤其是 Claude Mythos 聲名大噪,Google 似乎再次希望在成本效益上突圍。
Gemini 3.5 Pro 何時釋出?
「除了今天的發表外,Gemini 3.5 Pro 目前正與合作夥伴進行測試,我們計劃在準備就緒後盡快廣泛推出」,Google 在官方部落格文章解答了外界對最高階模型推出時程的疑惑。
3.5 Pro 最初承諾在 6 月推出,市場和投資人均在等待它是否能跟上 Anthropic 和 OpenAI 的腳步,因故延後導致母公司 Alphabet 股價下跌。根據外媒報導,3.5 Pro 延後推出是因模型未達預設目標,特別是在程式設計部分,編碼能力不如預期。
不只如此,「我們的團隊已經著手建立下一代模型,啟動至今最大規模的 Gemini 4 預訓練工作,並對目前的進展感到振奮」,Google 首度透露 Gemini 4,但還未有確切時程。
Google 目前策略上積極整合 Gemini 至既有產品線,擴大營收並帶來獲利,搜尋和廣告本業仍然穩健。Google 鞏固既有生態系的同時,也重視模型的 token 效率,創造成本效益。相比之下,Anthropic、OpenAI 不僅面臨燒錢與商業模式未明的挑戰,也受到中國開源模型追趕的壓力。
(首圖來源:Google Blog)






