🚨 AI-LECTURER 快訊速報|2026-07-22|5 分鐘速讀

🚨 Google 發布 Gemini 3.6 Flash 系列:AI 代理更省錢、更快,還多了資安專用版

取材:Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber(Hacker News(AI 高人氣))|完整課同日跟進,見書架
📍 真實場景
小型新創的技術負責人,公司只有他一個人懂技術

正在用 Gemini API 串一個能自己查資料、回答客戶問題的 AI 客服代理,準備讓它正式上線

😖 卡住的地方:AI 代理每答一次問題都要多想幾步、多呼叫幾次工具才能給出答案,等於每次對話都在燒 token、燒錢,月底帳單一看嚇一跳,回應速度也慢到客戶等到不耐煩
💡 讀完就知道要去哪裡看實際用量對比,並抓出三個今天就能做的動作,不用等別人幫你測

⚡ 一句話講清楚

Google 在官方部落格一口氣公布三支新模型:3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyber,都是接在原本 3.5 Flash 之後的升級版,主打讓開發者透過 API應用程式介面,讓你的程式可以呼叫 Google 的 AI 模型來處理任務的技術通道 打造能自己拆解任務、決定要查資料或叫用工具的 AI 代理(AI agent)能自己一步步規劃、執行多個步驟把事情做完的 AI 程式,不是只會單次一問一答 時更划算。

主力機種 3.6 Flash 的官方數字是:比 3.5 Flash 省下 17% 的輸出 tokenAI 模型讀懂或吐出文字時用來計價與計算長度的最小單位,類似「字數」但更精細,在 DeepSWE 這種寫程式抓蟲的 跑分測試(benchmark)用一套固定題目測試不同 AI 模型表現好壞的標準化測驗,方便互相比較 裡甚至省到 65%;同時每百萬輸出 token 的單價也調降到 7.5 美元,等於同樣預算能讓代理多做更多事、少走冤枉路。

另外兩支不是要取代 3.6 Flash,而是各自專攻:3.5 Flash-Lite 主打速度,每秒能吐出 350 個 token,適合要求即時反應的場景;3.5 Flash Cyber 則是專門搭配叫做 CodeMender 的程式碼資安代理,用來掃描、抓程式漏洞,走的是另一套代理架構,不是單純換個模型名字就能用。

🏃 快速上手三步(今天就能做)

1
查你現在的 AI 帳單基準打開 Google AI Studio(aistudio.google.com)或 Vertex AI 主控台的「用量與帳單」頁面,把上個月用 Gemini 3.5 Flash 呼叫 API 的輸出 token 總量和費用記下來,這是你之後比較「換新模型划不划算」的對照組。
2
拿同一個任務實測新模型把你原本用 3.5 Flash 跑的一個典型任務(例如一次客服問答或一次程式除錯),原封不動只把 model 參數換成 gemini-3.6-flash 或 gemini-3.5-flash-lite 重跑一次,比較輸出 token 用量、回應秒數、答案品質有沒有變化,別只信官方數字。
3
資安、程式碼場景另外評估 Cyber 版如果你的專案牽涉程式碼掃描、找漏洞這類資安工作,先別急著套用一般 3.6 Flash,去查 Google 對 3.5 Flash Cyber 搭配 CodeMender 代理的官方文件,確認它是否要透過特定代理架構而非直接單純 API 呼叫才能發揮效果。

🧠 工程思維透鏡(資深工程師看到的是什麼)

🔭 省下的 17% token,實際上真的等於省 17% 的錢、變快 17% 嗎?
官方數字來自第三方評測站「Artificial Analysis Index」的固定測試題,不是你自己專案的實測值。新模型單價雖然比舊版低,但如果你的代理任務型態跟評測題目差異很大(例如需要更多輪 推理步驟AI 在給出最終答案前,內部一步步思考、規劃的過程,步驟越多通常代表越花錢、越慢 或工具呼叫),實際省下的比例可能落差很大,一定要照 Step 2 自己實測才準。
🔭 現在就該把正式環境全部換成 3.6 Flash 嗎?
官方把 3.6 Flash 定位成「workhorse」主力機種,對一般文字生成、寫程式代理算是穩妥選擇;但同一篇公告也透露 Gemini 3.5 Pro 還在跟合作夥伴測試中、Gemini 4 才剛啟動史上最大規模的預訓練,代表模型世代交替很快。比較務實的做法是先在測試環境跑一段時間觀察穩定性,不用急著把所有正式流量一次全部切過去。