他讓AI客服自己判斷問題、查資料庫、呼叫好幾個工具才回覆客人,最近月底核帳單時嚇了一跳
Google這次一口氣發布三顆新模型,主角是接替3.5 Flash的「3.6 Flash」。它是主打代理式工作流(Agentic workflow)讓AI自己拆解任務、決定要呼叫哪些工具、一步一步做完,而不是你問一句它答一句的主力機種。這次改款的重點不是「變得更聰明」,而是「變得更省」:官方測出同樣任務用掉的輸出tokenAI產生回答時計費的最小單位,AI講的每個字或字的一部分都要另外算錢比舊版少了17%,某些測試項目甚至省下65%。
為什麼省token這麼重要?因為代理式工作流是一步步來的:AI要思考、呼叫工具、看結果、再思考,每一輪都要花token。根據官方公布的基準測試(Benchmark)用同一套固定題目去測不同AI模型,方便直接比較誰強誰弱的成績單,3.6 Flash完成同樣任務所需的思考步驟和工具呼叫次數都變少了,等於少繞幾圈路就把事情辦完,帳單自然變薄。官方同時也調降了牌價(每百萬輸入token 1.5美元、輸出token 7.5美元),等於「跑得更省、油價還更便宜」。
除了主力款,這次還多了兩顆專用款:一顆是3.5 Flash-Lite,犧牲一點能力換取速度和成本,官方測出每秒能吐出350個token,適合要求「秒回」的場景;另一顆是3.5 Flash Cyber,專門訓練來抓程式漏洞、搭配Google自家的資安工具CodeMender使用,不是給一般聊天或客服用的。