🚨 AI-LECTURER 快訊速報|2026-07-26|5 分鐘速讀

🚨 Claude Opus 5 上線:跑分刷新紀錄、價格砍半,Claude Pro/Max 現正開放

取材:Introducing Claude Opus 5(Anthropic News)|完整課同日跟進,見書架
📍 真實場景
接案接到手軟的自由接案工程師

你正在用 Claude 處理一個客戶的後端重構案,工作進行到一半要離線去開會,只能先丟給 AI 自己跑

😖 卡住的地方:以前的模型常常改一半就停下來回報「大致完成」,你回來一看才發現漏了邊界條件,還要自己補
💡 讀完你會知道 Opus 5 為什麼被設計成「會自己盯自己」,以及什麼情況下值得把手上的專案換過去試

⚡ 一句話講清楚

Anthropic 在今天發布了新一代旗艦模型 Claude Opus 5,主打的賣點很單純:比前一代 Opus 4.8 聰明很多,但收費幾乎沒漲。官方在好幾個 benchmark評測基準,用一組固定的測試題目幫不同 AI 模型打分數、方便互相比較 上都拿下新紀錄,包括程式能力測試 Frontier-Bench,以及模擬真實商業任務的 GDPval-AA,不過在資安相關任務上,還是輸給另一個模型 Mythos 5。

這次升級的重點不是「更聰明一點」,而是「更會把事情做完」。Anthropic 特別強調 Opus 5 更擅長一邊做一邊檢查自己的成果,而不是做到一半就交差了事——這種特質官方稱為 agency主動性,指模型會自己判斷任務有沒有真的完成,而不是等你發現問題才回頭改。這也是為什麼它現在被設為 Claude Max 的預設模型,同時也是 Claude Pro 方案裡最強的選項。

值得注意的是,Opus 5 提供一個叫 effort setting努力設定,讓你自己選要模型「想深一點、貴一點」還是「想快一點、便宜一點」 的選項。同樣的價格,你可以選擇讓它想得更久換取更高品質,或是調低換取更快、更便宜的回應——等於把「品質 vs. 成本」的選擇權交回到你手上。

🏃 快速上手三步(今天就能做)

1
先去帳號設定確認方案登入 claude.ai,點右上角帳號選單看你是 Free/Pro/Max。Max 用戶今天起預設就是 Opus 5,不用做任何設定;Pro 用戶要在對話視窗左上角的模型選單裡手動選「Opus 5」才會用到。
2
拿一個你上次卡關的任務重跑一次找一個你之前覺得「AI 做到一半就停、需要你自己收尾」的任務(例如改一段複雜邏輯、抓一個難找的 bug),原封不動丟給 Opus 5,觀察它這次會不會主動把邊界情況也檢查過一輪再回報你。
3
動手前先調一次 effort 設定如果對話介面有「思考強度/effort」的選項,先用預設值跑一次,記下花費的時間跟結果品質;再調到最高檔重跑同一題,比較差異值不值得多花的等待時間和費用,之後再依任務難度決定要不要每次都調高。

🧠 工程思維透鏡(資深工程師看到的是什麼)

🔭 「同價格但更聰明」是怎麼做到的?值得全面信任嗎?
Anthropic 說在 Frontier-Bench v0.1 上,Opus 5 的表現是前代的兩倍以上,而且每個任務花的成本更低,這代表背後的訓練或推理架構有實質效率提升,不只是「調高預算硬跑分」。但跑分是官方自己選的測試集,實際換到你手上的專案,效果多好還是得靠自己實測,不能只看官方公布的圖表就直接全面換用在正式環境。
🔭 「在資安任務上輸給 Mythos 5」這句話透露了什麼?
這句話等於是官方主動承認自己不是每個項目都最強,這種老實揭露反而是件好事——代表評測數字是真的比出來的,不是行銷包裝。對工程師的實務意義是:選模型不該只看單一總分或哪家最新,而要看你的任務屬於哪個類別(寫程式、資安分析、科學運算……),針對該類別去比較各家模型的實測數字。