Claude Opus 4.5 定價砍半、程式碼分數僅差 0.5%:這次升級真正值得看的地方

Claude Opus 4.5 定價砍半、程式碼分數僅差 0.5%:這次升級真正值得看的地方

Claude Opus 4.5 定價砍半、程式碼分數僅差 0.5%:這次升級真正值得看的地方

Anthropic 最新推出的 Claude Opus 4.5,最令人意外的不是能力再創新高,而是價格直接被砍到上一代 Opus 的三分之一左右,同時在主流程式碼基準測試上的表現,與目前公認最強的 GPT-5.1(Fable 5 系列)差距不到 0.5%。換句話說,這一次 Anthropic 沒有在打「更強的旗艦」,而是在打「同級能力、半價供應」。這篇文章的判斷很直接:Opus 4.5 真正的殺傷力不在 benchmark,而在它把頂級模型的使用門檻整個往下拉一階。

這次更新到底改了什麼

過去 Claude Opus 系列一直是「貴但強」的代名詞,輸入輸出 token 費用高企,讓很多開發者只在關鍵任務才敢動用 Opus,其他時候退回 Sonnet 或 Haiku。Opus 4.5 這次改動最核心的三件事:

第一,價格直接砍到約前代三分之一。 這不是那種「輸入便宜、輸出照舊」的行銷式降價,而是輸入輸出雙邊同步下調。過去用 Opus 跑一輪長 context 分析可能要花掉幾美金,現在同樣工作量的成本回到 Sonnet 級別的區間。

第二,程式碼能力幾乎追平業界最強。 在 SWE-bench Verified 這類真實世界程式修復基準上,Opus 4.5 與 GPT-5.1 的分數差距壓在 0.5% 以內。這個差距在統計意義上基本可以視為打平,而不是誰壓誰。

第三,長 context 與 agent 任務的穩定度提升。 這一點官方講得不多,但實際跑起來會感受到:長對話中途「失憶」、tool use 中途亂調用、多步驟任務中段崩掉的情況比 Opus 4 明顯減少。對做 coding agent、做長文件處理的人來說,這才是每天會用到的差別。

為什麼「差 0.5%」這件事被低估了

很多人看 benchmark 只看誰第一,但對實際開發者而言,0.5% 的差距代表的是:你不再需要為了那一點點分數,付三倍價錢。

過去半年市場的共識是:要做嚴肅的 coding agent,就得用最貴那一檔模型,否則多步驟任務會斷。Opus 4.5 出來之後,這個共識會被鬆動。當一個模型的能力已經在你能感知的誤差範圍內,卻只要一半甚至三分之一的價錢,理性的選擇就是換過去,除非你有非常明確的理由留在原本的生態。

這也是為什麼這次降價比升級本身更值得注意——它會直接改變很多團隊 API 帳單的結構。

實際會在哪些場景感受到差別

舉兩個具體情境會更清楚。

第一種是 coding agent 跑大型 repo 重構。過去用 Opus 4 跑一次全 repo 掃描 + 修 bug + 寫 test,可能一輪就燒掉十幾美金,導致大部分團隊只敢在 CI 出錯時才召喚 Opus,其他時候用 Sonnet 頂著。Opus 4.5 之後,這種「頂級模型只在關鍵時刻用」的策略可以放寬,日常開發也負擔得起讓 Opus 全程盯著。

第二種是 長文件 / 長對話的分析任務。例如做法律合約審閱、做整份財報拆解、做多份研究論文交叉比對,這些任務吃 context 又吃推理深度,過去用 Opus 每跑一份都要精算成本。現在同樣預算可以多跑兩三倍的量,或者把原本要拆成多次的任務一次過餵進去。

Anthropic 這一步在打什麼算盤

這裡值得說一句:Opus 4.5 不是單純的「良心降價」,它是一次針對 OpenAI 與 Google 的正面價格戰。

過去 Anthropic 的定位偏「高階、精緻、企業向」,價格是護城河也是門檻。但當 GPT-5.1 與 Gemini 3 都在往「同時追能力也追性價比」走,Anthropic 如果繼續維持高價,很容易在開發者社群失去日常使用場景,只剩下企業合約單。這次直接把 Opus 拉到中價位帶,等於主動放棄「最貴 = 最強」的敘事,改用「同樣強、便宜一半」來搶市場份額。

對用戶來說這是好事,但也要留意一件事:這種等級的降價通常伴隨對 rate limit、context 政策、或 fine-tune 選項的調整。真正打算把 Opus 4.5 大量塞進 production 之前,最好先跑一輪自己工作流的實際成本與延遲,不要只看官方 pricing 頁面的數字。

值不值得立即切過去

如果你現在正在用 Opus 4、或者在 GPT-5.1 上做 coding / agent 工作,Opus 4.5 值得馬上開一條分支測試。判斷標準不是 benchmark 分數,而是三件事:你原本的 prompt 在新模型上會不會需要重調、tool use 的成功率有沒有提升、以及同樣任務跑一輪的實際 token 消耗。

如果你是用 Sonnet 為主的團隊,這次更新對你影響反而沒那麼大——Sonnet 本來就便宜,你要考慮的是有哪些原本捨不得升到 Opus 的任務,現在可以升上去。

這次更新真正的訊號是:頂級模型的價格天花板正在被壓低,而且壓得比大家預期快。接下來半年,其他家會不會跟進,才是這場價格戰真正的看點。

追蹤以下平台,獲得最新AI資訊:
Facebook: https://www.facebook.com/drjackeiwong/
Instagram: https://www.instagram.com/drjackeiwong/
Threads: https://www.threads.net/@drjackeiwong/
YouTube: https://www.youtube.com/@drjackeiwong/
Website: https://drjackeiwong.com/

Dr. Jackei Wong

Dr. Jackei Wong|GenAI 企業培訓導師|AI 書籍作者|科技 YouTuber
專注生成式 AI(GenAI)企業培訓、公開課程、講座、工作坊及社交媒體內容合作。
DayGen AI Limited 及 RoboCode Academy 創辦人。
擁有超過 20 年人工智能研究、教學及培訓經驗。
YouTube:youtube.com/@drjackeiwong
網站:drjackeiwong.com
合作邀請歡迎 DM

喜歡請分享