$5 和 $25。這是 Claude Opus 5 每一百萬 token 的輸入和輸出價格,跟它接班的 Opus 4.8 一字不差。同一個價格,Anthropic 換上了一顆官方稱「力氣是前代兩倍以上」的腦袋。
每次換旗艦都會說「更強了」,這次先擱著那句。這組價格還有另一半意義:同樣每百萬 token,OpenAI 的 Fable 5 收 10 美元和 50 美元,正好是 Opus 5 的兩倍。Anthropic 這次沒把最新旗艦定成最貴的選項,反而把它擺在對手一半的價位上。
先說清楚這組數字能證明什麼、不能證明什麼。價格是可以自己去官方規格表對的事實;而所有「比 Fable 5 強」「成本只要一半」的跑分,都是 Anthropic 自己跑、自己公布的。這篇把這兩層分開講,順便交代你今天怎麼換上、怎麼用它省錢。
同價,官方稱力氣是 Opus 4.8 的兩倍以上
Opus 5 在 2026 年 7 月 24 日發表,API 代號 claude-opus-5,接班的是才上線兩個月的 Opus 4.8。官方定位是「Opus 這一階的一次 step change」,主打長時間運行的 AI 代理人(AI agent)、coding 與專業工作。
官方公布的 benchmark 是這樣(以下數字全是 Anthropic 自報,不是中立第三方測的):
- Frontier-Bench v0.1:超過所有其他模型,是 Opus 4.8 的兩倍以上,而且每題成本更低。
- CursorBench 3.2(開到 max effort):距離 Fable 5 的巔峰分數 0.5% 以內,但每題成本只要一半。
- OSWorld 2.0:在任一成本水準上都勝過對手,超過 Fable 5 的最佳成績,成本卻只約三分之一。
- ARC-AGI 3:分數是次佳模型的三倍。
這些數字的方向很一致:不是宣稱「全面碾壓」,而是「同一個分數、我更便宜」。這也是為什麼定價維持不變是這次發表的重點,不是附註。
「半價」有兩層,一層是事實,一層要看它跟誰比
把「半價」拆開看,才不會被官方 benchmark 牽著走。
第一層是價格,這是事實。三個模型的每百萬 token 牌價攤開如下,你可以直接到官方 docs 對:
| 模型 | 輸入(每百萬 token) | 輸出(每百萬 token) | context | 可靠知識截止 |
|---|---|---|---|---|
| Claude Opus 5 | $5 | $25 | 1M | May 2026 |
| Claude Opus 4.8 | $5 | $25 | 1M | Jan 2026 |
| OpenAI Fable 5 | $10 | $50 | 1M | Jan 2026 |
輸入、輸出兩邊,Opus 5 都恰好是 Fable 5 的一半。這一格不用信任何跑分,帳單就是帳單。
第二層是「用一半成本拿到接近的分數」,這要看它拿哪一格比。官方的 CursorBench「半價」是把 Opus 5 開到 max effort、去貼 Fable 5 的巔峰;OSWorld 的「三分之一成本」又是另一個測法。每一條對比各自成立的 effort 檔位與對照版本,官方頁沒有逐項攤開。所以正確的讀法是:價格砍半可以寫死,跑分砍半是官方說的——兩者都真實存在,但一個你能驗證,一個你只能先信、再自己測。
接班機的記憶,比旗艦還新
規格表裡有一個容易被跳過、但很實用的差別:Opus 5 的可靠知識截止是 May 2026,而 Fable 5 和 Opus 4.8 都停在 Jan 2026。
也就是說,這台「比較便宜」的接班機,記得的世界反而比貴一倍的 Fable 5 還晚了四個月。你要是常問近期的框架版本、函式庫改動、或今年上半年才發生的事,這一格幫你省下的,是一輪又一輪「它不知道」的來回。其餘規格上,Opus 5 是 1M token 的 context、單次最多輸出 128k token(走 batch 的 beta 標頭可以到 300k)。
effort 五段,變成你手上的成本旋鈕
Opus 5 真正該學會用的一個設定叫 effort。它控制模型在一次回應裡花多少 token——包含思考、工具呼叫、解釋——等於一支從省到用力的旋鈕。共五段:low、medium、high、xhigh、max,用 API 參數 output_config.effort 設定,預設是 high(不帶這個參數,就等於 high)。
官方給 Opus 5 的建議有兩句值得記:coding 和 agent 任務從 xhigh 起手;而 low 和 medium 在 Opus 5 上比舊 Opus 明顯更強,可以放心當成控成本、控延遲的主要旋鈕,只要你的評測顯示品質守得住。要往上頂到 max 才是留給真正難的問題。
兩個會踩到的雷先講:在 xhigh 或 max 檔位下把 thinking 設成 disabled,會直接回 400 錯誤;還有,在 Opus 5 上調 effort 控制的是「思考量」,不會可靠地讓「你看到的回覆」變短——想要短答案要另外在 prompt 裡講,不是把 effort 調低。
在 Claude Code 換上 Opus 5,先確認版本
如果你主要在 Claude Code 裡用 Claude,換 Opus 5 的路徑很短,但有一道版本閘:
- 先
claude update。Opus 5 需要 Claude Code v2.1.219 以上,舊版的模型選單根本不會列出它。 - 在對話裡打
/model opus——在 Anthropic API 上,opus這個 alias 現在會解析到最新的 Opus,也就是 Opus 5;或用/model claude-opus-5把版本釘死。 - 想比較的話,Fable 5 仍在選單裡(
/model fable),它在 Claude Code 的定位是「最強、但不是預設」。
另外提醒一句跟時程有關的:舊的 Opus 4.1 已被標記 deprecated,2026 年 8 月 5 日退役,官方建議直接遷到 Opus 5——如果你的腳本還釘著 4.1,這是該動的訊號。
值得先做的一件事
不用急著把所有東西都切過去。最省事的驗證,是拿一個你上週真的用 Opus 4.8 或 Fable 5 跑過的任務——一段重構、一次多檔案的 agent 修改、一份長文件的整理——用 Opus 5 原封不動重跑一遍,再把 effort 從 xhigh 往 medium、low 掃下去,看你的品質底線落在哪一格。價格那半已經是事實,剩下要你自己確認的,只有官方那些「一半成本」的跑分,在你的活上還成不成立。
還沒公開的那塊留著盯:官方的成本對比各自是拿哪個 effort 檔位、對哪一版對手算出來的,Anthropic 沒逐項攤開。在你自己的評測跑出來以前,那半價就先當「官方稱」。
LEARN
想系統性學會,不只看這一則?
Claude Code 教學:用終端 AI Agent 完成真正的工作
讓 Claude Code 在你的專案裡完成一個真實任務,而且控得住權限、驗得了 diff、管得住成本。
從第 0 課開始 →SOURCES
- A Introducing Claude Opus 5
- A Claude Docs — Models overview
- A Claude Docs — Effort
- A Claude Code Docs — Model configuration
- B Anthropic debuts Claude Opus 5 with feature that lets users toggle between cost and capability
來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。
本文由 AI 協助研究與起草,矽基前沿編輯部編修,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明