Claude Opus 5.5 於 2026 年 9 月 22 日推出;Anthropic 表示,它在多數工作上接近 Fable 5.1,典型工作負載的執行成本則比 Opus 5 低約 40%。 這是廠商以預設設定測出的工作負載成本,不是 API 所有費率一律降四成。輸入和輸出牌價各降 20%,快取讀取從每百萬 token 0.50 美元降至 0.20 美元。

對採用多模型的團隊,這次發表最需要重算的是路由規則。過去的安排常把 Opus 5 當日常主力,把 Fable 5.1 留給難題。現在若 Opus 5.5 能在自己的任務上達到相近的完成率,Fable 的升級條件就得寫得更清楚。Anthropic 的發表頁提供了方向,但不能代替企業自己的帳單與品質紀錄。

Anthropic 官方 Claude Opus 5.5 發表主視覺

圖片來源:官方網站

40% 是工作負載結果,20% 才是一般 token 降價

Anthropic 的官方定價表列出四筆可直接比較的費用。快取讀取適用於重新使用先前存入的提示、文件與工具脈絡;長時間執行的 agent 反覆讀取相同內容,這筆費用可能佔很大比重。

每百萬 token,美元 Opus 5.5 Opus 5 Fable 5.1
一般輸入 4 5 10
輸出 20 25 50
五分鐘快取寫入 5 6.25 12.50
快取讀取 0.20 0.50 0.25

Opus 5.5 的快取讀取價格甚至比 Fable 5.1 的 0.25 美元低,但不能只看這一格就說整個任務一定更便宜。輸出量、快取命中率、推理檔位與重試次數都會改變結果。Anthropic 說 Opus 5.5 所需的服務運算量低於 Opus 5,輸出速度快逾 30%;它把牌價下降與每項任務使用較少 token 合併,才得出典型負載約 40% 的成本降幅。

另一個值得警覺的數字來自獨立評測機構 Artificial Analysis。它在最高 effort 檔位測得,Opus 5.5 的 Intelligence Index 為 58,是該機構當時測得的最高分;但每項評測任務平均輸出約 11.9 萬 token,Opus 5 約 7.3 萬。該條件下,Opus 5.5 的每項任務成本與 Opus 5 接近,而非一律便宜 40%。兩組結果測的是不同工作與設定,採購試算不能挑較好看的數字套用到所有情境。

Anthropic 官方 Opus 5.5 發表頁的地平線視覺

圖片來源:官方網站

Fable 5.1 的能力定位受到直接挑戰

Anthropic 將 Opus 5.5 描述為「多數工作」達到 Fable 5.1 水準,並公布一組自己與合作方的評測。Terminal-Bench 4.0 上,Opus 5.5 得 66.4%,Fable 5.1 為 55.8%;在 GDPval-AA v2.1 知識工作評測,兩者分別是 1846 與 1735 Elo。這些差距值得試用,卻不是所有真實工作都會出現相同排序。Anthropic 也明說,在這個能力水準,基準測試的分數差距未必可靠地預測實際工作差異。

一項內部案例把 HAProxy 從 C 改寫為 Rust:Opus 5.5 花 9.5 小時,Fable 5.1 花 12 小時,前者成本低 51%,兩份改寫都通過幾乎所有原專案迴歸測試。這能說明長工作流程的潛力,卻仍是廠商設計的單一任務。GitHub 的早期測試也指出,Opus 5.5 在 VS Code 的終端任務比 Opus 5 用更少步驟完成更多題目;企業應把它當成要求內部複測的線索。

Fable 5.1 在 9 月 1 日才調低快取讀取價格,從 1 美元降到 0.25 美元。如今 Opus 5.5 以更低的一般 token 牌價與 0.20 美元快取讀取進場,原先「遇到難題就升到 Fable」的成本假設需要重新驗算。Fable 仍可能在特定科學、程式或長時間任務中勝出;公開資料不足以宣告它失去用途。

Anthropic 官方 Opus 5.5 發表頁視覺

圖片來源:官方網站

多模型路由該記錄成功任務的成本

我會先拿已完成、可評分的真實任務做平行比較,而不是立即改掉全公司的預設模型。每類任務記錄完成率、人工修正時間、總 token、快取命中、工具呼叫與實際付款。再把 Opus 5.5 放到原本 Opus 5 的流量上,對難題保留 Fable 5.1 的對照組。若只有 token 單價下降,卻增加重試與人工檢查,就沒有真正省錢。

採購部門也得重算價格。Anthropic 在 7 月 24 日推出 Opus 5 時,已用 Fable 5 一半的 API 牌價爭取日常主力位置。9 月 1 日又為 Fable 5.1 降低快取帳單。不到兩個月,兩個價位層級的有效成本再次靠近。企業的模型預算不宜只按型號名稱分桶,應按成功任務與延遲要求計價。

新模型的安全與合規條件也要進路由表。Anthropic 表示,Opus 5.5 採用接近 Fable 5.1 的生物與資安護欄,部分資安工作會轉至 Opus 4.8;需要較寬生物研究權限的組織可申請驗證計畫。Opus 5.5 可使用零資料保留,但高敏感工作仍要確認實際部署平台、區域與合約條件。官方文件並指出,美國限定推論可能加收 10%,雲端夥伴有各自價格。這些條件會改變前面的牌價比較。

常見問題

Claude Opus 5.5 的價格真的下降 40% 嗎?

不是所有 API 牌價都降 40%。相較 Opus 5,輸入和輸出單價各降 20%,快取讀取降 60%。約 40% 是 Anthropic 在預設設定下對典型工作負載測得的總成本降幅。

Opus 5.5 已經取代 Fable 5.1 嗎?

Anthropic 說兩者在多數工作上接近,若干官方評測由 Opus 5.5 領先。這仍不能證明每家企業的任務都該替換。保留 Fable 對照組,觀察成功率與每項成功任務成本。

快取價格為何影響 agent 成本?

Agent 每一步可能重讀相同文件、工具定義與對話脈絡。Opus 5.5 的快取讀取從每百萬 token 0.50 美元降到 0.20 美元;命中率越高,這項降價越可能反映在總帳單上。

多模型團隊應先改哪一項設定?

先建立固定測試集與停止條件,記錄完成率、延遲、總費用和人工修正量。用真實任務比較 Opus 5、Opus 5.5 與 Fable 5.1,再調整預設與升級門檻。

資料來源

Author Insight

真正值得換掉的是「高階模型必然較貴,所以只用在例外任務」這條過時規則。現在一個快取密集的 agent 可能在較強模型上花更少錢,也可能因輸出變長而吃掉折扣。路由表應該跟著已完成任務的成本與錯誤率移動。

Share this post
Erik (EKC)

With over 20 years of experience in technology, and the startup industry, I am passionate about AI and driving innovation. Keeping the engine running

Loading...