Claude Opus 5.5 深度分析:參數、價格與業界位置

依一手資料整理 Claude Opus 5.5 的公開參數、官網價格,以及相對 Fable 5.1、Opus 5 與 GPT-6 Astra 的基準讀法,並記錄 2026-09-30 Modelflare 目錄中的公開分組與用戶價格。

Claude Opus 5.5 於 2026 年 9 月 22 日釋出。公開契約寫在模型頁和更新說明裡:API 標識是 claude-opus-5-5,上下文 1M tokens,最大輸出 128K,自適應思考保持開啟,預設 effort 為 medium,標價是每百萬輸入 token $4、每百萬輸出 token $20。Anthropic 的這些頁面沒有給出參數量,也沒有給出訓練算力。本文只使用已公開的規格、價格表和基準表。

核查後的結論: 按 Anthropic 官網標價,Opus 5.5 是當前的 Opus 等級。按 token 計,它比 Opus 5 便宜,也比 Fable 5.1 便宜很多。在 Anthropic 印出的程式設計和知識工作行上,它的分數領先 Fable 5.1、Opus 5,並且在其中大多數行上領先 GPT-6 Astra。有兩行方向相反:Astra 領先 Terminal-Bench-Science 0.1 和 Zapier 的 AutomationBench。Modelflare 的價格介面在 2026 年 9 月 30 日已經包含 claude-opus-5-5,單位價格與官網的 $4 / $20 一致。這一行開放的公開分組是 claude-award 0.25、claude-stable 0.315 和 claude-premium 0.5。這個等級的 Key 應傳送 claude-opus-5-5。實時價格見價格頁。

下文的官方行為引自 Opus 5.5 模型頁、更新說明 和釋出頁。Fable 5.1 的遷移細節見本部落格已有的 Fable 5.1 評測。

已經公開的參數

專案 Claude Opus 5.5
模型 ID,Claude API claude-opus-5-5
Amazon Bedrock ID anthropic.claude-opus-5-5
Google Cloud 與 Microsoft Foundry ID claude-opus-5-5
釋出日期 2026 年 9 月 22 日
上下文視窗 1M tokens,預設即最大
最大輸出 128K tokens
思考 自適應,始終開啟
預設 effort medium
模型頁上的延遲等級 中等
可靠知識截止 2026 年 6 月
參數量 公開模型頁未提供

“可靠知識截止”是 Anthropic 對模型既有知識最充分所及日期的叫法。它和上下文視窗是兩件事。請求裡附上的檔案仍然在這次上下文中。

Fast mode 是同一模型 ID 上的速度開關,文件把它標成僅 Claude API 可用的研究預覽。請求使用 speed: "fast",並帶上 beta 頭 fast-mode-2026-02-01。Anthropic 給這個模式的價格是每百萬 token $8 / $40,並把輸出速度寫成最高約 2.5 倍。更新說明寫明:Amazon Bedrock、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry 沒有這個 fast mode。

同一頁把 effort 階梯寫成思考深度的控制項:low、medium、high、xhigh、max。手工指定思考預算會被拒絕。可快取提示詞的最短長度是 512 tokens。

價格

官網標價

單位是美元 / 每百萬 tokens。Opus 5.5 的快取、批次和 fast mode 來自更新說明的價格一節。Opus 5 的快取寫入格,是釋出頁對比表裡的那一個 “cache writes” 數字,該表沒有把 5 分鐘和 1 小時級拆開。Fable 5.1 的快取讀取沿用本部落格 Fable 5.1 評測裡已經使用的官網數字。Sonnet 5 和 Haiku 4.5 的輸入、輸出價格來自 Opus 5.5 模型頁上的對比行。破折號表示本文沒有從一份一手價格行裡取這一格。

每 1M tokens 的價格 Opus 5.5 Opus 5 Fable 5.1 Sonnet 5 Haiku 4.5
輸入 $4 $5 $10 $2 $1
輸出 $20 $25 $50 $10 $5
快取讀取 $0.20 $0.50 $0.25 — —
快取寫入 5 分鐘 $5;1 小時 $8 $6.25 — — —
批次輸入 / 輸出 $2 / $10 — — — —
Fast mode 輸入 / 輸出 $8 / $40 — — — —

相對 Opus 5,新鮮輸入和輸出的標價降了 20%,從 $5 / $25 到 $4 / $20。長 Agent 迴圈裡佔比更高的快取讀取,從 $0.50 降到 $0.20。這是比 Opus 5 的快取讀取價低 60%,也低於 Fable 5.1 的 $0.25。Anthropic 另有一條工作負載說法:預設設定下,典型任務的花費大約比 Opus 5 低 40%,因為模型用掉的 token 也更少。這 40% 描述的是他們自己的測試裝置。真實帳單仍取決於 effort、快取命中率和工具輪次。

批次處理是新標價的一半。Fast mode 是新標價的兩倍,而且只在 Claude API 上。

2026 年 9 月 30 日的 Modelflare 目錄

2026 年 9 月 30 日讀取的 GET https://modelflare.dev/api/pricing 包含 claude-opus-5-5,同一份回應裡還有 claude-opus-5、claude-fable-5-1、claude-sonnet-5、claude-sonnet-5-5、claude-haiku-4-5、gpt-6-astra 和 gpt-5.6-sol。其中沒有 Haiku 5.5 的 ID。

下表的單位價格是該回應裡、乘上分組倍率之前的 token 價格。Claude 這幾行與官網標價一致。Astra 和 Sol 分檔:輸入上下文超過 272,000 tokens 時用第二組價格,長上下文的輸出價是該檔自己的輸出價。示例列裡,Claude 行乘的是 claude-stable 0.315,OpenAI 行乘的是 openai-stable 0.08。這次讀取的 Claude 倍率是 claude-premium 0.5、claude-stable 0.315、claude-award 0.25。OpenAI 倍率是 openai-premium 0.13、openai-stable 0.08、openai-award 0.03。Opus 5.5 只啟用上面三個 Claude 分組。claude-tmp-cheap 是公開的 Claude 分組,這一行沒有啟用它。

模型 目錄 ID 單位輸入 / 輸出 stable 分組上的使用者價格
Opus 5.5 claude-opus-5-5 $4 / $20 $1.26 / $6.30
Opus 5 claude-opus-5 $5 / $25 $1.575 / $7.875
Fable 5.1 claude-fable-5-1 $10 / $50 $3.15 / $15.75
Sonnet 5 claude-sonnet-5 $2 / $10 $0.63 / $3.15
GPT-6 Astra gpt-6-astra $10 / $50,其後 $20 / $75 $0.80 / $4.00,其後 $1.60 / $6.00
GPT-5.6 Sol gpt-5.6-sol $5 / $30,其後 $10 / $45 $0.40 / $2.40,其後 $0.80 / $3.60

Opus 5.5 在 claude-stable 上是 $4 × 0.315 和 $20 × 0.315。拿 Opus 5.5 和其他實驗室比較時看官網表。看今天就能發出的 Modelflare 帳單時看目錄表。

Haiku 4.5 也在同一份目錄裡,單位價格 $1 / $5。在 claude-stable 上是 $0.315 / $1.575。模型頁的對比仍給 Haiku 200K 上下文和 64K 最大輸出。2026 年 9 月 30 日的回應裡沒有 Haiku 5.5。Haiku 4.5 仍是目前確實列出來的 Claude 產品線低價端。

目錄行上的快取倍率是輸入單位價格的一個分數:Opus 5.5 為 0.05,所以目錄快取讀取是 $0.20,目錄快取寫入是 $5。這個寫入價對應官網的 5 分鐘檔。官網的 1 小時寫入是 $8,目錄沒有單獨的這一檔。Opus 5 和 Sonnet 5 為 0.1,Fable 5.1 為 0.025。快取、長上下文和優先檔以價格頁以及完成後的用量記錄為準。

相對 Opus 5 和 Fable 5.1 改了什麼

行為 Opus 5.5 Opus 5 Fable 5.1
API ID claude-opus-5-5 claude-opus-5 claude-fable-5-1
上下文 / 最大輸出 1M / 128K 1M / 128K 1M / 128K
思考 始終開啟。disabled 和手工預算返回 400 預設開啟。僅在 effort 為 high 或更低時接受 disabled 始終開啟
省略 effort 時的預設值 medium high high
可靠知識截止 2026 年 6 月 2026 年 5 月 2026 年 6 月
標價輸入 / 輸出 $4 / $20 $5 / $25 $10 / $50
快取讀取 $0.20 $0.50 $0.25
強制工具選擇 any 和 tool 返回 400 被列為相對 Opus 5 的破壞性變更 與 Opus 5.5 同樣返回 400
網路安全防護 把任務交給 Opus 4.8 釋出說明沒有把這條回退放在 Opus 5 上 Fable 級別的防護
生物與前沿 LLM 防護 把任務交給 Opus 5 釋出說明把這條回退和 Opus 5.5 寫在一起 同一類防護

Opus 5.5 能讀 Opus 5 以及更早的 Opus、Sonnet、Haiku 產生的思考塊。它不讀 Fable 或 Mythos 產生的思考塊。在 Claude API 上,Fable 5.1 和 Mythos 5.1 能讀 Opus 5.5 的思考塊;更新說明寫明,其他當前模型不能。目標模型讀不了的塊會在模型看到之前被丟掉,丟掉的塊不計費。

2026 年 8 月 31 日及之後建立的帳號檢查更嚴:如果系統提示詞、工具列表或更早的訊息在 Opus 5.5 思考塊產生之後被改過,重放這個塊會返回 400。遷移指南給出的做法是只追加的歷史;指令必須改時,用對話中途的系統訊息。釋出頁還寫到,Opus 5.5 帶有 Fable 5.1 引入的保留思考控制、歐盟 AI 法案水印,以及與此前 Opus 一致的零資料保留。

智力分數應該怎麼讀

下表就是釋出頁印出的那一張。Anthropic 說,除非腳註另有說明,Opus 5.5 使用自適應思考、effort 為 max。Terminal-Bench 4.0 是那個腳註:Opus 5.5 用 xhigh,GPT-6 Astra 用 high,各自取該模型公佈的最高分。Astra 和 Sol 的數字按 OpenAI 的報告引用。生產防護是開啟的。防護介入時,網路安全任務由 Opus 4.8 完成,生物和前沿 LLM 開發任務由 Opus 5 完成。Anthropic 說這會把 Opus 5.5 的分數拉低。

基準 Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Terminal-Bench 4.0 66.4% 55.8% 52.3% 57.9% 37.3%
FrontierCode v1.1(Main) 54.4% 50.3% 48.0% 53.3% 47.5%
CursorBench 4.0 57.8% 51.8% 46.6% — 41.7%
GDPval-AA v2.1 1846 1735 1708 1542 1588
AutomationBench 40.0% 31.4% 26.9% 41.4% 28.8%
Humanity's Last Exam,使用工具 67.7% 65.6% 63.6% 57.2% —
Terminal-Bench-Science 0.1 58.7% 52.6% 29.0% 64.6% 22.4%
OSWorld 2.0,partial 81.8% 80.7% 74.0% — —
Chartography,使用工具 89.0% 88.4% 83.4% — —

把差距和他們公佈的誤差放在一起看。Terminal-Bench 4.0 上,Opus 5.5 為 ±2.6 分,其他 Claude 模型為 ±1.6 到 ±2 分。從 66.4% 到 Astra 的 57.9%、到 Fable 的 55.8%,都寬於這些誤差。Terminal-Bench-Science 每個模型是 ±3.5 到 ±5 分。Astra 的 64.6% 對 Opus 5.5 的 58.7%,幅度接近這些誤差的寬度,點估計上 Astra 在前。

AutomationBench 由 Zapier 執行。因為該次執行沒有回退模型,防護介入算作失敗。Anthropic 說實際分數會更高。印出的 40.0% 對 Astra 的 41.4% 是一個很接近的公佈結果,點估計上 Astra 在前。GDPval-AA v2.1 是覆蓋 44 個職業的真實專業任務 Elo:Opus 5.5 為 1846,Fable 5.1 為 1735,Opus 5 為 1708,Sol 為 1588,Astra 為 1542。

同一釋出頁的成本圖上還有第二組分數,取的是預設 effort medium:FrontierCode 54.6%,CursorBench 52.5%。對比表印的是 54.4% 和 57.8%。把它們當成 Anthropic 在兩種 effort 下的兩個數字。圖注還說,medium effort 下 FrontierCode 以大約五分之一的單任務成本超過 Astra 的最高分 53.3%,Terminal-Bench 則以大約 40% 的成本打平 Astra。這些是關於 Anthropic 自己測試裝置的單任務成本說法。

表下那句話更值得留下:在 Anthropic 自己的使用裡,Opus 5.5 和 Fable 5.1 的差距比分數看起來更窄,這個水平上的基準分差對真實任務的指導也更弱。釋出頁上的客戶引語是挑選過的證詞。它們可以提示該重放什麼,不屬於分數表。

它在當前模型格局裡的位置

同一天落地了三件可以核對的變化。

Anthropic 說成“大多數任務達到 Fable 5.1 水準”的那類工作,現在有了一張 Opus 價格卡。標價是 $4 / $20,Fable 5.1 是 $10 / $50。快取讀取是 $0.20,Fable 是 $0.25,Opus 5 是 $0.50。團隊自己的重放若同意這個判斷,Fable 5.1 留給仍然失敗的任務,迴圈本身交給 Opus 5.5。重放若不同意,表裡已經寫出公佈的例外:科學 Agent 任務和 Zapier 的業務工作流,印出的數字由 Astra 領先。

預設值跟著價格一起動了。與這次釋出同時更新的 Claude Code 模型配置,把 Opus 5.5 設為 Pro、Max、Team、Enterprise 和 Anthropic API 的預設模型,也是 Claude Platform on AWS、Amazon Bedrock 和 Google Cloud Agent Platform 的預設模型。Agent 產品裡的預設值,比模型選擇器裡多一行更能帶動流量。

防護邊界下移到了 Opus。早先的 Opus 承接的是 Fable 分類器不願回答的流量。Opus 5.5 帶著一套相近的防護發布:網路安全任務由 Opus 4.8 完成,生物和前沿 LLM 開發任務由 Opus 5 完成。日誌裡請求 ID 記成 claude-opus-5-5,完成結果仍可能來自另一個模型。拒絕以 HTTP 200 返回,stop_reason 為 "refusal"。

Sonnet 5.5 已經在 2026 年 9 月 30 日的目錄裡,單位價格與 Sonnet 5 同為 $2 / $10。該回應沒有 Haiku 5.5。已經列出來的更便宜 Claude 卡是 Sonnet 5.5、Sonnet 5 的 $2 / $10,以及 Haiku 4.5 的 $1 / $5。Haiku 4.5 仍是 200K 窗口。Sonnet 5.5 的分組見 Sonnet 5.5 評測。

這是一份可以從文件裡審計的位置:標價、Claude Code 的預設模型、防護觸發時由誰作答,以及廠商自己的表裡仍由 Astra 領先的行。這裡沒有市場份額的說法。

接入時的約束

會直接返回 400 的請求

只替換模型字串的客戶端,仍會撞上文件為“跑在 Opus 5 上的程式碼”列出的四處破壞性變更。前三處同樣適用於 Fable 5.1。下面是遷移說明要求傳送的形狀。註釋標出返回 invalid_request_error 的變體。

model: claude-opus-5-5
thinking: {"type": "adaptive"}
tool_choice: {"type": "auto"}
output_config.effort: medium
# 400: thinking 型別為 disabled,或 enabled 且帶 budget_tokens
# 400: tool_choice 為 any,或 tool_choice 為 tool
# 400,限於 Claude API 與 Google Cloud:工具型別 computer_20251124

深度取代了過去的思考開關。省略 thinking,或傳送 adaptive。effort 要顯式設定。tool_choice 的 auto 和 none 仍然有效,計數 token 的端點也一樣。要得到符合 schema 的 JSON,遷移說明指向嚴格工具呼叫或結構化輸出,並在提示詞裡寫明何時呼叫工具。

在 Claude API 和 Google Cloud 上,用 computer_toolset_20260801 工具集替換 computer_20251124,並去掉舊的計算機使用 beta 頭。Amazon Bedrock 上的 Opus 5.5 仍接受 computer_20251124。已經使用該工具集的瀏覽器操作整合,不必為這一處破壞性變更改程式碼。

2026 年 8 月 31 日及之後建立的帳號,若重放時改了 Opus 5.5 思考塊前面的字首,就是第四處 400。對話保持只追加。

請求成功、行為仍然變了

省略 effort 現在會跑在 medium。同樣的省略在 Opus 5 上跑的是 high。effort 對齊之後,Opus 5.5 每一輪往往比 Opus 5 思考得更多,在 xhigh 和 max 上尤其明顯。從 Opus 5 配置裡抄過來的 effort 值是一個新的成本點。max_tokens 要給思考塊留出空間。

工具呼叫之間寫下的文字,回到思考塊裡。預設 display 值是 omitted 時,這些塊是空的。過去會把這段文字流式展示出來的介面會變靜,請求本身仍然成功。產品需要這些進度行時,設定一個 display 值。

生物分類器和網路安全分類器一起執行。把模型推向“把推理抄進可見回答”的提示,可能以 reasoning_extraction 被拒絕。提示指南說,圖表和截圖在加上視覺工具之前就已經讀得更準,因此過去用來彌補讀圖偏弱的提示詞,值得單獨重放。

哪些負載值得先評測

把 Opus 5.5 放在釋出頁寫得很具體的工作上重放:跨多個檔案的修改、帶著倉庫自己測試的遷移、按來源評分的研究備忘錄,以及可以跑兩遍的計算機操作流程。記下請求的模型、實際作答的模型、effort、輸入 token、快取讀取 token、輸出 token、牆鍾時間、重試和人工修改。Anthropic 的“大約低 40%”和“大約五分之一成本”說的是他們的測試裝置,替代不了這張記錄表。

重放仍然輸掉的任務,繼續用 Fable 5.1,或一條明確的回退。網路安全防護會移交的流量,按 Opus 4.8 來準備;生物和前沿模型開發上防護會移交的流量,按 Opus 5 來準備。任務適合 $2 / $10 這張卡、又不需要 Opus 迴圈時,繼續用 Sonnet 5.5 或 Sonnet 5。

在 Modelflare 上,這個等級傳送 claude-opus-5-5。2026 年 9 月 30 日這一行啟用三個公開分組:失敗代價高時用 claude-premium 0.5,日常生產用 claude-stable 0.315,呼叫可以重試時用 claude-award 0.25。claude-tmp-cheap 沒有啟用在這個模型上。claude-stable 的用戶價格是每百萬輸入 token $1.26、每百萬輸出 token $6.30。

資料來源