Claude Opus 5.5 深度分析:參數、價格與業界位置
依一手資料整理 Claude Opus 5.5 的公開參數、官網價格,以及相對 Fable 5.1、Opus 5 與 GPT-6 Astra 的基準讀法,並記錄 2026-09-30 Modelflare 目錄中的公開分組與用戶價格。
Claude Opus 5.5 於 2026 年 9 月 22 日釋出。公開契約寫在模型頁和更新說明裡:API 標識是 claude-opus-5-5,上下文 1M tokens,最大輸出 128K,自適應思考保持開啟,預設 effort 為 medium,標價是每百萬輸入 token $4、每百萬輸出 token $20。Anthropic 的這些頁面沒有給出參數量,也沒有給出訓練算力。本文只使用已公開的規格、價格表和基準表。
核查後的結論: 按 Anthropic 官網標價,Opus 5.5 是當前的 Opus 等級。按 token 計,它比 Opus 5 便宜,也比 Fable 5.1 便宜很多。在 Anthropic 印出的程式設計和知識工作行上,它的分數領先 Fable 5.1、Opus 5,並且在其中大多數行上領先 GPT-6 Astra。有兩行方向相反:Astra 領先 Terminal-Bench-Science 0.1 和 Zapier 的 AutomationBench。Modelflare 的價格介面在 2026 年 9 月 30 日已經包含 claude-opus-5-5,單位價格與官網的 $4 / $20 一致。這一行開放的公開分組是 claude-award 0.25、claude-stable 0.315 和 claude-premium 0.5。這個等級的 Key 應傳送 claude-opus-5-5。實時價格見價格頁。
下文的官方行為引自 Opus 5.5 模型頁、更新說明 和釋出頁。Fable 5.1 的遷移細節見本部落格已有的 Fable 5.1 評測。
已經公開的參數
| 專案 | Claude Opus 5.5 |
|---|---|
| 模型 ID,Claude API | claude-opus-5-5 |
| Amazon Bedrock ID | anthropic.claude-opus-5-5 |
| Google Cloud 與 Microsoft Foundry ID | claude-opus-5-5 |
| 釋出日期 | 2026 年 9 月 22 日 |
| 上下文視窗 | 1M tokens,預設即最大 |
| 最大輸出 | 128K tokens |
| 思考 | 自適應,始終開啟 |
| 預設 effort | medium |
| 模型頁上的延遲等級 | 中等 |
| 可靠知識截止 | 2026 年 6 月 |
| 參數量 | 公開模型頁未提供 |
“可靠知識截止”是 Anthropic 對模型既有知識最充分所及日期的叫法。它和上下文視窗是兩件事。請求裡附上的檔案仍然在這次上下文中。
Fast mode 是同一模型 ID 上的速度開關,文件把它標成僅 Claude API 可用的研究預覽。請求使用 speed: "fast",並帶上 beta 頭 fast-mode-2026-02-01。Anthropic 給這個模式的價格是每百萬 token $8 / $40,並把輸出速度寫成最高約 2.5 倍。更新說明寫明:Amazon Bedrock、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry 沒有這個 fast mode。
同一頁把 effort 階梯寫成思考深度的控制項:low、medium、high、xhigh、max。手工指定思考預算會被拒絕。可快取提示詞的最短長度是 512 tokens。
價格
官網標價
單位是美元 / 每百萬 tokens。Opus 5.5 的快取、批次和 fast mode 來自更新說明的價格一節。Opus 5 的快取寫入格,是釋出頁對比表裡的那一個 “cache writes” 數字,該表沒有把 5 分鐘和 1 小時級拆開。Fable 5.1 的快取讀取沿用本部落格 Fable 5.1 評測裡已經使用的官網數字。Sonnet 5 和 Haiku 4.5 的輸入、輸出價格來自 Opus 5.5 模型頁上的對比行。破折號表示本文沒有從一份一手價格行裡取這一格。
| 每 1M tokens 的價格 | Opus 5.5 | Opus 5 | Fable 5.1 | Sonnet 5 | Haiku 4.5 |
|---|---|---|---|---|---|
| 輸入 | $4 | $5 | $10 | $2 | $1 |
| 輸出 | $20 | $25 | $50 | $10 | $5 |
| 快取讀取 | $0.20 | $0.50 | $0.25 | — | — |
| 快取寫入 | 5 分鐘 $5;1 小時 $8 | $6.25 | — | — | — |
| 批次輸入 / 輸出 | $2 / $10 | — | — | — | — |
| Fast mode 輸入 / 輸出 | $8 / $40 | — | — | — | — |
相對 Opus 5,新鮮輸入和輸出的標價降了 20%,從 $5 / $25 到 $4 / $20。長 Agent 迴圈裡佔比更高的快取讀取,從 $0.50 降到 $0.20。這是比 Opus 5 的快取讀取價低 60%,也低於 Fable 5.1 的 $0.25。Anthropic 另有一條工作負載說法:預設設定下,典型任務的花費大約比 Opus 5 低 40%,因為模型用掉的 token 也更少。這 40% 描述的是他們自己的測試裝置。真實帳單仍取決於 effort、快取命中率和工具輪次。
批次處理是新標價的一半。Fast mode 是新標價的兩倍,而且只在 Claude API 上。
2026 年 9 月 30 日的 Modelflare 目錄
2026 年 9 月 30 日讀取的 GET https://modelflare.dev/api/pricing 包含 claude-opus-5-5,同一份回應裡還有 claude-opus-5、claude-fable-5-1、claude-sonnet-5、claude-sonnet-5-5、claude-haiku-4-5、gpt-6-astra 和 gpt-5.6-sol。其中沒有 Haiku 5.5 的 ID。
下表的單位價格是該回應裡、乘上分組倍率之前的 token 價格。Claude 這幾行與官網標價一致。Astra 和 Sol 分檔:輸入上下文超過 272,000 tokens 時用第二組價格,長上下文的輸出價是該檔自己的輸出價。示例列裡,Claude 行乘的是 claude-stable 0.315,OpenAI 行乘的是 openai-stable 0.08。這次讀取的 Claude 倍率是 claude-premium 0.5、claude-stable 0.315、claude-award 0.25。OpenAI 倍率是 openai-premium 0.13、openai-stable 0.08、openai-award 0.03。Opus 5.5 只啟用上面三個 Claude 分組。claude-tmp-cheap 是公開的 Claude 分組,這一行沒有啟用它。
| 模型 | 目錄 ID | 單位輸入 / 輸出 | stable 分組上的使用者價格 |
|---|---|---|---|
| Opus 5.5 | claude-opus-5-5 |
$4 / $20 | $1.26 / $6.30 |
| Opus 5 | claude-opus-5 |
$5 / $25 | $1.575 / $7.875 |
| Fable 5.1 | claude-fable-5-1 |
$10 / $50 | $3.15 / $15.75 |
| Sonnet 5 | claude-sonnet-5 |
$2 / $10 | $0.63 / $3.15 |
| GPT-6 Astra | gpt-6-astra |
$10 / $50,其後 $20 / $75 | $0.80 / $4.00,其後 $1.60 / $6.00 |
| GPT-5.6 Sol | gpt-5.6-sol |
$5 / $30,其後 $10 / $45 | $0.40 / $2.40,其後 $0.80 / $3.60 |
Opus 5.5 在 claude-stable 上是 $4 × 0.315 和 $20 × 0.315。拿 Opus 5.5 和其他實驗室比較時看官網表。看今天就能發出的 Modelflare 帳單時看目錄表。
Haiku 4.5 也在同一份目錄裡,單位價格 $1 / $5。在 claude-stable 上是 $0.315 / $1.575。模型頁的對比仍給 Haiku 200K 上下文和 64K 最大輸出。2026 年 9 月 30 日的回應裡沒有 Haiku 5.5。Haiku 4.5 仍是目前確實列出來的 Claude 產品線低價端。
目錄行上的快取倍率是輸入單位價格的一個分數:Opus 5.5 為 0.05,所以目錄快取讀取是 $0.20,目錄快取寫入是 $5。這個寫入價對應官網的 5 分鐘檔。官網的 1 小時寫入是 $8,目錄沒有單獨的這一檔。Opus 5 和 Sonnet 5 為 0.1,Fable 5.1 為 0.025。快取、長上下文和優先檔以價格頁以及完成後的用量記錄為準。
相對 Opus 5 和 Fable 5.1 改了什麼
| 行為 | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| API ID | claude-opus-5-5 |
claude-opus-5 |
claude-fable-5-1 |
| 上下文 / 最大輸出 | 1M / 128K | 1M / 128K | 1M / 128K |
| 思考 | 始終開啟。disabled 和手工預算返回 400 |
預設開啟。僅在 effort 為 high 或更低時接受 disabled |
始終開啟 |
| 省略 effort 時的預設值 | medium |
high |
high |
| 可靠知識截止 | 2026 年 6 月 | 2026 年 5 月 | 2026 年 6 月 |
| 標價輸入 / 輸出 | $4 / $20 | $5 / $25 | $10 / $50 |
| 快取讀取 | $0.20 | $0.50 | $0.25 |
| 強制工具選擇 | any 和 tool 返回 400 |
被列為相對 Opus 5 的破壞性變更 | 與 Opus 5.5 同樣返回 400 |
| 網路安全防護 | 把任務交給 Opus 4.8 | 釋出說明沒有把這條回退放在 Opus 5 上 | Fable 級別的防護 |
| 生物與前沿 LLM 防護 | 把任務交給 Opus 5 | 釋出說明把這條回退和 Opus 5.5 寫在一起 | 同一類防護 |
Opus 5.5 能讀 Opus 5 以及更早的 Opus、Sonnet、Haiku 產生的思考塊。它不讀 Fable 或 Mythos 產生的思考塊。在 Claude API 上,Fable 5.1 和 Mythos 5.1 能讀 Opus 5.5 的思考塊;更新說明寫明,其他當前模型不能。目標模型讀不了的塊會在模型看到之前被丟掉,丟掉的塊不計費。
2026 年 8 月 31 日及之後建立的帳號檢查更嚴:如果系統提示詞、工具列表或更早的訊息在 Opus 5.5 思考塊產生之後被改過,重放這個塊會返回 400。遷移指南給出的做法是只追加的歷史;指令必須改時,用對話中途的系統訊息。釋出頁還寫到,Opus 5.5 帶有 Fable 5.1 引入的保留思考控制、歐盟 AI 法案水印,以及與此前 Opus 一致的零資料保留。
智力分數應該怎麼讀
下表就是釋出頁印出的那一張。Anthropic 說,除非腳註另有說明,Opus 5.5 使用自適應思考、effort 為 max。Terminal-Bench 4.0 是那個腳註:Opus 5.5 用 xhigh,GPT-6 Astra 用 high,各自取該模型公佈的最高分。Astra 和 Sol 的數字按 OpenAI 的報告引用。生產防護是開啟的。防護介入時,網路安全任務由 Opus 4.8 完成,生物和前沿 LLM 開發任務由 Opus 5 完成。Anthropic 說這會把 Opus 5.5 的分數拉低。
| 基準 | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 55.8% | 52.3% | 57.9% | 37.3% |
| FrontierCode v1.1(Main) | 54.4% | 50.3% | 48.0% | 53.3% | 47.5% |
| CursorBench 4.0 | 57.8% | 51.8% | 46.6% | — | 41.7% |
| GDPval-AA v2.1 | 1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench | 40.0% | 31.4% | 26.9% | 41.4% | 28.8% |
| Humanity's Last Exam,使用工具 | 67.7% | 65.6% | 63.6% | 57.2% | — |
| Terminal-Bench-Science 0.1 | 58.7% | 52.6% | 29.0% | 64.6% | 22.4% |
| OSWorld 2.0,partial | 81.8% | 80.7% | 74.0% | — | — |
| Chartography,使用工具 | 89.0% | 88.4% | 83.4% | — | — |
把差距和他們公佈的誤差放在一起看。Terminal-Bench 4.0 上,Opus 5.5 為 ±2.6 分,其他 Claude 模型為 ±1.6 到 ±2 分。從 66.4% 到 Astra 的 57.9%、到 Fable 的 55.8%,都寬於這些誤差。Terminal-Bench-Science 每個模型是 ±3.5 到 ±5 分。Astra 的 64.6% 對 Opus 5.5 的 58.7%,幅度接近這些誤差的寬度,點估計上 Astra 在前。
AutomationBench 由 Zapier 執行。因為該次執行沒有回退模型,防護介入算作失敗。Anthropic 說實際分數會更高。印出的 40.0% 對 Astra 的 41.4% 是一個很接近的公佈結果,點估計上 Astra 在前。GDPval-AA v2.1 是覆蓋 44 個職業的真實專業任務 Elo:Opus 5.5 為 1846,Fable 5.1 為 1735,Opus 5 為 1708,Sol 為 1588,Astra 為 1542。
同一釋出頁的成本圖上還有第二組分數,取的是預設 effort medium:FrontierCode 54.6%,CursorBench 52.5%。對比表印的是 54.4% 和 57.8%。把它們當成 Anthropic 在兩種 effort 下的兩個數字。圖注還說,medium effort 下 FrontierCode 以大約五分之一的單任務成本超過 Astra 的最高分 53.3%,Terminal-Bench 則以大約 40% 的成本打平 Astra。這些是關於 Anthropic 自己測試裝置的單任務成本說法。
表下那句話更值得留下:在 Anthropic 自己的使用裡,Opus 5.5 和 Fable 5.1 的差距比分數看起來更窄,這個水平上的基準分差對真實任務的指導也更弱。釋出頁上的客戶引語是挑選過的證詞。它們可以提示該重放什麼,不屬於分數表。
它在當前模型格局裡的位置
同一天落地了三件可以核對的變化。
Anthropic 說成“大多數任務達到 Fable 5.1 水準”的那類工作,現在有了一張 Opus 價格卡。標價是 $4 / $20,Fable 5.1 是 $10 / $50。快取讀取是 $0.20,Fable 是 $0.25,Opus 5 是 $0.50。團隊自己的重放若同意這個判斷,Fable 5.1 留給仍然失敗的任務,迴圈本身交給 Opus 5.5。重放若不同意,表裡已經寫出公佈的例外:科學 Agent 任務和 Zapier 的業務工作流,印出的數字由 Astra 領先。
預設值跟著價格一起動了。與這次釋出同時更新的 Claude Code 模型配置,把 Opus 5.5 設為 Pro、Max、Team、Enterprise 和 Anthropic API 的預設模型,也是 Claude Platform on AWS、Amazon Bedrock 和 Google Cloud Agent Platform 的預設模型。Agent 產品裡的預設值,比模型選擇器裡多一行更能帶動流量。
防護邊界下移到了 Opus。早先的 Opus 承接的是 Fable 分類器不願回答的流量。Opus 5.5 帶著一套相近的防護發布:網路安全任務由 Opus 4.8 完成,生物和前沿 LLM 開發任務由 Opus 5 完成。日誌裡請求 ID 記成 claude-opus-5-5,完成結果仍可能來自另一個模型。拒絕以 HTTP 200 返回,stop_reason 為 "refusal"。
Sonnet 5.5 已經在 2026 年 9 月 30 日的目錄裡,單位價格與 Sonnet 5 同為 $2 / $10。該回應沒有 Haiku 5.5。已經列出來的更便宜 Claude 卡是 Sonnet 5.5、Sonnet 5 的 $2 / $10,以及 Haiku 4.5 的 $1 / $5。Haiku 4.5 仍是 200K 窗口。Sonnet 5.5 的分組見 Sonnet 5.5 評測。
這是一份可以從文件裡審計的位置:標價、Claude Code 的預設模型、防護觸發時由誰作答,以及廠商自己的表裡仍由 Astra 領先的行。這裡沒有市場份額的說法。
接入時的約束
會直接返回 400 的請求
只替換模型字串的客戶端,仍會撞上文件為“跑在 Opus 5 上的程式碼”列出的四處破壞性變更。前三處同樣適用於 Fable 5.1。下面是遷移說明要求傳送的形狀。註釋標出返回 invalid_request_error 的變體。
model: claude-opus-5-5
thinking: {"type": "adaptive"}
tool_choice: {"type": "auto"}
output_config.effort: medium
# 400: thinking 型別為 disabled,或 enabled 且帶 budget_tokens
# 400: tool_choice 為 any,或 tool_choice 為 tool
# 400,限於 Claude API 與 Google Cloud:工具型別 computer_20251124
深度取代了過去的思考開關。省略 thinking,或傳送 adaptive。effort 要顯式設定。tool_choice 的 auto 和 none 仍然有效,計數 token 的端點也一樣。要得到符合 schema 的 JSON,遷移說明指向嚴格工具呼叫或結構化輸出,並在提示詞裡寫明何時呼叫工具。
在 Claude API 和 Google Cloud 上,用 computer_toolset_20260801 工具集替換 computer_20251124,並去掉舊的計算機使用 beta 頭。Amazon Bedrock 上的 Opus 5.5 仍接受 computer_20251124。已經使用該工具集的瀏覽器操作整合,不必為這一處破壞性變更改程式碼。
2026 年 8 月 31 日及之後建立的帳號,若重放時改了 Opus 5.5 思考塊前面的字首,就是第四處 400。對話保持只追加。
請求成功、行為仍然變了
省略 effort 現在會跑在 medium。同樣的省略在 Opus 5 上跑的是 high。effort 對齊之後,Opus 5.5 每一輪往往比 Opus 5 思考得更多,在 xhigh 和 max 上尤其明顯。從 Opus 5 配置裡抄過來的 effort 值是一個新的成本點。max_tokens 要給思考塊留出空間。
工具呼叫之間寫下的文字,回到思考塊裡。預設 display 值是 omitted 時,這些塊是空的。過去會把這段文字流式展示出來的介面會變靜,請求本身仍然成功。產品需要這些進度行時,設定一個 display 值。
生物分類器和網路安全分類器一起執行。把模型推向“把推理抄進可見回答”的提示,可能以 reasoning_extraction 被拒絕。提示指南說,圖表和截圖在加上視覺工具之前就已經讀得更準,因此過去用來彌補讀圖偏弱的提示詞,值得單獨重放。
哪些負載值得先評測
把 Opus 5.5 放在釋出頁寫得很具體的工作上重放:跨多個檔案的修改、帶著倉庫自己測試的遷移、按來源評分的研究備忘錄,以及可以跑兩遍的計算機操作流程。記下請求的模型、實際作答的模型、effort、輸入 token、快取讀取 token、輸出 token、牆鍾時間、重試和人工修改。Anthropic 的“大約低 40%”和“大約五分之一成本”說的是他們的測試裝置,替代不了這張記錄表。
重放仍然輸掉的任務,繼續用 Fable 5.1,或一條明確的回退。網路安全防護會移交的流量,按 Opus 4.8 來準備;生物和前沿模型開發上防護會移交的流量,按 Opus 5 來準備。任務適合 $2 / $10 這張卡、又不需要 Opus 迴圈時,繼續用 Sonnet 5.5 或 Sonnet 5。
在 Modelflare 上,這個等級傳送 claude-opus-5-5。2026 年 9 月 30 日這一行啟用三個公開分組:失敗代價高時用 claude-premium 0.5,日常生產用 claude-stable 0.315,呼叫可以重試時用 claude-award 0.25。claude-tmp-cheap 沒有啟用在這個模型上。claude-stable 的用戶價格是每百萬輸入 token $1.26、每百萬輸出 token $6.30。
資料來源
- 釋出頁,2026 年 9 月 22 日:https://www.anthropic.com/claude-opus-5-5
- 模型頁,規格與當前對比行:https://platform.claude.com/docs/en/models/opus-5-5/overview
- 更新說明,破壞性變更與價格卡:https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5
- Claude Code 模型配置,預設模型:https://code.claude.com/docs/en/model-config
- Modelflare 價格介面,讀取於 2026 年 9 月 30 日:https://modelflare.dev/api/pricing
- 本部落格的 Fable 5.1 評測:Fable 5.1 評測