Claude Sonnet 5.5:規格、價格與 Modelflare 接入

依據 Anthropic 2026 年 9 月 28 日的發布頁和模型頁,整理 claude-sonnet-5-5 的規格、官網標價和基準讀法,並記錄 2026 年 9 月 30 日 Modelflare 價格介面中的公開群組與使用者價格。

Claude Sonnet 5.5 於 2026 年 9 月 28 日發布。API 模型 ID 是 claude-sonnet-5-5。它是 Claude 5.5 系列的第二款。Anthropic 把它放在 Opus 5.5 旁邊:範圍清楚的日常任務、修 bug,以及文件、幻燈片和表格,用這一款;複雜、開放、需要持續判斷的工作,仍用 Opus 5.5。官網標價與 Sonnet 5 相同,每百萬輸入 token $2,每百萬輸出 token $10,快取讀取 $0.20。

本文把三層分開。規格和破壞性變更來自模型頁、更新說明和遷移指南。基準表抄自發布頁,Modelflare 沒有重跑這些評測。群組和使用者價格來自 2026 年 9 月 30 日讀取的 GET https://modelflare.dev/api/pricing。廠商關於“最多便宜 30%”“快 30% 以上”的說法,描述的是他們自己的測試裝置。

核查後的結論

按官網標價,Sonnet 5.5 與 Sonnet 5 是同一張價格卡,輸入和輸出都是 Opus 5.5 的一半。發布頁印出的程式設計和知識工作行上,它明顯高於 Sonnet 5。Terminal-Bench 4.0 的 70.6% 高於 Opus 5.5 在該表中的 66.4%。CursorBench 4.0 的 55.5% 與 GDPval-AA v2.1 的 1844,都緊挨著 Opus 5.5,並低於它。Anthropic 同時寫明,在他們自己的使用和外部測試裡,複雜、開放、需要持續判斷的工作仍是 Opus 5.5 更強。

2026 年 9 月 30 日,Modelflare 價格介面已經有 claude-sonnet-5-5。單位價格與官網的輸入、輸出、快取讀取和 5 分鐘快取寫入一致。公開群組是 claude-award、claude-stable、claude-premium 和 claude-tmp-cheap。2026 年 9 月 29 日的主站公告寫的是當時開放的 claude-award 和 claude-stable。到這次讀取時,公開群組已經多了後兩個。

已經公開的規格

項目 Claude Sonnet 5.5
Claude API ID claude-sonnet-5-5
Amazon Bedrock ID anthropic.claude-sonnet-5-5
Google Cloud、Microsoft Foundry、Claude Platform on AWS claude-sonnet-5-5
發布日期 2026 年 9 月 28 日
退役承諾 不早於 2027 年 9 月 28 日
上下文 / 同步最大輸出 1M / 128K tokens
批次 API 最大輸出 300K tokens,beta 標頭 output-300k-2026-03-24
輸入 → 輸出 文字和圖片 → 文字
思考 自適應,預設開啟
Claude API 的預設 effort high
Claude 應用與 Claude Code 的預設 effort medium
effort 取值 low、medium、high、xhigh、max
可靠知識截止 2026 年 6 月
可快取提示的最短長度 512 tokens
分詞器 與 Sonnet 5 相同,同一段文字的 token 數相同

模型頁把延遲檔寫成 Fast,這是相對當前 Claude 產品線的比較,不是一個 tokens/秒的測量值。關閉預先思考的最低檔是 thinking: {"type": "between_tools"},只在 low、medium 和 high 上接受。xhigh 和 max 要改回自適應思考。temperature、top_p 或 top_k 設成非預設值會返回 400。

Haiku 5.5 在發布頁上寫的是隨後幾週推出。本文不給一個尚未出現的 ID 寫價格。

官網價格

單位是美元 / 每百萬 tokens。Sonnet 5.5 這一列來自模型頁。Opus 5.5 這一列來自同一發布頁的對比表。更新說明寫明,Sonnet 5.5 的價格與 Sonnet 5 相同,包含提示快取和批次。批次折扣是輸入和輸出的 50%。

每 1M tokens Sonnet 5.5 發布頁上的 Opus 5.5
輸入 $2 $4
輸出 $10 $20
快取讀取 $0.20 $0.20
快取寫入 5 分鐘 $2.50;1 小時 $4 $5
批次輸入 / 輸出 標價的 50% 這張表沒有給出

發布頁把 Opus 5.5 的快取寫入印成一個 $5,沒有拆開 5 分鐘和 1 小時。Sonnet 5.5 的模型頁把兩檔分開。相對 Opus 5.5 的輸入和輸出,這張卡是一半。快取讀取兩款都是 $0.20。

Anthropic 還有兩條工作負載說法:同樣的工作通常更省 token,多數任務最多便宜 30%;輸出生成比 Sonnet 5 快 30% 以上。成本圖上還有若干“大約十分之一”“大約五分之一”“大約十五分之一”的單任務成本比較。這些都是他們測試裝置裡的結果。真實帳單仍取決於 effort、快取命中、工具輪次和有沒有走批次。

基準應該怎麼讀

下表就是發布頁印出的那一張。破折號是發布頁自己的空格。Terminal-Bench 4.0 和 CursorBench 4.0 的成本圖改用了 GPT-5.6 Sol,因為 OpenAI 沒有公開 GPT-6 Sol 的這兩項。本文不把圖上的 GPT-5.6 Sol 填進 GPT-6 Sol 這一列。Modelflare 沒有重跑。

基準 Sonnet 5.5 Sonnet 5 Opus 5.5 GPT-6 Sol
Terminal-Bench 4.0 70.6% 10.3% 66.4% —
FrontierCode v1.1,Main 46.2%(max);52.1%(xhigh) 42.4% 54.4% 49.3%
CursorBench 4.0 55.5% 34.1% 57.8% —
GDPval-AA v2.1 1844 1449 1846 1487
AA-Briefcase v1.1 1811 1359 1822 1483
Humanity's Last Exam,有工具 64.5% 54.9% 67.7% —
OSWorld 2.1,partial 80.1% 57.0% 81.8% —
Chartography,無工具 61.6% 15.6% 64.4% 53.6%

腳註要和分數放在一起看。Opus 5.5 的 Terminal-Bench 4.0 是 xhigh,發布頁稱這是該模型的最高分。FrontierCode 上,Sonnet 5.5 的 max 低於 xhigh。發布頁的解釋是:max 更常執行程式碼審查,審查被拆到多個子代理之後,出現過超時,也出現過超出任務範圍的修改,而這項評測會懲罰超範圍改動。GDPval-AA 和 AA-Briefcase 由 Artificial Analysis 跑在一個預發布部署上,該部署有一個可能壓低結構化輸出的缺陷,發布頁說這個缺陷後來已修復,若有影響,方向是低估 Sonnet 5.5。GPT-6 Sol 列上的 GDPval-AA、AA-Briefcase 和 Chartography 還帶另一條說明:OpenAI 修復過一個損害圖像理解的缺陷,這些外部分數當時未必已經更新。

同一頁的成本圖用的是另一種讀法。Medium effort 是 Claude 應用裡的預設值。在若干基準上,Low 或 Medium 的 Sonnet 5.5 以大約十分之一的單任務成本超過 Sonnet 5 的最好成績。High effort 是 Claude Platform 的預設值。發布頁寫,FrontierCode 在 High 上比同一檔的 Sonnet 5 高大約 10 分,單任務成本大約是十五分之一,並與 GPT-6 Sol 的最好成績相當,成本大約是五分之一。CursorBench 在 Low 上超過 Sonnet 5 的最好成績,成本不到十分之一。AA-Briefcase 在 Medium 上超過 Sonnet 5 的最好成績,成本大約是九分之一。表裡的 55.5% 和 1844 是發布頁印出的點,成本句是另一套裝置。發布頁上的客戶引語是挑選過的證詞,可以提示該重放什麼,不屬於這張表。

發布頁還寫到,它是第一款只看截圖就透過 Pokémon Red 的 Sonnet。這是廠商的產品敘述,不是上表的一行。

Modelflare 的價格和群組

2026 年 9 月 30 日的價格響應裡,claude-sonnet-5-5 的 input_price 是 2,completion_ratio 是 5,所以輸出是 $10。cache_ratio 是 0.1,所以快取讀取是 $0.20。create_cache_ratio 是 1.25,所以目錄裡的快取寫入是 $2.50。這一行沒有 billing_mode,也沒有單獨的 1 小時寫入價。官網的 1 小時 $4 和批次五折,都不要乘上群組倍率之後當成已經入帳的金額。入帳看用量記錄。

端點型別是 anthropic 和 openai。群組寫在 API 金鑰上。四個公開群組呼叫的是同一個模型 ID。

價格表

群組 倍率 輸入 / 1M 快取讀取 / 1M 目錄快取寫入 / 1M 輸出 / 1M 當天的目錄說明
claude-award 0.25 $0.50 $0.05 $0.625 $2.50 價格優先,適合預算敏感、可以重試的開發、測試和彈性任務
claude-stable 0.315 $0.63 $0.063 $0.7875 $3.15 看重穩定性的個人開發、較長期專案和生產應用
claude-premium 0.5 $1.00 $0.10 $1.25 $5.00 優先連續性和請求成功,按官網標價的 50% 計
claude-tmp-cheap 0.06 $0.12 $0.012 $0.15 $0.60 限時優惠路由

計算方式是目錄單位價格乘以群組倍率。claude-stable 的 $0.63 是 $2 × 0.315,快取寫入 $0.7875 是 $2.50 × 0.315。目錄說明是群組定義裡的文字,不是已經測得的可用性協議。

同一份響應還列出未公開的 claude-first-topup,倍率 0.03,定義寫成單筆充值達到 50 美元後解鎖。它不在公開可選群組裡,所以上表沒有這一行。金鑰如果還配置了回退群組,請求離開活動群組之後,按實際承接的群組計費。

三個算例

形狀是 10 萬個相應類別的輸入 token,加 5,000 個輸出 token。快取行假定用量記錄真的把這些 token 計成讀取或寫入。金額很小時,額度取整也可能讓入帳數字移動。

請求 官網標價 claude-award claude-stable claude-premium claude-tmp-cheap
10 萬未快取輸入,5,000 輸出 $0.2500 $0.0625 $0.07875 $0.1250 $0.0150
10 萬快取讀取,5,000 輸出 $0.0700 $0.0175 $0.02205 $0.0350 $0.0042
10 萬目錄快取寫入,5,000 輸出 $0.3000 $0.0750 $0.0945 $0.1500 $0.0180

第一行的官網標價是 0.1 × $2 + 0.005 × $10。群組列是這個 $0.25 乘以倍率。第三行用的是目錄裡的 $2.50 寫入價,對應官網的 5 分鐘檔,不是 1 小時的 $4。實時頁面是 claude-sonnet-5-5 價格頁。總表是模型與價格。

失敗一次的代價很高時,目錄把 claude-premium 寫成連續性優先。日常生產和較長期專案,目錄把 claude-stable 寫成預設的那一類。可以重試的開發和測試,用 claude-award。claude-tmp-cheap 是限時優惠路由,倍率 0.06。選擇群組看失敗成本,不要只看倍率。

在 Modelflare 上怎麼呼叫

建立金鑰時選上表裡的一個群組。模型 ID 必須精確傳送 claude-sonnet-5-5。規範基址是 https://modelflare.dev/v1。同一套 API 也在 https://cf.modelflare.dev/v1 和 https://origin.modelflare.dev/v1。根域名是規範站點。

Messages API 是設定 effort 的那條入口。下面這個請求把思考留在自適應,把 effort 設為 medium。max_tokens 要給思考塊留出位置。

export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"

curl -sS https://modelflare.dev/v1/messages \
  -H "x-api-key: $MODELFLARE_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 1024,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {
        "role": "user",
        "content": "審這份遷移計畫,列出最需要補測試的三個假設。"
      }
    ]
  }'

Chat Completions 也列在這個 ID 上。這個例子只發文字,不帶 reasoning_effort。

curl -sS https://modelflare.dev/v1/chat/completions \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "messages": [
      {
        "role": "user",
        "content": "審這份遷移計畫,列出最需要補測試的三個假設。"
      }
    ]
  }'

要指定 effort,用上面的 Messages 請求。當前閘道器把 Chat Completions 的 reasoning_effort 寫成帶 budget_tokens 的手動思考,而 Sonnet 5.5 會拒絕手動預算。省略 effort 時,Claude API 的預設值是 high。兩種入口的差別見 Responses API 與 Chat Completions 對比。用量怎麼對上帳單,見 AI API 成本追蹤。

從 Sonnet 5 遷過來

更新說明列出五處會讓原來跑在 Sonnet 5 上的程式碼返回 400 的變更,另有一處請求仍然成功、響應形狀變了。

會返回 400 的請求

thinking: {"type": "disabled"}
thinking: {"type": "enabled", "budget_tokens": N}
thinking: {"type": "between_tools"} 且 effort 為 xhigh 或 max
tool_choice: {"type": "any"}
tool_choice: {"type": "tool", "name": "..."}
temperature、top_p、top_k 設為非預設值
Claude API 與 Google Cloud 上的工具型別 computer_20251124
顧問工具使用 Opus 4.8、Opus 4.7 或 Sonnet 5 作為顧問

關閉預先思考時,傳送 between_tools,effort 保持在 high 或更低。tool_choice 繼續用 auto 或 none。要得到符合 schema 的工具參數,把 strict 開啟,或改用結構化輸出,並在提示裡寫明何時呼叫工具。計算機操作在 Claude API 和 Google Cloud 上改用 computer_toolset_20260801。Amazon Bedrock 仍接受原來的 computer_20251124。顧問工具接受 Mythos 5.1、Fable 5.1、Mythos 5、Fable 5、Opus 5.5、Opus 5,或 Sonnet 5.5 自己。顧問返回的內容是加密的,用戶端讀不到正文。

2026 年 8 月 31 日 00:00 UTC 及之後建立的帳號,在 Claude API、Amazon Bedrock 和 Google Cloud 上還有一處 400:重放 Sonnet 5.5 的思考塊時,如果系統提示、工具列表或更早的訊息已經改過,請求會失敗。對話保持只追加。指令必須改時,用對話中途的系統訊息。

請求成功,行為仍然變了

省略 effort 時,API 跑在 high。同一個詞在 Sonnet 5 上的思考量對不上,更新說明要求重新做 effort 掃描,不要把舊配置抄過來。範圍清楚的工具迴圈可以從 medium 開始,更長或更難的再升到 high。延遲敏感的對話從 medium 或 low 開始。

工具呼叫之間超過一兩句的進度文字,回到思考塊裡。預設 display 為 omitted 時,這些塊的文字是空的,介面會在工具之間變靜,請求本身仍然成功。需要這些進度行時,設定 display。使用 between_tools 時,這段文字會回來。

思考塊記著產生它的模型。Sonnet 5.5 能讀 Sonnet 5、Opus 4.8、Haiku 4.5 和更早模型的思考塊。它不讀 Opus 5、Opus 5.5、Fable 或 Mythos 的思考塊。其他模型也不讀 Sonnet 5.5 的思考塊。目標模型讀不了的塊會在模型看到之前被丟掉,丟掉的塊不計費。Sonnet 5.5 產生的思考塊還綁在產生它的帳號上。換一個沒有關聯的帳號重放時,塊會被丟掉,請求仍然成功。

拒答和回退

被拒絕的請求以 HTTP 200 返回,stop_reason 為 "refusal"。更新說明裡的類別包括 cyber、bio、frontier_llm、reasoning_extraction 和 general_harms。發布頁寫明,它的網路安全能力已經接近 Opus 5,因此這是第一款帶上同類網路安全防護的 Sonnet。更高風險的網路安全任務會回退到 Sonnet 5。生物防護與 Sonnet 5 相同。常規軟體開發和多數生命科學工作不在這兩條窄防護裡。

更新說明裡的 Claude API beta 預設回退,會把 cyber 和 frontier_llm 轉到 Sonnet 5,不重試 bio、reasoning_extraction 和 general_harms。那是 Anthropic 文件裡的行為。Modelflare 這條路由有沒有同一種回退,以響應裡的模型名為準。拒答和傳輸錯誤要分開處理。計費是否發生,還要看拒答類別。發布頁同時寫明,Sonnet 5.5 可以提供零資料保留。

切換流量前要核對的事

  1. 固定 claude-sonnet-5-5。完成結果裡的模型名也要核對,防護回退時,作答的模型可以是 Sonnet 5。
  2. 確認金鑰群組是上表四個公開群組之一,並按失敗成本來選。
  3. 用同一份不含敏感資訊的集合,分別在 low、medium、high、xhigh 和 max 上回放。記錄成功率、延遲、輸入、快取讀取、快取寫入、輸出和費用。
  4. effort 放在 Messages 請求的 output_config.effort 裡。不要用 Chat Completions 的 reasoning_effort 來設定這一款的思考檔。
  5. 原來發送 disabled、強制工具選擇、手動思考預算或 computer_20251124 的用戶端,先改再放量。
  6. 重放思考塊的對話保持只追加。
  7. 把 HTTP 200 的拒答和傳輸失敗分開計數。
  8. 用一條短提示和一條會命中快取的提示核對入帳金額。官網的 1 小時寫入價和批次五折,都以用量記錄為準。
  9. 複雜、開放、需要持續判斷的任務繼續用 claude-opus-5-5。claude-sonnet-5 繼續可用。

來源

核對日期:2026 年 9 月 30 日。Modelflare 沒有獨立復現基準。