Claude Sonnet 5.5:規格、價格與 Modelflare 接入
依據 Anthropic 2026 年 9 月 28 日的發布頁和模型頁,整理 claude-sonnet-5-5 的規格、官網標價和基準讀法,並記錄 2026 年 9 月 30 日 Modelflare 價格介面中的公開群組與使用者價格。
Claude Sonnet 5.5 於 2026 年 9 月 28 日發布。API 模型 ID 是 claude-sonnet-5-5。它是 Claude 5.5 系列的第二款。Anthropic 把它放在 Opus 5.5 旁邊:範圍清楚的日常任務、修 bug,以及文件、幻燈片和表格,用這一款;複雜、開放、需要持續判斷的工作,仍用 Opus 5.5。官網標價與 Sonnet 5 相同,每百萬輸入 token $2,每百萬輸出 token $10,快取讀取 $0.20。
本文把三層分開。規格和破壞性變更來自模型頁、更新說明和遷移指南。基準表抄自發布頁,Modelflare 沒有重跑這些評測。群組和使用者價格來自 2026 年 9 月 30 日讀取的 GET https://modelflare.dev/api/pricing。廠商關於“最多便宜 30%”“快 30% 以上”的說法,描述的是他們自己的測試裝置。
核查後的結論
按官網標價,Sonnet 5.5 與 Sonnet 5 是同一張價格卡,輸入和輸出都是 Opus 5.5 的一半。發布頁印出的程式設計和知識工作行上,它明顯高於 Sonnet 5。Terminal-Bench 4.0 的 70.6% 高於 Opus 5.5 在該表中的 66.4%。CursorBench 4.0 的 55.5% 與 GDPval-AA v2.1 的 1844,都緊挨著 Opus 5.5,並低於它。Anthropic 同時寫明,在他們自己的使用和外部測試裡,複雜、開放、需要持續判斷的工作仍是 Opus 5.5 更強。
2026 年 9 月 30 日,Modelflare 價格介面已經有 claude-sonnet-5-5。單位價格與官網的輸入、輸出、快取讀取和 5 分鐘快取寫入一致。公開群組是 claude-award、claude-stable、claude-premium 和 claude-tmp-cheap。2026 年 9 月 29 日的主站公告寫的是當時開放的 claude-award 和 claude-stable。到這次讀取時,公開群組已經多了後兩個。
已經公開的規格
| 項目 | Claude Sonnet 5.5 |
|---|---|
| Claude API ID | claude-sonnet-5-5 |
| Amazon Bedrock ID | anthropic.claude-sonnet-5-5 |
| Google Cloud、Microsoft Foundry、Claude Platform on AWS | claude-sonnet-5-5 |
| 發布日期 | 2026 年 9 月 28 日 |
| 退役承諾 | 不早於 2027 年 9 月 28 日 |
| 上下文 / 同步最大輸出 | 1M / 128K tokens |
| 批次 API 最大輸出 | 300K tokens,beta 標頭 output-300k-2026-03-24 |
| 輸入 → 輸出 | 文字和圖片 → 文字 |
| 思考 | 自適應,預設開啟 |
| Claude API 的預設 effort | high |
| Claude 應用與 Claude Code 的預設 effort | medium |
| effort 取值 | low、medium、high、xhigh、max |
| 可靠知識截止 | 2026 年 6 月 |
| 可快取提示的最短長度 | 512 tokens |
| 分詞器 | 與 Sonnet 5 相同,同一段文字的 token 數相同 |
模型頁把延遲檔寫成 Fast,這是相對當前 Claude 產品線的比較,不是一個 tokens/秒的測量值。關閉預先思考的最低檔是 thinking: {"type": "between_tools"},只在 low、medium 和 high 上接受。xhigh 和 max 要改回自適應思考。temperature、top_p 或 top_k 設成非預設值會返回 400。
Haiku 5.5 在發布頁上寫的是隨後幾週推出。本文不給一個尚未出現的 ID 寫價格。
官網價格
單位是美元 / 每百萬 tokens。Sonnet 5.5 這一列來自模型頁。Opus 5.5 這一列來自同一發布頁的對比表。更新說明寫明,Sonnet 5.5 的價格與 Sonnet 5 相同,包含提示快取和批次。批次折扣是輸入和輸出的 50%。
| 每 1M tokens | Sonnet 5.5 | 發布頁上的 Opus 5.5 |
|---|---|---|
| 輸入 | $2 | $4 |
| 輸出 | $10 | $20 |
| 快取讀取 | $0.20 | $0.20 |
| 快取寫入 | 5 分鐘 $2.50;1 小時 $4 | $5 |
| 批次輸入 / 輸出 | 標價的 50% | 這張表沒有給出 |
發布頁把 Opus 5.5 的快取寫入印成一個 $5,沒有拆開 5 分鐘和 1 小時。Sonnet 5.5 的模型頁把兩檔分開。相對 Opus 5.5 的輸入和輸出,這張卡是一半。快取讀取兩款都是 $0.20。
Anthropic 還有兩條工作負載說法:同樣的工作通常更省 token,多數任務最多便宜 30%;輸出生成比 Sonnet 5 快 30% 以上。成本圖上還有若干“大約十分之一”“大約五分之一”“大約十五分之一”的單任務成本比較。這些都是他們測試裝置裡的結果。真實帳單仍取決於 effort、快取命中、工具輪次和有沒有走批次。
基準應該怎麼讀
下表就是發布頁印出的那一張。破折號是發布頁自己的空格。Terminal-Bench 4.0 和 CursorBench 4.0 的成本圖改用了 GPT-5.6 Sol,因為 OpenAI 沒有公開 GPT-6 Sol 的這兩項。本文不把圖上的 GPT-5.6 Sol 填進 GPT-6 Sol 這一列。Modelflare 沒有重跑。
| 基準 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% | — |
| FrontierCode v1.1,Main | 46.2%(max);52.1%(xhigh) | 42.4% | 54.4% | 49.3% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | — |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam,有工具 | 64.5% | 54.9% | 67.7% | — |
| OSWorld 2.1,partial | 80.1% | 57.0% | 81.8% | — |
| Chartography,無工具 | 61.6% | 15.6% | 64.4% | 53.6% |
腳註要和分數放在一起看。Opus 5.5 的 Terminal-Bench 4.0 是 xhigh,發布頁稱這是該模型的最高分。FrontierCode 上,Sonnet 5.5 的 max 低於 xhigh。發布頁的解釋是:max 更常執行程式碼審查,審查被拆到多個子代理之後,出現過超時,也出現過超出任務範圍的修改,而這項評測會懲罰超範圍改動。GDPval-AA 和 AA-Briefcase 由 Artificial Analysis 跑在一個預發布部署上,該部署有一個可能壓低結構化輸出的缺陷,發布頁說這個缺陷後來已修復,若有影響,方向是低估 Sonnet 5.5。GPT-6 Sol 列上的 GDPval-AA、AA-Briefcase 和 Chartography 還帶另一條說明:OpenAI 修復過一個損害圖像理解的缺陷,這些外部分數當時未必已經更新。
同一頁的成本圖用的是另一種讀法。Medium effort 是 Claude 應用裡的預設值。在若干基準上,Low 或 Medium 的 Sonnet 5.5 以大約十分之一的單任務成本超過 Sonnet 5 的最好成績。High effort 是 Claude Platform 的預設值。發布頁寫,FrontierCode 在 High 上比同一檔的 Sonnet 5 高大約 10 分,單任務成本大約是十五分之一,並與 GPT-6 Sol 的最好成績相當,成本大約是五分之一。CursorBench 在 Low 上超過 Sonnet 5 的最好成績,成本不到十分之一。AA-Briefcase 在 Medium 上超過 Sonnet 5 的最好成績,成本大約是九分之一。表裡的 55.5% 和 1844 是發布頁印出的點,成本句是另一套裝置。發布頁上的客戶引語是挑選過的證詞,可以提示該重放什麼,不屬於這張表。
發布頁還寫到,它是第一款只看截圖就透過 Pokémon Red 的 Sonnet。這是廠商的產品敘述,不是上表的一行。
Modelflare 的價格和群組
2026 年 9 月 30 日的價格響應裡,claude-sonnet-5-5 的 input_price 是 2,completion_ratio 是 5,所以輸出是 $10。cache_ratio 是 0.1,所以快取讀取是 $0.20。create_cache_ratio 是 1.25,所以目錄裡的快取寫入是 $2.50。這一行沒有 billing_mode,也沒有單獨的 1 小時寫入價。官網的 1 小時 $4 和批次五折,都不要乘上群組倍率之後當成已經入帳的金額。入帳看用量記錄。
端點型別是 anthropic 和 openai。群組寫在 API 金鑰上。四個公開群組呼叫的是同一個模型 ID。
價格表
| 群組 | 倍率 | 輸入 / 1M | 快取讀取 / 1M | 目錄快取寫入 / 1M | 輸出 / 1M | 當天的目錄說明 |
|---|---|---|---|---|---|---|
claude-award |
0.25 | $0.50 | $0.05 | $0.625 | $2.50 | 價格優先,適合預算敏感、可以重試的開發、測試和彈性任務 |
claude-stable |
0.315 | $0.63 | $0.063 | $0.7875 | $3.15 | 看重穩定性的個人開發、較長期專案和生產應用 |
claude-premium |
0.5 | $1.00 | $0.10 | $1.25 | $5.00 | 優先連續性和請求成功,按官網標價的 50% 計 |
claude-tmp-cheap |
0.06 | $0.12 | $0.012 | $0.15 | $0.60 | 限時優惠路由 |
計算方式是目錄單位價格乘以群組倍率。claude-stable 的 $0.63 是 $2 × 0.315,快取寫入 $0.7875 是 $2.50 × 0.315。目錄說明是群組定義裡的文字,不是已經測得的可用性協議。
同一份響應還列出未公開的 claude-first-topup,倍率 0.03,定義寫成單筆充值達到 50 美元後解鎖。它不在公開可選群組裡,所以上表沒有這一行。金鑰如果還配置了回退群組,請求離開活動群組之後,按實際承接的群組計費。
三個算例
形狀是 10 萬個相應類別的輸入 token,加 5,000 個輸出 token。快取行假定用量記錄真的把這些 token 計成讀取或寫入。金額很小時,額度取整也可能讓入帳數字移動。
| 請求 | 官網標價 | claude-award |
claude-stable |
claude-premium |
claude-tmp-cheap |
|---|---|---|---|---|---|
| 10 萬未快取輸入,5,000 輸出 | $0.2500 | $0.0625 | $0.07875 | $0.1250 | $0.0150 |
| 10 萬快取讀取,5,000 輸出 | $0.0700 | $0.0175 | $0.02205 | $0.0350 | $0.0042 |
| 10 萬目錄快取寫入,5,000 輸出 | $0.3000 | $0.0750 | $0.0945 | $0.1500 | $0.0180 |
第一行的官網標價是 0.1 × $2 + 0.005 × $10。群組列是這個 $0.25 乘以倍率。第三行用的是目錄裡的 $2.50 寫入價,對應官網的 5 分鐘檔,不是 1 小時的 $4。實時頁面是 claude-sonnet-5-5 價格頁。總表是模型與價格。
失敗一次的代價很高時,目錄把 claude-premium 寫成連續性優先。日常生產和較長期專案,目錄把 claude-stable 寫成預設的那一類。可以重試的開發和測試,用 claude-award。claude-tmp-cheap 是限時優惠路由,倍率 0.06。選擇群組看失敗成本,不要只看倍率。
在 Modelflare 上怎麼呼叫
建立金鑰時選上表裡的一個群組。模型 ID 必須精確傳送 claude-sonnet-5-5。規範基址是 https://modelflare.dev/v1。同一套 API 也在 https://cf.modelflare.dev/v1 和 https://origin.modelflare.dev/v1。根域名是規範站點。
Messages API 是設定 effort 的那條入口。下面這個請求把思考留在自適應,把 effort 設為 medium。max_tokens 要給思考塊留出位置。
export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"
curl -sS https://modelflare.dev/v1/messages \
-H "x-api-key: $MODELFLARE_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{
"role": "user",
"content": "審這份遷移計畫,列出最需要補測試的三個假設。"
}
]
}'
Chat Completions 也列在這個 ID 上。這個例子只發文字,不帶 reasoning_effort。
curl -sS https://modelflare.dev/v1/chat/completions \
-H "Authorization: Bearer $MODELFLARE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"messages": [
{
"role": "user",
"content": "審這份遷移計畫,列出最需要補測試的三個假設。"
}
]
}'
要指定 effort,用上面的 Messages 請求。當前閘道器把 Chat Completions 的 reasoning_effort 寫成帶 budget_tokens 的手動思考,而 Sonnet 5.5 會拒絕手動預算。省略 effort 時,Claude API 的預設值是 high。兩種入口的差別見 Responses API 與 Chat Completions 對比。用量怎麼對上帳單,見 AI API 成本追蹤。
從 Sonnet 5 遷過來
更新說明列出五處會讓原來跑在 Sonnet 5 上的程式碼返回 400 的變更,另有一處請求仍然成功、響應形狀變了。
會返回 400 的請求
thinking: {"type": "disabled"}
thinking: {"type": "enabled", "budget_tokens": N}
thinking: {"type": "between_tools"} 且 effort 為 xhigh 或 max
tool_choice: {"type": "any"}
tool_choice: {"type": "tool", "name": "..."}
temperature、top_p、top_k 設為非預設值
Claude API 與 Google Cloud 上的工具型別 computer_20251124
顧問工具使用 Opus 4.8、Opus 4.7 或 Sonnet 5 作為顧問
關閉預先思考時,傳送 between_tools,effort 保持在 high 或更低。tool_choice 繼續用 auto 或 none。要得到符合 schema 的工具參數,把 strict 開啟,或改用結構化輸出,並在提示裡寫明何時呼叫工具。計算機操作在 Claude API 和 Google Cloud 上改用 computer_toolset_20260801。Amazon Bedrock 仍接受原來的 computer_20251124。顧問工具接受 Mythos 5.1、Fable 5.1、Mythos 5、Fable 5、Opus 5.5、Opus 5,或 Sonnet 5.5 自己。顧問返回的內容是加密的,用戶端讀不到正文。
2026 年 8 月 31 日 00:00 UTC 及之後建立的帳號,在 Claude API、Amazon Bedrock 和 Google Cloud 上還有一處 400:重放 Sonnet 5.5 的思考塊時,如果系統提示、工具列表或更早的訊息已經改過,請求會失敗。對話保持只追加。指令必須改時,用對話中途的系統訊息。
請求成功,行為仍然變了
省略 effort 時,API 跑在 high。同一個詞在 Sonnet 5 上的思考量對不上,更新說明要求重新做 effort 掃描,不要把舊配置抄過來。範圍清楚的工具迴圈可以從 medium 開始,更長或更難的再升到 high。延遲敏感的對話從 medium 或 low 開始。
工具呼叫之間超過一兩句的進度文字,回到思考塊裡。預設 display 為 omitted 時,這些塊的文字是空的,介面會在工具之間變靜,請求本身仍然成功。需要這些進度行時,設定 display。使用 between_tools 時,這段文字會回來。
思考塊記著產生它的模型。Sonnet 5.5 能讀 Sonnet 5、Opus 4.8、Haiku 4.5 和更早模型的思考塊。它不讀 Opus 5、Opus 5.5、Fable 或 Mythos 的思考塊。其他模型也不讀 Sonnet 5.5 的思考塊。目標模型讀不了的塊會在模型看到之前被丟掉,丟掉的塊不計費。Sonnet 5.5 產生的思考塊還綁在產生它的帳號上。換一個沒有關聯的帳號重放時,塊會被丟掉,請求仍然成功。
拒答和回退
被拒絕的請求以 HTTP 200 返回,stop_reason 為 "refusal"。更新說明裡的類別包括 cyber、bio、frontier_llm、reasoning_extraction 和 general_harms。發布頁寫明,它的網路安全能力已經接近 Opus 5,因此這是第一款帶上同類網路安全防護的 Sonnet。更高風險的網路安全任務會回退到 Sonnet 5。生物防護與 Sonnet 5 相同。常規軟體開發和多數生命科學工作不在這兩條窄防護裡。
更新說明裡的 Claude API beta 預設回退,會把 cyber 和 frontier_llm 轉到 Sonnet 5,不重試 bio、reasoning_extraction 和 general_harms。那是 Anthropic 文件裡的行為。Modelflare 這條路由有沒有同一種回退,以響應裡的模型名為準。拒答和傳輸錯誤要分開處理。計費是否發生,還要看拒答類別。發布頁同時寫明,Sonnet 5.5 可以提供零資料保留。
切換流量前要核對的事
- 固定
claude-sonnet-5-5。完成結果裡的模型名也要核對,防護回退時,作答的模型可以是 Sonnet 5。 - 確認金鑰群組是上表四個公開群組之一,並按失敗成本來選。
- 用同一份不含敏感資訊的集合,分別在
low、medium、high、xhigh和max上回放。記錄成功率、延遲、輸入、快取讀取、快取寫入、輸出和費用。 - effort 放在 Messages 請求的
output_config.effort裡。不要用 Chat Completions 的reasoning_effort來設定這一款的思考檔。 - 原來發送
disabled、強制工具選擇、手動思考預算或computer_20251124的用戶端,先改再放量。 - 重放思考塊的對話保持只追加。
- 把 HTTP 200 的拒答和傳輸失敗分開計數。
- 用一條短提示和一條會命中快取的提示核對入帳金額。官網的 1 小時寫入價和批次五折,都以用量記錄為準。
- 複雜、開放、需要持續判斷的任務繼續用
claude-opus-5-5。claude-sonnet-5繼續可用。
來源
核對日期:2026 年 9 月 30 日。Modelflare 沒有獨立復現基準。
- 發布頁,2026 年 9 月 28 日:https://www.anthropic.com/claude-sonnet-5-5
- 模型頁:https://platform.claude.com/docs/en/models/sonnet-5-5/overview
- 更新說明:https://platform.claude.com/docs/en/models/sonnet-5-5/whats-new-sonnet-5-5
- 遷移指南:https://platform.claude.com/docs/en/models/sonnet-5-5/migration-guide
- Modelflare 價格介面:https://modelflare.dev/api/pricing
- 價格頁:https://modelflare.dev/pricing/claude-sonnet-5-5