Claude Sonnet 5.5:仕様、価格と Modelflare での利用

出典に基づく claude-sonnet-5-5 の説明。公開された仕様、公式のトークン価格、2026年9月28日のベンチマーク表の読み方、そして2026年9月30日に返った Modelflare のグループとユーザー価格。

Anthropicは2026年9月28日にClaude Sonnet 5.5をリリースしました。APIのモデルIDはclaude-sonnet-5-5です。Claude 5.5シリーズの第二のモデルです。AnthropicはこれをOpus 5.5の隣に置きます。範囲の明確な日常の作業、バグ修正、文書、スライド、スプレッドシートはこちらです。複雑で開かれた、継続的な判断が要る作業は、引き続きOpus 5.5です。リスト価格はSonnet 5と同じで、入力100万トークン当たり$2、出力100万トークン当たり$10、キャッシュ読み取りは100万トークン当たり$0.20です。

この記事は三つの層を分けます。仕様と破壊的変更は、モデルページ、更新ページ、移行ガイドから来ます。ベンチマーク表はリリースページからの転記で、Modelflareはこれらの評価を再実行していません。グループとユーザー価格は、2026年9月30日に読んだGET https://modelflare.dev/api/pricingです。「最大で30%安い」「30%以上速い」といったベンダーの言い方は、彼ら自身のハーネスを説明しています。

確認後の結論

公開リスト価格では、Sonnet 5.5はSonnet 5と同じ価格表です。入力と出力はどちらもOpus 5.5の半分です。リリースページに印刷されたコーディングと知識作業の行では、Sonnet 5を明らかに上回ります。Terminal-Bench 4.0の70.6%は、その表にあるOpus 5.5の66.4%より上です。CursorBench 4.0の55.5%とGDPval-AA v2.1の1844は、どちらもOpus 5.5のすぐ隣にあり、かつそれより下です。Anthropicは同時に、自社での利用と外部テストでは、複雑で開かれた、継続的な判断が要る作業はなおOpus 5.5の方が強い、と書いています。

2026年9月30日、Modelflareの料金レスポンスにはすでにclaude-sonnet-5-5がありました。単価は公式の入力、出力、キャッシュ読み取り、5分のキャッシュ書き込みと一致します。公開グループはclaude-award、claude-stable、claude-premium、claude-tmp-cheapです。2026年9月29日の本サイト告知が書いていたのは、当時開いていたclaude-awardとclaude-stableです。今回の読み取りの時点で、公開グループには後の二つが加わっていました。

公開されている仕様

項目 Claude Sonnet 5.5
Claude API ID claude-sonnet-5-5
Amazon Bedrock ID anthropic.claude-sonnet-5-5
Google Cloud、Microsoft Foundry、Claude Platform on AWS claude-sonnet-5-5
リリース日 2026年9月28日
退役の確約 2027年9月28日より前にはしない
コンテキスト / 同期の最大出力 1M / 128Kトークン
Batch APIの最大出力 300Kトークン、betaヘッダーoutput-300k-2026-03-24
入力 → 出力 テキストと画像 → テキスト
思考 適応型、デフォルトでオン
Claude APIのデフォルト effort high
ClaudeアプリとClaude Codeのデフォルト effort medium
effortの値 low、medium、high、xhigh、max
信頼できる知識カットオフ 2026年6月
キャッシュできるプロンプトの最短 512トークン
トークナイザ Sonnet 5と同じなので、同じテキストのトークン数は同じ

モデルページは遅延の区分をFastと書いています。これは現行のClaude製品ラインの中での比較であり、毎秒トークン数の測定値ではありません。事前思考を切る最も低い設定はthinking: {"type": "between_tools"}で、受け付けるのはlow、medium、highだけです。xhighとmaxは適応型の思考へ戻します。temperature、top_p、top_kをデフォルト以外にすると400が返ります。

Haiku 5.5は、リリースページでは今後数週間のうちに出すと書かれています。この記事は、まだ出ていないIDに価格を書きません。

公式価格

単位は100万トークン当たりの米ドルです。Sonnet 5.5の列はモデルページです。Opus 5.5の列は、同じリリースページの比較表です。更新ページは、Sonnet 5.5の価格はプロンプトキャッシュとバッチ処理を含めてSonnet 5と同じだと書いています。バッチ割引は入力と出力の50%です。

1Mトークン当たり Sonnet 5.5 リリースページ上の Opus 5.5
入力 $2 $4
出力 $10 $20
キャッシュ読み取り $0.20 $0.20
キャッシュ書き込み 5分 $2.50、1時間 $4 $5
バッチ入力 / 出力 リスト価格の50% この表にはない

リリースページはOpus 5.5のキャッシュ書き込みを$5一つとして印刷し、5分と1時間には分けていません。Sonnet 5.5のモデルページは二つを分けています。Opus 5.5の入力と出力に対して、この価格表は半分です。キャッシュ読み取りはどちらも$0.20です。

Anthropicには、作業負荷についての記述がもう二つあります。同じ仕事は通常より少ないトークンで済み、大半のタスクは最大30%安くなること。出力の生成はSonnet 5より30%以上速いことです。コストの図には、タスク当たりおよそ十分の一、およそ五分の一、およそ十五分の一という比較もあります。これらはすべて、彼らのハーネスの中の結果です。実際の請求は、なおeffort、キャッシュヒット、ツールの往復、バッチを使ったかどうかに依存します。

ベンチマークの読み方

下の表は、リリースページに印刷されたその表です。ダッシュはそのページ自身の空欄です。Terminal-Bench 4.0とCursorBench 4.0のコスト図はGPT-5.6 Solを使っています。OpenAIがその二つについてGPT-6 Solを公開していなかったためです。この記事は、図のGPT-5.6 SolをGPT-6 Solの列へ入れません。Modelflareは再実行していません。

ベンチマーク Sonnet 5.5 Sonnet 5 Opus 5.5 GPT-6 Sol
Terminal-Bench 4.0 70.6% 10.3% 66.4% —
FrontierCode v1.1、Main 46.2%(max);52.1%(xhigh) 42.4% 54.4% 49.3%
CursorBench 4.0 55.5% 34.1% 57.8% —
GDPval-AA v2.1 1844 1449 1846 1487
AA-Briefcase v1.1 1811 1359 1822 1483
Humanity's Last Exam、ツールあり 64.5% 54.9% 67.7% —
OSWorld 2.1、partial 80.1% 57.0% 81.8% —
Chartography、ツールなし 61.6% 15.6% 64.4% 53.6%

脚注はスコアと並べて読んでください。Opus 5.5のTerminal-Bench 4.0はxhighで、リリースページはこれをそのモデルの最高スコアと呼んでいます。FrontierCodeでは、Sonnet 5.5のmaxはxhighより下です。リリースページの説明では、maxはコードレビューをより頻繁に実行し、レビューが複数のサブエージェントに分割されたあと、タイムアウトも、タスクの範囲を超える編集も起きました。この評価は範囲外の変更を減点します。GDPval-AAとAA-Briefcaseは、Artificial Analysisがプレリリースのデプロイ上で実行しました。そのデプロイには、構造化出力を下げ得た不具合があり、リリースページは、この不具合は後に修正され、影響があるとしても方向はSonnet 5.5の過小評価だと述べています。GPT-6 Sol列のGDPval-AA、AA-Briefcase、Chartographyには、もう一つの注記があります。OpenAIは画像理解を損なう不具合を修正しており、これらの外部スコアは当時、まだ更新されていなかった可能性があります。

同じページのコスト図は、別の読み方です。Medium effortはClaudeアプリのデフォルトです。いくつかのベンチマークでは、LowまたはMediumのSonnet 5.5が、タスク当たりおよそ十分の一のコストでSonnet 5の最高成績を上回ります。High effortはClaude Platformのデフォルトです。リリースページは、FrontierCodeのHighでは同じ設定のSonnet 5よりおよそ10点高く、タスク当たりのコストはおよそ十五分の一であり、GPT-6 Solの最高成績に並び、そのコストはおよそ五分の一だと書いています。CursorBenchのLowではSonnet 5の最高成績を上回り、コストは十分の一未満です。AA-BriefcaseのMediumではSonnet 5の最高成績を上回り、コストはおよそ九分の一です。表の55.5%と1844はリリースページが印刷した点であり、コストの文は別のハーネスです。リリースページ上の顧客の引用は選ばれた証言で、何を再生すべきかの手がかりにはなりますが、この表には入りません。

リリースページはさらに、スクリーンショットだけでPokémon Redを通った最初のSonnetだと書いています。これはベンダーの製品上の語りであり、上の表の一行ではありません。

Modelflareの料金とグループ

2026年9月30日の料金レスポンスでは、claude-sonnet-5-5のinput_priceは2、completion_ratioは5なので、出力は$10です。cache_ratioは0.1なので、キャッシュ読み取りは$0.20です。create_cache_ratioは1.25なので、カタログ上のキャッシュ書き込みは$2.50です。この行にはbilling_modeがなく、単独の1時間書き込み価格もありません。公式の1時間$4とバッチの半額は、グループ倍率を掛けた積を、すでに記帳された金額として扱わないでください。記帳は使用量の記録を見ます。

エンドポイント型はanthropicとopenaiです。グループはAPIキーの上に書きます。四つの公開グループが呼ぶのは、同じモデルIDです。

価格表

グループ 倍率 入力 / 1M キャッシュ読み取り / 1M カタログのキャッシュ書き込み / 1M 出力 / 1M その日のカタログ説明
claude-award 0.25 $0.50 $0.05 $0.625 $2.50 価格優先。予算に敏感で、再試行できる開発、テスト、弾力的な作業向け
claude-stable 0.315 $0.63 $0.063 $0.7875 $3.15 安定性を重んじる個人の開発、やや長期のプロジェクト、本番利用
claude-premium 0.5 $1.00 $0.10 $1.25 $5.00 連続性とリクエスト成功を優先し、公式リスト価格の50%で課金
claude-tmp-cheap 0.06 $0.12 $0.012 $0.15 $0.60 期間限定のプロモーション経路

計算は、カタログの単価にグループ倍率を掛けたものです。claude-stableの$0.63は$2 × 0.315、キャッシュ書き込みの$0.7875は$2.50 × 0.315です。カタログの説明はグループ定義の文言であり、測定済みの可用性についての合意ではありません。

同じレスポンスには、未公開のclaude-first-topupもあります。倍率は0.03で、定義は一回のチャージが$50に達すると解放される、と書かれています。公開で選べるグループではないので、上の表にこの行はありません。キーにフォールバックのグループもある場合、リクエストがキャンペーンのグループを離れたあとは、実際に受けたグループで課金されます。

三つの計算例

形は、該当する区分の入力トークン100,000に、出力トークン5,000を足したものです。キャッシュの行は、使用量の記録がそれらのトークンを読み取りまたは書き込みとして実際に数えることを仮定しています。金額が小さいとき、クォータの丸めが記帳の数字を動かすこともあります。

リクエスト リスト価格 claude-award claude-stable claude-premium claude-tmp-cheap
100,000の未キャッシュ入力、5,000の出力 $0.2500 $0.0625 $0.07875 $0.1250 $0.0150
100,000のキャッシュ読み取り、5,000の出力 $0.0700 $0.0175 $0.02205 $0.0350 $0.0042
100,000のカタログ上のキャッシュ書き込み、5,000の出力 $0.3000 $0.0750 $0.0945 $0.1500 $0.0180

一行目のリスト価格は0.1 × $2 + 0.005 × $10です。グループの列は、この$0.25に倍率を掛けたものです。三行目が使うのはカタログの書き込み価格$2.50で、公式の5分階層に対応し、1時間の$4ではありません。ライブのページはclaude-sonnet-5-5の料金ページです。総表はモデルと料金です。

一度失敗したときのコストが高い場合、カタログはclaude-premiumを連続性優先と書いています。日常の本番とやや長期のプロジェクトでは、カタログはclaude-stableをその種のデフォルトと書いています。再試行できる開発とテストにはclaude-awardを使います。claude-tmp-cheapは期間限定のプロモーション経路で、倍率は0.06です。グループは失敗のコストで選び、倍率だけを見ないでください。

Modelflareでの呼び出し方

キーを作るときは、上の表のグループを一つ選びます。モデルIDはclaude-sonnet-5-5を正確に送ってください。正規のベースURLはhttps://modelflare.dev/v1です。同じAPIはhttps://cf.modelflare.dev/v1とhttps://origin.modelflare.dev/v1にもあります。ルートのホスト名が正規のサイトです。

effortを設定する入口はMessages APIです。下のリクエストは思考を適応型のままにし、effortをmediumにします。max_tokensは思考ブロックの余地を残す必要があります。

export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"

curl -sS https://modelflare.dev/v1/messages \
  -H "x-api-key: $MODELFLARE_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 1024,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {
        "role": "user",
        "content": "この移行計画を確認し、テストが最も必要な三つの仮定を挙げてください。"
      }
    ]
  }'

Chat CompletionsもこのIDに載っています。この例はテキストだけを送り、reasoning_effortは付けません。

curl -sS https://modelflare.dev/v1/chat/completions \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "messages": [
      {
        "role": "user",
        "content": "この移行計画を確認し、テストが最も必要な三つの仮定を挙げてください。"
      }
    ]
  }'

effortを指定するなら、上のMessagesリクエストを使ってください。現在のゲートウェイは、Chat Completionsのreasoning_effortを、budget_tokens付きの手動思考に書きます。Sonnet 5.5は手動の予算を拒否します。effortを省くと、Claude APIのデフォルトはhighです。二つの入口の違いはResponses APIとChat Completionsの対比にあります。使用量が請求とどう対応するかはAI APIのコスト追跡にあります。

Sonnet 5からの移行

更新ページは、もともとSonnet 5で動いていたコードが400を返す変更を五つ挙げ、もう一つ、リクエストは成功したままレスポンスの形が変わる変更を挙げています。

400を返すリクエスト

thinking: {"type": "disabled"}
thinking: {"type": "enabled", "budget_tokens": N}
thinking: {"type": "between_tools"} かつ effort が xhigh または max
tool_choice: {"type": "any"}
tool_choice: {"type": "tool", "name": "..."}
temperature、top_p、top_k をデフォルト以外に設定
Claude API と Google Cloud 上のツール型 computer_20251124
advisor ツールが Opus 4.8、Opus 4.7、または Sonnet 5 を advisor にする

事前思考を切るにはbetween_toolsを送り、effortはhigh以下に保ちます。tool_choiceはautoかnoneのままにします。schemaに合うツール引数を得るには、strictをオンにするか、構造化出力へ移し、いつツールを呼ぶかをプロンプトに書きます。コンピュータ操作は、Claude APIとGoogle Cloudではcomputer_toolset_20260801へ移ります。Amazon Bedrockは従来のcomputer_20251124を引き続き受け付けます。advisorツールが受け付けるのはMythos 5.1、Fable 5.1、Mythos 5、Fable 5、Opus 5.5、Opus 5、またはSonnet 5.5自身です。advisorが返す内容は暗号化されており、クライアントは本文を読めません。

2026年8月31日00:00 UTC以降に作られたアカウントには、Claude API、Amazon Bedrock、Google Cloudでもう一箇所の400があります。Sonnet 5.5の思考ブロックを再生するとき、システムプロンプト、ツール一覧、またはより前のメッセージがすでに変わっていると、リクエストは失敗します。会話は追記だけにしてください。指示を変えなければならないときは、会話の途中のシステムメッセージを使います。

成功しても、挙動は変わる

effortを省くと、APIはhighで動きます。同じ語がSonnet 5で買っていた思考量とは一致しません。更新ページは、古い設定を写さず、effortを改めて掃引するよう求めています。範囲の明確なツールループはmediumから始め、より長いものや難しいものはhighへ上げられます。レイテンシに敏感な会話はmediumかlowから始めます。

ツール呼び出しのあいだで、一文か二文を超える進捗のテキストは、思考ブロックの中へ戻ります。デフォルトのdisplayがomittedのとき、それらのブロックのテキストは空なので、ツールのあいだ画面は静かになり、リクエスト自体は成功したままです。その進捗行が要るときはdisplayを設定します。between_toolsを使うと、そのテキストは戻ってきます。

思考ブロックは、それを作ったモデルを記録しています。Sonnet 5.5は、Sonnet 5、Opus 4.8、Haiku 4.5、およびそれより前のモデルの思考ブロックを読めます。Opus 5、Opus 5.5、Fable、Mythosの思考ブロックは読みません。他のモデルもSonnet 5.5の思考ブロックを読みません。対象モデルが読めないブロックは、モデルが見る前に落とされ、落とされたブロックは課金されません。Sonnet 5.5が作った思考ブロックは、それを作ったアカウントにも縛られます。関連のないアカウントから再生すると、ブロックは落とされ、リクエストは成功したままです。

拒否とフォールバック

拒否されたリクエストはHTTP 200で返り、stop_reasonは"refusal"です。更新ページの区分にはcyber、bio、frontier_llm、reasoning_extraction、general_harmsがあります。リリースページは、そのサイバーセキュリティ能力はすでにOpus 5に近く、したがってこの種のサイバー防護を載せて出荷される最初のSonnetだと書いています。より高いリスクのサイバーセキュリティ作業はSonnet 5へ戻ります。生物学の防護はSonnet 5と同じです。通常のソフトウェア開発と、大半の生命科学の作業は、この二つの狭い防護の外にあります。

更新ページにあるClaude API betaのデフォルトフォールバックは、cyberとfrontier_llmをSonnet 5へ回し、bio、reasoning_extraction、general_harmsは再試行しません。それはAnthropicの文書にある挙動です。Modelflareのこの経路が同じフォールバックをするかは、レスポンス上のモデル名で分かります。拒否と転送エラーは分けて扱ってください。課金が起きるかどうかは、拒否の区分によります。リリースページは同時に、Sonnet 5.5ではゼロデータ保持を提供できると書いています。

流量を移す前に確認すること

  1. claude-sonnet-5-5を固定します。完了した結果のモデル名も確認してください。防護のフォールバックでは、答えるモデルがSonnet 5になることがあります。
  2. キーのグループが上の表の四つの公開グループの一つであることを確認し、失敗のコストで選んでください。
  3. 機密を含まない同じ集合を、low、medium、high、xhigh、maxで再生してください。成功率、レイテンシ、入力、キャッシュ読み取り、キャッシュ書き込み、出力、課金を記録します。
  4. effortはMessagesリクエストのoutput_config.effortに置きます。このモデルの思考の段を、Chat Completionsのreasoning_effortで設定しないでください。
  5. まだdisabled、強制されたツール選択、手動の思考予算、computer_20251124を送っているクライアントは、流量を上げる前に直してください。
  6. 思考ブロックを再生する会話は、追記だけに保ちます。
  7. HTTP 200の拒否と、転送の失敗を分けて数えてください。
  8. 短いプロンプト一つと、キャッシュに当たるはずのプロンプト一つで、記帳された金額を確認してください。公式の1時間の書き込み価格とバッチの半額は、使用量の記録に従います。
  9. 複雑で開かれた、継続的な判断が要る作業はclaude-opus-5-5のままにしてください。claude-sonnet-5は引き続き使えます。

出典

確認日は2026年9月30日です。Modelflareはベンチマークを独自には再現していません。