Claude Sonnet 5.5: spesifikasi, harga, dan akses Modelflare

Uraian claude-sonnet-5-5 berdasarkan sumber: spesifikasi yang diterbitkan, harga token resmi, cara membaca tabel benchmark 28 September 2026, serta grup dan harga pengguna Modelflare yang dikembalikan pada 30 September 2026.

Anthropic merilis Claude Sonnet 5.5 pada 28 September 2026. ID model pada API adalah claude-sonnet-5-5. Ini adalah model kedua dalam keluarga Claude 5.5. Anthropic menempatkannya di samping Opus 5.5: tugas sehari-hari yang cakupannya jelas, perbaikan bug, serta dokumen, slide, dan spreadsheet masuk ke sini; pekerjaan yang kompleks, terbuka, dan membutuhkan penilaian yang berkelanjutan tetap di Opus 5.5. Harga daftar sama dengan Sonnet 5, yaitu $2 per satu juta token input, $10 per satu juta token output, dan $0.20 per satu juta token pembacaan cache.

Artikel ini memisahkan tiga lapisan. Spesifikasi dan perubahan yang memutus kompatibilitas berasal dari halaman model, halaman yang baru, dan panduan migrasi. Tabel benchmark disalin dari halaman peluncuran. Modelflare tidak menjalankan ulang evaluasi itu. Grup dan harga pengguna berasal dari GET https://modelflare.dev/api/pricing yang dibaca pada 30 September 2026. Pernyataan vendor seperti "hingga 30% lebih murah" dan "lebih cepat lebih dari 30%" menggambarkan rangkaian uji milik mereka sendiri.

Kesimpulan setelah pemeriksaan

Pada harga daftar yang diterbitkan, Sonnet 5.5 adalah kartu yang sama dengan Sonnet 5. Input dan output adalah setengah dari Opus 5.5. Pada baris pemrograman dan pekerjaan pengetahuan yang dicetak di halaman peluncuran, model ini jauh di depan Sonnet 5. Terminal-Bench 4.0 sebesar 70.6% berada di atas 66.4% yang dicetak di sana untuk Opus 5.5. CursorBench 4.0 sebesar 55.5% dan GDPval-AA v2.1 sebesar 1844 berada di samping Opus 5.5 dan di bawahnya. Anthropic juga menulis bahwa, dalam pemakaian mereka sendiri dan dalam pengujian eksternal, Opus 5.5 tetap lebih kuat pada pekerjaan yang kompleks, terbuka, dan membutuhkan penilaian yang berkelanjutan.

Pada 30 September 2026, respons harga Modelflare sudah memuat claude-sonnet-5-5. Harga satuan cocok dengan tarif resmi input, output, pembacaan cache, dan penulisan cache 5 menit. Grup publik adalah claude-award, claude-stable, claude-premium, dan claude-tmp-cheap. Pemberitahuan situs utama pada 29 September 2026 menyebut grup yang terbuka hari itu, claude-award dan claude-stable. Pada pembacaan ini, daftar publik juga sudah mencakup dua grup yang terakhir.

Spesifikasi yang sudah diterbitkan

Item Claude Sonnet 5.5
Claude API ID claude-sonnet-5-5
Amazon Bedrock ID anthropic.claude-sonnet-5-5
Google Cloud, Microsoft Foundry, Claude Platform on AWS claude-sonnet-5-5
Tanggal rilis 28 September 2026
Komitmen penghentian Tidak lebih awal dari 28 September 2027
Konteks / output maksimum sinkron 1M / 128K tokens
Output maksimum Batch API 300K tokens, header beta output-300k-2026-03-24
Input ke output Teks dan gambar ke teks
Berpikir Adaptif, aktif secara bawaan
Effort bawaan pada Claude API high
Effort bawaan di aplikasi Claude dan Claude Code medium
Nilai effort low, medium, high, xhigh, max
Batas pengetahuan yang andal Juni 2026
Prompt minimum yang dapat masuk cache 512 tokens
Tokenizer Sama dengan Sonnet 5, jadi teks yang sama memiliki jumlah token yang sama

Halaman model menandai latensi sebagai Fast. Itu adalah perbandingan di dalam jajaran Claude saat ini, bukan angka token per detik yang terukur. Setelan terendah yang mematikan berpikir di awal adalah thinking: {"type": "between_tools"}, dan setelan itu hanya diterima pada low, medium, dan high. xhigh dan max kembali ke berpikir adaptif. Mengatur temperature, top_p, atau top_k menjauh dari nilai bawaan mengembalikan 400.

Halaman peluncuran mengatakan Haiku 5.5 akan menyusul dalam beberapa minggu mendatang. Artikel ini tidak memberi harga pada ID yang belum tersedia.

Harga resmi

Jumlahnya adalah dolar AS per satu juta token. Kolom Sonnet 5.5 berasal dari halaman model. Kolom Opus 5.5 berasal dari tabel perbandingan di halaman peluncuran yang sama. Halaman yang baru mengatakan Sonnet 5.5 memiliki harga yang sama dengan Sonnet 5, termasuk cache prompt dan pemrosesan batch. Diskon batch adalah 50% pada input dan output.

Per 1M tokens Sonnet 5.5 Opus 5.5 di halaman peluncuran
Input $2 $4
Output $10 $20
Pembacaan cache $0.20 $0.20
Penulisan cache 5 menit $2.50; 1 jam $4 $5
Input / output batch 50% dari harga daftar Tidak dicetak di tabel itu

Halaman peluncuran mencetak satu angka penulisan cache Opus 5.5, $5, tanpa pemisahan 5 menit dan 1 jam. Halaman model Sonnet 5.5 memisahkan keduanya. Terhadap input dan output Opus 5.5, kartu ini adalah setengahnya. Pembacaan cache pada keduanya adalah $0.20.

Anthropic juga menerbitkan dua pernyataan beban kerja: pekerjaan yang sama biasanya memakai lebih sedikit token, dan sebagian besar tugas berharga hingga 30% lebih murah; pembuatan output lebih cepat lebih dari 30% daripada Sonnet 5. Grafik biaya menambahkan perbandingan per tugas sekitar sepersepuluh, seperlima, dan seperlima belas. Hasil itu milik rangkaian uji mereka. Tagihan yang nyata tetap bergantung pada effort, kena cache, putaran alat, dan apakah panggilan memakai batch.

Cara membaca benchmark

Tabel di bawah adalah tabel yang dicetak di halaman peluncuran. Tanda hubung adalah sel kosong di halaman itu. Grafik biaya Terminal-Bench 4.0 dan CursorBench 4.0 memakai GPT-5.6 Sol karena OpenAI belum menerbitkan GPT-6 Sol pada dua benchmark itu. Artikel ini tidak menyalin titik grafik GPT-5.6 Sol ke kolom GPT-6 Sol. Modelflare tidak menjalankan ulang pengujian.

Benchmark Sonnet 5.5 Sonnet 5 Opus 5.5 GPT-6 Sol
Terminal-Bench 4.0 70.6% 10.3% 66.4% —
FrontierCode v1.1, Main 46.2% (max); 52.1% (xhigh) 42.4% 54.4% 49.3%
CursorBench 4.0 55.5% 34.1% 57.8% —
GDPval-AA v2.1 1844 1449 1846 1487
AA-Briefcase v1.1 1811 1359 1822 1483
Humanity's Last Exam, dengan alat 64.5% 54.9% 67.7% —
OSWorld 2.1, partial 80.1% 57.0% 81.8% —
Chartography, tanpa alat 61.6% 15.6% 64.4% 53.6%

Catatan kaki dibaca di samping skor. Opus 5.5 pada Terminal-Bench 4.0 berada di xhigh, yang oleh halaman peluncuran disebut skor tertinggi model itu. Pada FrontierCode, Sonnet 5.5 di max mencetak skor di bawah xhigh. Halaman peluncuran menjelaskan bahwa max lebih sering menjalankan tinjauan kode yang dipecah ke beberapa subagen, dan hal itu menghasilkan timeout atau suntingan di luar tugas, yang dihukum oleh benchmark. Artificial Analysis menjalankan GDPval-AA dan AA-Briefcase pada penyebaran pra-rilis yang memiliki cacat yang dapat menurunkan output terstruktur. Halaman peluncuran mengatakan cacat itu kemudian diperbaiki dan bahwa efek apa pun akan mengecilkan Sonnet 5.5. Sel GPT-6 Sol untuk GDPval-AA, AA-Briefcase, dan Chartography membawa catatan lain: OpenAI telah memperbaiki cacat yang merugikan pemahaman gambar, dan skor luar itu mungkin belum diperbarui.

Grafik biaya di halaman yang sama adalah pembacaan yang berbeda. Medium effort adalah bawaan di aplikasi Claude. Pada beberapa benchmark, Sonnet 5.5 di Low atau Medium mengalahkan skor terbaik Sonnet 5 dengan biaya sekitar sepersepuluh per tugas. High effort adalah bawaan di Claude Platform. Halaman peluncuran mengatakan bahwa pada FrontierCode di High model ini mencetak sekitar 10 poin di atas Sonnet 5 pada setelan yang sama, dengan biaya sekitar seperlima belas per tugas, dan menyamai skor terbaik GPT-6 Sol dengan biaya sekitar seperlima. Pada CursorBench di Low model ini melampaui skor terbaik Sonnet 5 dengan biaya kurang dari sepersepuluh. Pada AA-Briefcase di Medium model ini mengalahkan skor terbaik Sonnet 5 dengan biaya sekitar sepersembilan. Angka 55.5% dan 1844 yang dicetak adalah titik-titik dalam tabel. Kalimat biaya adalah rangkaian uji yang lain. Kutipan pelanggan terpilih di halaman peluncuran dapat memberi petunjuk tentang apa yang perlu diputar ulang. Kutipan itu bukan bagian dari tabel ini.

Halaman peluncuran juga mengatakan ini adalah Sonnet pertama yang mengalahkan Pokémon Red hanya dari tangkapan layar. Itu narasi produk vendor, bukan baris dalam tabel di atas.

Harga dan grup Modelflare

Dalam respons harga 30 September 2026, claude-sonnet-5-5 memiliki input_price 2 dan completion_ratio 5, jadi output adalah $10. cache_ratio adalah 0.1, jadi pembacaan cache adalah $0.20. create_cache_ratio adalah 1.25, jadi penulisan cache katalog adalah $2.50. Baris itu tidak memiliki billing_mode dan tidak memiliki harga penulisan 1 jam yang terpisah. Jangan mengalikan $4 resmi untuk 1 jam, atau setengah harga batch, dengan rasio grup lalu memperlakukan hasilnya sebagai tagihan yang sudah diposting. Catatan penggunaan adalah tagihannya.

Tipe endpoint adalah anthropic dan openai. Grup dipilih pada kunci API. Empat grup publik memanggil ID model yang sama.

Tabel harga

Grup Rasio Input / 1M Pembacaan cache / 1M Penulisan cache katalog / 1M Output / 1M Deskripsi katalog hari itu
claude-award 0.25 $0.50 $0.05 $0.625 $2.50 Perutean prioritas harga untuk pengembangan, pengujian, dan beban fleksibel yang peka anggaran dan dapat diulang
claude-stable 0.315 $0.63 $0.063 $0.7875 $3.15 Pengembangan pribadi, proyek yang lebih panjang, dan pemakaian produksi yang mengutamakan stabilitas
claude-premium 0.5 $1.00 $0.10 $1.25 $5.00 Mengutamakan kesinambungan dan keberhasilan permintaan, ditagih 50% dari harga daftar resmi
claude-tmp-cheap 0.06 $0.12 $0.012 $0.15 $0.60 Rute promosi waktu terbatas

Perhitungannya adalah harga satuan katalog dikali rasio grup. Pada claude-stable, $0.63 adalah $2 × 0.315, dan penulisan cache $0.7875 adalah $2.50 × 0.315. Deskripsi adalah teks dalam definisi grup. Itu bukan perjanjian ketersediaan yang sudah diukur.

Respons yang sama juga mencantumkan claude-first-topup yang tidak publik pada rasio 0.03, yang dijelaskan terbuka ketika satu isi ulang mencapai $50. Grup itu bukan grup publik yang dapat dipilih, jadi tidak ada barisnya di atas. Jika kunci juga memiliki grup fallback, permintaan yang meninggalkan grup kampanye ditagih pada grup yang melayaninya.

Tiga contoh

Setiap bentuk adalah 100,000 token dari kelas input yang disebut ditambah 5,000 token output. Baris cache mengasumsikan catatan penggunaan benar-benar menggolongkan token itu sebagai pembacaan atau penulisan. Pada jumlah kecil, pembulatan kuota dapat menggeser angka yang diposting.

Permintaan Harga daftar claude-award claude-stable claude-premium claude-tmp-cheap
100,000 input tanpa cache, 5,000 output $0.2500 $0.0625 $0.07875 $0.1250 $0.0150
100,000 pembacaan cache, 5,000 output $0.0700 $0.0175 $0.02205 $0.0350 $0.0042
100,000 penulisan cache katalog, 5,000 output $0.3000 $0.0750 $0.0945 $0.1500 $0.0180

Harga daftar pada baris pertama adalah 0.1 × $2 + 0.005 × $10. Setiap sel grup adalah $0.25 itu dikali rasio. Baris ketiga memakai harga penulisan katalog $2.50, jenjang resmi 5 menit, bukan $4 untuk 1 jam. Halaman yang hidup adalah halaman harga claude-sonnet-5-5. Katalog lengkap adalah Model dan harga.

Ketika satu kegagalan mahal, katalog menggambarkan claude-premium sebagai rute kesinambungan. Untuk produksi sehari-hari dan proyek yang lebih panjang, katalog menggambarkan claude-stable sebagai bawaan semacam itu. Pengembangan dan pengujian yang dapat diulang memakai claude-award. claude-tmp-cheap adalah rute promosi waktu terbatas pada 0.06. Pilih grup menurut biaya kegagalan, dan baca rasio bersama deskripsi itu, jangan hanya melihat rasio.

Memanggilnya di Modelflare

Buat kunci pada salah satu dari empat grup dalam tabel. Kirim ID model claude-sonnet-5-5 persis. URL dasar kanonis adalah https://modelflare.dev/v1. API yang sama juga diterbitkan di https://cf.modelflare.dev/v1 dan https://origin.modelflare.dev/v1. Domain akar adalah situs kanonis.

Messages API adalah pintu masuk yang mengatur effort. Permintaan di bawah membiarkan berpikir tetap adaptif dan mengatur effort ke medium. max_tokens harus menyisakan ruang untuk blok berpikir.

export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"

curl -sS https://modelflare.dev/v1/messages \
  -H "x-api-key: $MODELFLARE_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 1024,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {
        "role": "user",
        "content": "Tinjau rencana migrasi ini dan sebutkan tiga asumsi yang paling perlu diuji."
      }
    ]
  }'

Chat Completions juga tercantum pada ID ini. Contoh ini hanya mengirim teks dan tidak mengatur reasoning_effort.

curl -sS https://modelflare.dev/v1/chat/completions \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "messages": [
      {
        "role": "user",
        "content": "Tinjau rencana migrasi ini dan sebutkan tiga asumsi yang paling perlu diuji."
      }
    ]
  }'

Untuk memilih effort, gunakan permintaan Messages di atas. Gerbang saat ini mengubah reasoning_effort pada Chat Completions menjadi anggaran berpikir manual dengan budget_tokens, dan Sonnet 5.5 menolak anggaran manual. Jika effort dihilangkan, bawaan Claude API adalah high. Perbedaan dua pintu masuk dibahas di Responses API dibandingkan Chat Completions. Cara penggunaan bertemu dengan tagihan dibahas di Pelacakan biaya AI API.

Pindah dari Sonnet 5

Halaman yang baru mencantumkan lima perubahan yang membuat kode yang sudah berjalan di Sonnet 5 mengembalikan 400, ditambah satu perubahan yang membiarkan permintaan berhasil dan mengubah bentuk respons.

Permintaan yang mengembalikan 400

thinking: {"type": "disabled"}
thinking: {"type": "enabled", "budget_tokens": N}
thinking: {"type": "between_tools"} pada effort xhigh atau max
tool_choice: {"type": "any"}
tool_choice: {"type": "tool", "name": "..."}
temperature, top_p, atau top_k diatur di luar nilai bawaan
tipe alat computer_20251124 pada Claude API dan Google Cloud
alat advisor memakai Opus 4.8, Opus 4.7, atau Sonnet 5 sebagai advisor

Untuk mematikan berpikir di awal, kirim between_tools dan pertahankan effort pada high atau lebih rendah. Pertahankan tool_choice pada auto atau none. Agar input alat sah terhadap skema, nyalakan strict, atau pindahkan skema ke output terstruktur, dan sebutkan di prompt kapan alat dipakai. Pada Claude API dan Google Cloud, penggunaan komputer pindah ke computer_toolset_20260801. Amazon Bedrock masih menerima computer_20251124. Alat advisor menerima Mythos 5.1, Fable 5.1, Mythos 5, Fable 5, Opus 5.5, Opus 5, atau Sonnet 5.5 sendiri. Konten advisor kembali terenkripsi, dan klien tidak dapat membaca teksnya.

Akun yang dibuat pada atau setelah 31 Agustus 2026, 00:00 UTC, memiliki satu 400 lagi pada Claude API, Amazon Bedrock, dan Google Cloud: memutar ulang blok berpikir Sonnet 5.5 setelah perubahan pada prompt sistem, daftar alat, atau pesan yang lebih awal akan gagal. Jaga percakapan hanya dengan penambahan. Jika instruksi harus berubah, gunakan pesan sistem di tengah percakapan.

Perilaku yang berubah pada respons yang berhasil

Jika effort dihilangkan, API berjalan pada high. Kata yang sama tidak membeli jumlah berpikir yang sama seperti di Sonnet 5. Halaman yang baru mengatakan untuk menyapu effort lagi, bukan menyalin setelan lama. Putaran alat yang cakupannya jelas dapat dimulai pada medium, dan yang lebih panjang atau lebih sulit dapat naik ke high. Obrolan yang peka latensi dapat dimulai pada medium atau low.

Teks kemajuan yang lebih panjang dari satu atau dua kalimat di antara panggilan alat kembali di dalam blok berpikir. Pada display bawaan omitted, teks blok itu kosong, jadi antarmuka menjadi sunyi di antara alat sementara permintaan tetap berhasil. Atur display jika produk membutuhkan baris itu. Dengan between_tools, teks itu kembali.

Blok berpikir mencatat model yang menghasilkannya. Sonnet 5.5 membaca blok berpikir dari Sonnet 5, Opus 4.8, Haiku 4.5, dan model yang lebih lama. Model ini tidak membaca blok dari Opus 5, Opus 5.5, Fable, atau Mythos. Tidak ada model lain yang membaca blok berpikir Sonnet 5.5. Blok yang tidak dapat dibaca model sasaran dibuang sebelum model melihatnya, dan blok yang dibuang tidak ditagih. Blok yang dihasilkan Sonnet 5.5 juga tetap pada akun yang menghasilkannya. Memutar ulangnya dari akun yang tidak tertaut membuang blok itu, dan permintaan tetap berhasil.

Penolakan dan fallback

Permintaan yang ditolak mengembalikan HTTP 200 dengan stop_reason diatur ke "refusal". Kategori yang disebut di halaman yang baru adalah cyber, bio, frontier_llm, reasoning_extraction, dan general_harms. Halaman peluncuran mengatakan kemampuan keamanan sibernya dekat dengan Opus 5, jadi ini adalah Sonnet pertama yang dikirimkan dengan kelas pengaman siber itu. Tugas keamanan siber berisiko lebih tinggi jatuh kembali ke Sonnet 5. Pengaman biologi sama dengan Sonnet 5. Pengembangan perangkat lunak rutin dan sebagian besar pekerjaan ilmu hayati berada di luar dua pengaman sempit itu.

Halaman yang baru mengatakan fallback bawaan beta Claude API mencoba lagi cyber dan frontier_llm pada Sonnet 5, dan tidak mencoba lagi bio, reasoning_extraction, atau general_harms. Itu perilaku yang didokumentasikan Anthropic. Apakah rute Modelflare ini melakukan fallback yang sama dijawab oleh nama model pada respons. Hitung penolakan terpisah dari kegagalan transport. Apakah suatu penolakan ditagih bergantung pada kategorinya. Halaman peluncuran juga mengatakan Sonnet 5.5 tersedia dengan retensi data nol.

Pemeriksaan sebelum mengalihkan lalu lintas

  1. Sematkan claude-sonnet-5-5. Periksa juga nama model pada hasil yang selesai. Fallback pengaman dapat menjawab sebagai Sonnet 5.
  2. Pastikan grup kunci adalah salah satu dari empat grup publik dalam tabel, dan pilih menurut biaya kegagalan.
  3. Putar ulang satu set yang tidak sensitif pada low, medium, high, xhigh, dan max. Catat keberhasilan, latensi, input, pembacaan cache, penulisan cache, output, dan tagihan.
  4. Letakkan effort di output_config.effort pada permintaan Messages. Jangan memakai reasoning_effort Chat Completions untuk mengatur tingkat berpikir model ini.
  5. Ubah klien yang masih mengirim disabled, pilihan alat paksa, anggaran berpikir manual, atau computer_20251124 sebelum menaikkan volume.
  6. Jaga percakapan yang memutar ulang blok berpikir agar hanya menambahkan.
  7. Hitung penolakan HTTP 200 terpisah dari kegagalan transport.
  8. Hargai satu prompt pendek dan satu prompt yang seharusnya mengenai cache, lalu baca jumlah yang diposting. Harga penulisan 1 jam resmi dan setengah harga batch mengikuti catatan penggunaan.
  9. Pekerjaan yang kompleks, terbuka, dan membutuhkan penilaian berkelanjutan tetap di claude-opus-5-5. claude-sonnet-5 tetap tersedia.

Sumber

Diperiksa pada 30 September 2026. Modelflare tidak mereproduksi benchmark secara independen.