Claude Sonnet 5.5: 사양, 가격, Modelflare 접속
출처에 근거한 claude-sonnet-5-5 기록입니다. 공개된 사양, 공식 토큰 가격, 2026년 9월 28일 벤치마크 표를 읽는 법, 그리고 2026년 9월 30일에 반환된 Modelflare 그룹과 사용자 가격을 담습니다.
Anthropic은 2026년 9월 28일 Claude Sonnet 5.5를 출시했습니다. API 모델 ID는 claude-sonnet-5-5입니다. Claude 5.5 계열의 두 번째 모델입니다. Anthropic은 이것을 Opus 5.5 옆에 둡니다. 범위가 분명한 일상 작업, 버그 수정, 문서·슬라이드·스프레드시트는 이쪽을 쓰고, 복잡하고 열려 있으며 지속적인 판단이 필요한 작업은 Opus 5.5에 남깁니다. 리스트 가격은 Sonnet 5와 같으며, 입력 백만 토큰당 $2, 출력 백만 토큰당 $10, 캐시 읽기 백만 토큰당 $0.20입니다.
이 글은 세 층을 나누어 둡니다. 사양과 호환을 깨는 변경은 모델 페이지, 업데이트 설명, 마이그레이션 가이드에서 옵니다. 벤치마크 표는 출시 페이지에서 옮긴 것입니다. Modelflare는 그 평가를 다시 실행하지 않았습니다. 그룹과 사용자 가격은 2026년 9월 30일에 읽은 GET https://modelflare.dev/api/pricing에서 옵니다. “최대 30% 더 싸다”, “30% 이상 더 빠르다” 같은 공급자 문구는 Anthropic 자신의 테스트 장치를 설명합니다.
확인한 뒤의 결론
공개된 리스트 가격에서 Sonnet 5.5는 Sonnet 5와 같은 가격표입니다. 입력과 출력은 Opus 5.5의 절반입니다. 출시 페이지에 인쇄된 코딩과 지식 작업 행에서는 Sonnet 5보다 분명히 앞섭니다. Terminal-Bench 4.0의 70.6%는 그 표에 적힌 Opus 5.5의 66.4%보다 높습니다. CursorBench 4.0의 55.5%와 GDPval-AA v2.1의 1844는 Opus 5.5 바로 옆에 있으면서 그보다 낮습니다. Anthropic은 자신들의 사용과 외부 테스트에서, 복잡하고 열려 있으며 지속적인 판단이 필요한 작업은 여전히 Opus 5.5가 더 강하다고도 적습니다.
2026년 9월 30일 Modelflare 가격 응답에는 이미 claude-sonnet-5-5가 들어 있었습니다. 단위 가격은 공식 입력, 출력, 캐시 읽기, 5분 캐시 쓰기와 같습니다. 공개 그룹은 claude-award, claude-stable, claude-premium, claude-tmp-cheap입니다. 2026년 9월 29일 메인 사이트 공지는 그날 열려 있던 그룹인 claude-award와 claude-stable을 적었습니다. 이번 읽기에서는 공개 목록에 뒤의 두 그룹도 들어 있었습니다.
이미 공개된 사양
| 항목 | Claude Sonnet 5.5 |
|---|---|
| Claude API ID | claude-sonnet-5-5 |
| Amazon Bedrock ID | anthropic.claude-sonnet-5-5 |
| Google Cloud, Microsoft Foundry, Claude Platform on AWS | claude-sonnet-5-5 |
| 출시일 | 2026년 9월 28일 |
| 종료 약속 | 2027년 9월 28일보다 이르지 않음 |
| 컨텍스트 / 동기 최대 출력 | 1M / 128K tokens |
| Batch API 최대 출력 | 300K tokens, beta 헤더 output-300k-2026-03-24 |
| 입력 → 출력 | 텍스트와 이미지 → 텍스트 |
| 사고 | 적응형, 기본으로 켜짐 |
| Claude API의 기본 effort | high |
| Claude 앱과 Claude Code의 기본 effort | medium |
| effort 값 | low, medium, high, xhigh, max |
| 신뢰 가능한 지식 기준 | 2026년 6월 |
| 캐시 가능한 프롬프트의 최소 길이 | 512 tokens |
| 토크나이저 | Sonnet 5와 같으므로, 같은 텍스트의 토큰 수도 같습니다 |
모델 페이지는 지연을 Fast로 적습니다. 이것은 현재 Claude 제품군 안의 비교이지, 측정된 초당 토큰 수가 아닙니다. 앞선 사고를 끄는 가장 낮은 설정은 thinking: {"type": "between_tools"}이며, low, medium, high에서만 받습니다. xhigh와 max는 적응형 사고로 돌아갑니다. temperature, top_p, top_k를 기본값에서 벗어나 두면 400을 반환합니다.
출시 페이지는 Haiku 5.5가 이후 몇 주 안에 이어진다고 적습니다. 이 글은 아직 없는 ID에 가격을 붙이지 않습니다.
공식 가격
금액은 백만 토큰당 미국 달러입니다. Sonnet 5.5 열은 모델 페이지입니다. Opus 5.5 열은 같은 출시 페이지의 비교표입니다. 업데이트 설명은 Sonnet 5.5의 가격이 Sonnet 5와 같고, 프롬프트 캐시와 배치 처리도 포함한다고 적습니다. 배치 할인은 입력과 출력의 50%입니다.
| 1M tokens당 | Sonnet 5.5 | 출시 페이지의 Opus 5.5 |
|---|---|---|
| 입력 | $2 | $4 |
| 출력 | $10 | $20 |
| 캐시 읽기 | $0.20 | $0.20 |
| 캐시 쓰기 | 5분 $2.50; 1시간 $4 | $5 |
| 배치 입력 / 출력 | 리스트 가격의 50% | 그 표에는 없습니다 |
출시 페이지는 Opus 5.5의 캐시 쓰기를 $5 하나로 인쇄하고, 5분과 1시간을 나누지 않습니다. Sonnet 5.5 모델 페이지는 두 칸을 나눕니다. Opus 5.5의 입력과 출력에 비해 이 가격표는 절반입니다. 캐시 읽기는 둘 다 $0.20입니다.
Anthropic은 워크로드에 대한 말 두 가지도 냅니다. 같은 작업은 보통 토큰을 덜 쓰고, 대부분 작업은 최대 30% 더 쌉니다. 출력 생성은 Sonnet 5보다 30% 이상 빠릅니다. 비용 그림은 작업당 비교를 대략 10분의 1, 5분의 1, 15분의 1로 더합니다. 그 결과는 그들 테스트 장치의 것입니다. 실제 청구는 여전히 effort, 캐시 적중, 도구 라운드, 그리고 호출이 배치를 썼는지에 달립니다.
벤치마크를 읽는 법
아래 표는 출시 페이지에 인쇄된 바로 그 표입니다. 대시는 그 페이지의 빈 칸입니다. Terminal-Bench 4.0과 CursorBench 4.0의 비용 그림은 GPT-5.6 Sol을 씁니다. OpenAI가 그 두 항목에 GPT-6 Sol을 공개하지 않았기 때문입니다. 이 글은 그림의 GPT-5.6 Sol 점을 GPT-6 Sol 열에 복사하지 않습니다. Modelflare는 테스트를 다시 실행하지 않았습니다.
| 벤치마크 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% | — |
| FrontierCode v1.1, Main | 46.2% (max); 52.1% (xhigh) | 42.4% | 54.4% | 49.3% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | — |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam, 도구 있음 | 64.5% | 54.9% | 67.7% | — |
| OSWorld 2.1, partial | 80.1% | 57.0% | 81.8% | — |
| Chartography, 도구 없음 | 61.6% | 15.6% | 64.4% | 53.6% |
각주는 점수 옆에 두어야 합니다. Opus 5.5의 Terminal-Bench 4.0은 xhigh이며, 출시 페이지는 이것을 그 모델의 최고 점수라고 부릅니다. FrontierCode에서 Sonnet 5.5의 max는 xhigh보다 낮습니다. 출시 페이지의 설명은, max가 코드 리뷰를 더 자주 돌리고 그 리뷰가 여러 하위 에이전트로 나뉜 뒤 시간 초과나 작업 범위를 넘는 수정이 나왔으며, 이 벤치마크는 범위 밖 변경에 불이익을 준다는 것입니다. Artificial Analysis는 구조화 출력을 떨어뜨릴 수 있는 결함이 있던 사전 공개 배포에서 GDPval-AA와 AA-Briefcase를 돌렸습니다. 출시 페이지는 그 결함이 나중에 고쳐졌고, 영향이 있다면 Sonnet 5.5를 낮게 보게 된다고 말합니다. GPT-6 Sol 열의 GDPval-AA, AA-Briefcase, Chartography에는 설명이 하나 더 있습니다. OpenAI가 이미지 이해를 해치던 결함을 고쳤고, 그 외부 점수는 아직 갱신되지 않았을 수 있습니다.
같은 페이지의 비용 그림은 다른 읽기입니다. Medium effort는 Claude 앱의 기본값입니다. 여러 벤치마크에서 Low 또는 Medium의 Sonnet 5.5는 작업당 비용 약 10분의 1로 Sonnet 5의 최고 점수를 이깁니다. High effort는 Claude Platform의 기본값입니다. 출시 페이지는 FrontierCode의 High에서 같은 설정의 Sonnet 5보다 약 10점 높고, 작업당 비용은 약 15분의 1이며, GPT-6 Sol의 최고 점수와 맞먹고 비용은 약 5분의 1이라고 적습니다. CursorBench의 Low에서는 Sonnet 5의 최고 점수를 넘고, 비용은 10분의 1보다 적습니다. AA-Briefcase의 Medium에서는 Sonnet 5의 최고 점수를 이기고, 비용은 약 9분의 1입니다. 인쇄된 55.5%와 1844는 표 안의 점입니다. 비용 문장은 다른 테스트 장치입니다. 출시 페이지에서 고른 고객 인용은 무엇을 다시 재생할지 힌트가 될 수 있습니다. 그 인용은 이 표의 일부가 아닙니다.
출시 페이지는 이것이 스크린샷만으로 Pokémon Red를 이긴 첫 Sonnet이라고도 적습니다. 그것은 공급자의 제품 서술이지, 위 표의 한 행이 아닙니다.
Modelflare의 가격과 그룹
2026년 9월 30일 가격 응답에서 claude-sonnet-5-5의 input_price는 2, completion_ratio는 5이므로 출력은 $10입니다. cache_ratio는 0.1이므로 캐시 읽기는 $0.20입니다. create_cache_ratio는 1.25이므로 카탈로그 캐시 쓰기는 $2.50입니다. 이 행에는 billing_mode가 없고, 별도의 1시간 쓰기 가격도 없습니다. 공식 1시간 $4나 배치 반값을 그룹 배율에 곱한 뒤, 그 곱을 이미 청구된 금액으로 다루지 마세요. 청구는 사용 기록입니다.
엔드포인트 유형은 anthropic과 openai입니다. 그룹은 API 키에서 고릅니다. 공개 그룹 네 개는 같은 모델 ID를 호출합니다.
가격표
| 그룹 | 배율 | 입력 / 1M | 캐시 읽기 / 1M | 카탈로그 캐시 쓰기 / 1M | 출력 / 1M | 그날의 카탈로그 설명 |
|---|---|---|---|---|---|---|
claude-award |
0.25 | $0.50 | $0.05 | $0.625 | $2.50 | 예산에 민감하고 재시도할 수 있는 개발, 테스트, 탄력적 워크로드를 위한 가격 우선 라우팅 |
claude-stable |
0.315 | $0.63 | $0.063 | $0.7875 | $3.15 | 안정성이 중요한 일상 개발, 비교적 긴 프로젝트, 프로덕션 사용 |
claude-premium |
0.5 | $1.00 | $0.10 | $1.25 | $5.00 | 연속성과 요청 성공을 우선하며, 공식 리스트 가격의 50%로 청구 |
claude-tmp-cheap |
0.06 | $0.12 | $0.012 | $0.15 | $0.60 | 기간 한정 프로모션 경로 |
계산은 카탈로그 단위 가격에 그룹 배율을 곱하는 것입니다. claude-stable에서 $0.63은 $2 × 0.315이고, 캐시 쓰기 $0.7875는 $2.50 × 0.315입니다. 설명은 그룹 정의 안의 문장입니다. 측정된 가용성 약속이 아닙니다.
같은 응답은 비공개인 claude-first-topup도 배율 0.03으로 올리며, 한 번의 충전이 $50에 도달하면 잠금 해제된다고 적습니다. 공개적으로 고를 수 있는 그룹이 아니므로 위 표에 행이 없습니다. 키에 폴백 그룹도 있으면, 요청이 캠페인 그룹을 떠난 뒤에는 그 요청을 받은 그룹으로 청구됩니다.
세 가지 예
각 형태는 이름 붙인 입력 종류 100,000토큰에 출력 5,000토큰을 더한 것입니다. 캐시 행은 사용 기록이 그 토큰을 실제로 읽기나 쓰기로 분류한다고 가정합니다. 금액이 작으면 할당량 반올림이 게시된 숫자를 움직일 수 있습니다.
| 요청 | 리스트 가격 | claude-award |
claude-stable |
claude-premium |
claude-tmp-cheap |
|---|---|---|---|---|---|
| 캐시되지 않은 입력 100,000, 출력 5,000 | $0.2500 | $0.0625 | $0.07875 | $0.1250 | $0.0150 |
| 캐시 읽기 100,000, 출력 5,000 | $0.0700 | $0.0175 | $0.02205 | $0.0350 | $0.0042 |
| 카탈로그 캐시 쓰기 100,000, 출력 5,000 | $0.3000 | $0.0750 | $0.0945 | $0.1500 | $0.0180 |
첫 행의 리스트 가격은 0.1 × $2 + 0.005 × $10입니다. 각 그룹 칸은 그 $0.25에 배율을 곱한 것입니다. 셋째 행은 카탈로그 쓰기 가격 $2.50, 곧 공식 5분 칸을 쓰며, 1시간 $4가 아닙니다. 실시간 페이지는 claude-sonnet-5-5 가격 페이지입니다. 전체 카탈로그는 모델과 가격입니다.
실패 한 번의 비용이 클 때, 카탈로그는 claude-premium을 연속성 경로로 적습니다. 일상 프로덕션과 비교적 긴 프로젝트에서 카탈로그는 claude-stable을 그런 종류의 기본으로 적습니다. 재시도할 수 있는 개발과 테스트는 claude-award를 씁니다. claude-tmp-cheap는 배율 0.06의 기간 한정 프로모션 경로입니다. 그룹은 실패 비용으로 고르고, 배율만 보지 말고 그 설명과 함께 읽으세요.
Modelflare에서 호출하는 방법
표에 있는 네 그룹 중 하나로 키를 만듭니다. 모델 ID claude-sonnet-5-5를 정확히 보냅니다. 기준 베이스 URL은 https://modelflare.dev/v1입니다. 같은 API는 https://cf.modelflare.dev/v1과 https://origin.modelflare.dev/v1에도 올라 있습니다. 루트 도메인이 기준 사이트입니다.
Messages API가 effort를 설정하는 입구입니다. 아래 요청은 사고를 적응형으로 두고 effort를 medium으로 설정합니다. max_tokens는 사고 블록이 들어갈 자리를 남겨야 합니다.
export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"
curl -sS https://modelflare.dev/v1/messages \
-H "x-api-key: $MODELFLARE_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{
"role": "user",
"content": "이 마이그레이션 계획을 검토하고, 테스트를 가장 보강해야 할 가정 세 가지를 나열하세요."
}
]
}'
Chat Completions도 이 ID에 올라 있습니다. 이 예는 텍스트만 보내고 reasoning_effort는 설정하지 않습니다.
curl -sS https://modelflare.dev/v1/chat/completions \
-H "Authorization: Bearer $MODELFLARE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"messages": [
{
"role": "user",
"content": "이 마이그레이션 계획을 검토하고, 테스트를 가장 보강해야 할 가정 세 가지를 나열하세요."
}
]
}'
effort를 고르려면 위의 Messages 요청을 씁니다. 현재 게이트웨이는 Chat Completions의 reasoning_effort를 budget_tokens가 있는 수동 사고 예산으로 바꾸며, Sonnet 5.5는 수동 예산을 거부합니다. effort를 빼면 Claude API의 기본값은 high입니다. 두 입구의 차이는 Responses API와 Chat Completions 비교에 있습니다. 사용량이 청구와 어떻게 맞는지는 AI API 비용 추적에 있습니다.
Sonnet 5에서 옮기기
업데이트 설명은 Sonnet 5에서 이미 돌던 코드가 400을 반환하게 하는 변경 다섯 가지와, 요청은 성공한 채 응답 모양이 바뀌는 변경 한 가지를 적습니다.
400을 반환하는 요청
thinking: {"type": "disabled"}
thinking: {"type": "enabled", "budget_tokens": N}
thinking: {"type": "between_tools"} 이면서 effort가 xhigh 또는 max
tool_choice: {"type": "any"}
tool_choice: {"type": "tool", "name": "..."}
temperature, top_p, top_k를 기본값에서 벗어나게 설정
Claude API와 Google Cloud의 도구 유형 computer_20251124
자문 도구가 Opus 4.8, Opus 4.7 또는 Sonnet 5를 자문으로 사용
앞선 사고를 끄려면 between_tools를 보내고 effort는 high 이하로 둡니다. tool_choice는 auto 또는 none으로 둡니다. schema에 맞는 도구 입력을 받으려면 strict를 켜거나 schema를 구조화 출력으로 옮기고, 프롬프트에 도구가 언제 적용되는지 적습니다. Claude API와 Google Cloud에서 컴퓨터 사용은 computer_toolset_20260801로 옮깁니다. Amazon Bedrock은 computer_20251124를 여전히 받습니다. 자문 도구는 Mythos 5.1, Fable 5.1, Mythos 5, Fable 5, Opus 5.5, Opus 5, 또는 Sonnet 5.5 자신을 받습니다. 자문 내용은 암호화되어 돌아오며, 클라이언트는 그 텍스트를 읽을 수 없습니다.
2026년 8월 31일 00:00 UTC 및 그 이후에 만든 계정은 Claude API, Amazon Bedrock, Google Cloud에서 400이 하나 더 있습니다. 시스템 프롬프트, 도구 목록, 또는 더 이른 메시지를 바꾼 뒤 Sonnet 5.5 사고 블록을 다시 재생하면 요청이 실패합니다. 대화는 덧붙이기만 유지합니다. 지시를 바꿔야 하면 대화 중간의 시스템 메시지를 씁니다.
성공한 응답에서도 바뀌는 동작
effort를 빼면 API는 high에서 돕니다. 같은 단어가 Sonnet 5에서 사던 만큼의 사고를 사지 않습니다. 업데이트 설명은 옛 설정을 복사하지 말고 effort를 다시 훑으라고 합니다. 범위가 분명한 도구 루프는 medium에서 시작할 수 있고, 더 길거나 더 어려운 루프는 high로 옮길 수 있습니다. 지연에 민감한 대화는 medium 또는 low에서 시작할 수 있습니다.
도구 호출 사이에 한두 문장을 넘는 진행 문장은 사고 블록 안으로 돌아옵니다. 기본 display가 omitted이면 그 블록의 텍스트는 비어서, 요청은 성공한 채 화면이 도구 사이에서 조용해집니다. 제품에 그 줄이 필요하면 display를 설정합니다. between_tools를 쓰면 그 문장이 돌아옵니다.
사고 블록은 그것을 만든 모델을 기록합니다. Sonnet 5.5는 Sonnet 5, Opus 4.8, Haiku 4.5, 그리고 더 이른 모델의 사고 블록을 읽습니다. Opus 5, Opus 5.5, Fable, Mythos의 블록은 읽지 않습니다. 다른 어떤 모델도 Sonnet 5.5의 사고 블록을 읽지 않습니다. 대상 모델이 읽을 수 없는 블록은 모델이 보기 전에 버려지고, 버려진 블록은 청구되지 않습니다. Sonnet 5.5가 만든 블록은 그것을 만든 계정에도 남습니다. 연결되지 않은 계정에서 다시 재생하면 블록은 버려지고, 요청은 여전히 성공합니다.
거부와 폴백
거부된 요청은 stop_reason이 "refusal"인 HTTP 200을 반환합니다. 업데이트 설명이 적은 범주는 cyber, bio, frontier_llm, reasoning_extraction, general_harms입니다. 출시 페이지는 사이버 보안 능력이 Opus 5에 가까워, 그 등급의 사이버 보호를 실은 첫 Sonnet이라고 적습니다. 더 위험한 사이버 보안 작업은 Sonnet 5로 폴백합니다. 생물 보호는 Sonnet 5와 같습니다. 일상적인 소프트웨어 개발과 대부분의 생명과학 작업은 그 두 좁은 보호 밖에 있습니다.
업데이트 설명은 Claude API beta의 기본 폴백이 cyber와 frontier_llm을 Sonnet 5에서 다시 시도하고, bio, reasoning_extraction, general_harms는 다시 시도하지 않는다고 적습니다. 그것은 Anthropic 문서에 적힌 동작입니다. Modelflare의 이 경로가 같은 폴백을 하는지는 응답의 모델 이름이 답합니다. 거부는 전송 실패와 따로 셉니다. 거부가 청구되는지는 그 범주에 달립니다. 출시 페이지는 Sonnet 5.5를 데이터 무보존으로도 쓸 수 있다고 함께 적습니다.
트래픽을 옮기기 전에 확인할 일
claude-sonnet-5-5를 고정합니다. 완료 결과의 모델 이름도 확인합니다. 보호 폴백은 Sonnet 5로 답할 수 있습니다.- 키 그룹이 표의 공개 그룹 네 개 중 하나인지 확인하고, 실패 비용으로 고릅니다.
- 민감 정보가 없는 집합 하나를
low,medium,high,xhigh,max에서 다시 재생합니다. 성공, 지연, 입력, 캐시 읽기, 캐시 쓰기, 출력, 청구를 기록합니다. - effort는 Messages 요청의
output_config.effort에 둡니다. 이 모델의 사고 단계를 설정하려고 Chat Completions의reasoning_effort를 쓰지 마세요. disabled, 강제 도구 선택, 수동 사고 예산, 또는computer_20251124를 아직 보내는 클라이언트는 양을 올리기 전에 바꿉니다.- 사고 블록을 다시 재생하는 대화는 덧붙이기만 유지합니다.
- HTTP 200 거부와 전송 실패를 따로 셉니다.
- 짧은 프롬프트 하나와 캐시에 맞아야 하는 프롬프트 하나의 가격을 매긴 뒤, 게시된 금액을 읽습니다. 공식 1시간 쓰기 가격과 배치 반값은 사용 기록을 따릅니다.
- 복잡하고 열려 있으며 지속적인 판단이 필요한 작업은
claude-opus-5-5에 둡니다.claude-sonnet-5는 계속 쓸 수 있습니다.
출처
확인일: 2026년 9월 30일. Modelflare는 벤치마크를 독립적으로 재현하지 않았습니다.
- 출시 페이지, 2026년 9월 28일: https://www.anthropic.com/claude-sonnet-5-5
- 모델 페이지: https://platform.claude.com/docs/en/models/sonnet-5-5/overview
- 업데이트 설명: https://platform.claude.com/docs/en/models/sonnet-5-5/whats-new-sonnet-5-5
- 마이그레이션 가이드: https://platform.claude.com/docs/en/models/sonnet-5-5/migration-guide
- Modelflare 가격 API: https://modelflare.dev/api/pricing
- 가격 페이지: https://modelflare.dev/pricing/claude-sonnet-5-5