Claude Sonnet 5.5: спецификация, цена и доступ в Modelflare

Разбор claude-sonnet-5-5 по источникам: опубликованные спецификации, официальные цены токенов, как читать таблицу бенчмарков от 28 сентября 2026 года, а также группы и пользовательские цены Modelflare, возвращённые 30 сентября 2026 года.

Anthropic выпустил Claude Sonnet 5.5 28 сентября 2026 года. ID модели в API — claude-sonnet-5-5. Это вторая модель семейства Claude 5.5. Anthropic ставит её рядом с Opus 5.5: повседневные задачи с ясным объёмом, исправление ошибок, а также документы, слайды и таблицы идут сюда; сложная открытая работа, которой нужно устойчивое суждение, остаётся на Opus 5.5. Прайс-лист совпадает с Sonnet 5: $2 за миллион входных токенов, $10 за миллион выходных токенов и $0.20 за миллион токенов чтения кэша.

Эта статья держит три слоя отдельно. Спецификация и ломающие изменения взяты со страницы модели, страницы обновлений и руководства по миграции. Таблица бенчмарков скопирована со страницы запуска. Modelflare эти оценки не перезапускал. Группы и пользовательские цены взяты из GET https://modelflare.dev/api/pricing, прочитанного 30 сентября 2026 года. Формулировки вендора вроде «до 30% дешевле» и «быстрее более чем на 30%» описывают их собственный тестовый стенд.

Вывод после сверки

По опубликованному прайс-листу Sonnet 5.5 — та же карточка, что и Sonnet 5. Ввод и вывод составляют половину Opus 5.5. На строках программирования и работы со знаниями, напечатанных на странице запуска, он заметно впереди Sonnet 5. Terminal-Bench 4.0 со значением 70.6% выше напечатанных там 66.4% у Opus 5.5. CursorBench 4.0 со значением 55.5% и GDPval-AA v2.1 со значением 1844 стоят рядом с Opus 5.5 и ниже него. Anthropic также пишет, что в их собственном использовании и во внешнем тестировании Opus 5.5 остаётся сильнее на сложной открытой работе, которой нужно устойчивое суждение.

30 сентября 2026 года ответ с ценами Modelflare уже содержал claude-sonnet-5-5. Единичные цены совпадают с официальными ставками ввода, вывода, чтения кэша и 5-минутной записи в кэш. Публичные группы — claude-award, claude-stable, claude-premium и claude-tmp-cheap. Объявление главного сайта от 29 сентября 2026 года называло группы, открытые в тот день, claude-award и claude-stable. К этому чтению публичный список включал и две последние.

Опубликованная спецификация

Пункт Claude Sonnet 5.5
Claude API ID claude-sonnet-5-5
Amazon Bedrock ID anthropic.claude-sonnet-5-5
Google Cloud, Microsoft Foundry, Claude Platform on AWS claude-sonnet-5-5
Дата выпуска 28 сентября 2026
Обязательство по выводу Не раньше 28 сентября 2027
Контекст / макс. синхронный вывод 1M / 128K tokens
Макс. вывод Batch API 300K tokens, бета-заголовок output-300k-2026-03-24
Вход → выход Текст и изображения → текст
Мышление Адаптивное, включено по умолчанию
Effort по умолчанию в Claude API high
Effort по умолчанию в приложениях Claude и Claude Code medium
Значения effort low, medium, high, xhigh, max
Надёжная граница знаний июнь 2026
Минимальный кэшируемый промпт 512 tokens
Токенизатор Тот же, что у Sonnet 5, поэтому один и тот же текст имеет то же число токенов

Страница модели помечает задержку как Fast. Это сравнение внутри текущей линейки Claude, а не измеренная величина в токенах в секунду. Самая низкая настройка, которая выключает предварительное мышление, — thinking: {"type": "between_tools"}, она принимается только на low, medium и high. xhigh и max возвращаются к адаптивному мышлению. Установка temperature, top_p или top_k не в значение по умолчанию возвращает 400.

На странице запуска сказано, что Haiku 5.5 выйдет в ближайшие недели. Эта статья не назначает цену ID, которого ещё нет.

Официальные цены

Суммы указаны в долларах США за миллион токенов. Столбец Sonnet 5.5 взят со страницы модели. Столбец Opus 5.5 — из сравнительной таблицы на той же странице запуска. Страница обновлений пишет, что у Sonnet 5.5 те же цены, что у Sonnet 5, включая кэш промпта и пакетную обработку. Пакетная скидка — 50% на ввод и вывод.

За 1M tokens Sonnet 5.5 Opus 5.5 на странице запуска
Ввод $2 $4
Вывод $10 $20
Чтение кэша $0.20 $0.20
Запись в кэш 5 минут $2.50; 1 час $4 $5
Пакетный ввод / вывод 50% прайс-листа В этой таблице не напечатано

Страница запуска печатает одну цифру записи в кэш у Opus 5.5, $5, без разделения на 5 минут и 1 час. Страница модели Sonnet 5.5 разделяет эти две. Относительно ввода и вывода Opus 5.5 эта карточка — половина. Чтение кэша у обеих — $0.20.

Anthropic публикует ещё два утверждения о нагрузке: та же работа обычно занимает меньше токенов, и большинство задач обходятся до 30% дешевле; генерация вывода более чем на 30% быстрее, чем у Sonnet 5. На графиках стоимости есть сравнения по задаче примерно в одну десятую, одну пятую и одну пятнадцатую. Эти результаты принадлежат их стенду. Реальный счёт по-прежнему зависит от effort, попаданий в кэш, раундов инструментов и того, шёл ли вызов через пакет.

Как читать бенчмарки

Таблица ниже — та, что напечатана на странице запуска. Тире — пустая ячейка на той странице. Графики стоимости Terminal-Bench 4.0 и CursorBench 4.0 используют GPT-5.6 Sol, потому что OpenAI не публиковал GPT-6 Sol по этим двум. Эта статья не переносит точку графика GPT-5.6 Sol в столбец GPT-6 Sol. Modelflare тесты не перезапускал.

Бенчмарк Sonnet 5.5 Sonnet 5 Opus 5.5 GPT-6 Sol
Terminal-Bench 4.0 70.6% 10.3% 66.4% —
FrontierCode v1.1, Main 46.2% (max); 52.1% (xhigh) 42.4% 54.4% 49.3%
CursorBench 4.0 55.5% 34.1% 57.8% —
GDPval-AA v2.1 1844 1449 1846 1487
AA-Briefcase v1.1 1811 1359 1822 1483
Humanity's Last Exam, с инструментами 64.5% 54.9% 67.7% —
OSWorld 2.1, partial 80.1% 57.0% 81.8% —
Chartography, без инструментов 61.6% 15.6% 64.4% 53.6%

Сноски надо читать рядом с баллами. Opus 5.5 на Terminal-Bench 4.0 стоит на xhigh, и страница запуска называет это высшим баллом этой модели. На FrontierCode Sonnet 5.5 на max набирает ниже, чем на xhigh. Страница запуска объясняет, что max чаще запускает ревью кода, разнесённое по субагентам, и это давало тайм-аут или правки за пределами задачи, которые бенчмарк штрафует. Artificial Analysis прогнал GDPval-AA и AA-Briefcase на предрелизном развёртывании с дефектом, который мог ухудшать структурированный вывод. Страница запуска пишет, что дефект позже исправили и что любой эффект занижал бы Sonnet 5.5. Ячейки GPT-6 Sol для GDPval-AA, AA-Briefcase и Chartography несут ещё одну оговорку: OpenAI исправил дефект, который вредил пониманию изображений, и эти внешние баллы тогда могли быть ещё не обновлены.

Графики стоимости на той же странице читаются иначе. Medium effort — значение по умолчанию в приложениях Claude. На нескольких бенчмарках Sonnet 5.5 на Low или Medium обходит лучший результат Sonnet 5 примерно за одну десятую стоимости задачи. High effort — значение по умолчанию на Claude Platform. Страница запуска пишет, что на FrontierCode при High он примерно на 10 баллов выше Sonnet 5 на той же настройке, примерно за одну пятнадцатую стоимости задачи, и совпадает с лучшим результатом GPT-6 Sol примерно за одну пятую стоимости. На CursorBench при Low он превосходит лучший результат Sonnet 5 менее чем за одну десятую стоимости. На AA-Briefcase при Medium он обходит лучший результат Sonnet 5 примерно за одну девятую стоимости. Напечатанные 55.5% и 1844 — это точки в таблице. Предложения о стоимости — другой стенд. Отобранные цитаты клиентов на странице запуска могут подсказать, что переигрывать. К этой таблице они не относятся.

Страница запуска также пишет, что это первый Sonnet, прошедший Pokémon Red только по скриншотам. Это продуктовый рассказ вендора, а не строка таблицы выше.

Цены и группы Modelflare

В ответе с ценами от 30 сентября 2026 года у claude-sonnet-5-5 input_price равен 2, а completion_ratio равен 5, поэтому вывод — $10. cache_ratio равен 0.1, поэтому чтение кэша — $0.20. create_cache_ratio равен 1.25, поэтому запись в кэш по каталогу — $2.50. У строки нет billing_mode и нет отдельной цены часовой записи. Не умножайте официальные $4 за час или пакетную половину цены на коэффициент группы и не считайте произведение уже выставленным списанием. Списание — это запись использования.

Типы эндпоинтов — anthropic и openai. Группа выбирается на API-ключе. Четыре публичные группы вызывают один и тот же ID модели.

Таблица цен

Группа Коэффициент Ввод / 1M Чтение кэша / 1M Запись в кэш по каталогу / 1M Вывод / 1M Описание каталога в тот день
claude-award 0.25 $0.50 $0.05 $0.625 $2.50 Маршрутизация с приоритетом цены для чувствительной к бюджету, повторяемой разработки, тестов и гибких нагрузок
claude-stable 0.315 $0.63 $0.063 $0.7875 $3.15 Личная разработка, более долгие проекты и production, где важна стабильность
claude-premium 0.5 $1.00 $0.10 $1.25 $5.00 Приоритет непрерывности и успеха запроса, по 50% официального прайс-листа
claude-tmp-cheap 0.06 $0.12 $0.012 $0.15 $0.60 Маршрут ограниченной по времени акции

Арифметика — единичная цена каталога, умноженная на коэффициент группы. На claude-stable $0.63 — это $2 × 0.315, а запись в кэш $0.7875 — это $2.50 × 0.315. Описание — текст из определения группы. Это не измеренное соглашение о доступности.

Тот же ответ также указывает непубличный claude-first-topup с коэффициентом 0.03. В определении он открывается, когда одно пополнение достигает $50. Это не публичная выбираемая группа, поэтому строки выше у него нет. Если у ключа есть ещё группы отката, запрос, покинувший группу кампании, тарифицируется по группе, которая его обслужила.

Три примера

Каждая форма — 100,000 токенов названного класса ввода плюс 5,000 выходных токенов. Строки кэша предполагают, что запись использования действительно относит эти токены к чтению или записи. На малых суммах округление квоты может сдвинуть выставленную цифру.

Запрос Прайс-лист claude-award claude-stable claude-premium claude-tmp-cheap
100,000 некэшированного ввода, 5,000 вывода $0.2500 $0.0625 $0.07875 $0.1250 $0.0150
100,000 чтения кэша, 5,000 вывода $0.0700 $0.0175 $0.02205 $0.0350 $0.0042
100,000 записи в кэш по каталогу, 5,000 вывода $0.3000 $0.0750 $0.0945 $0.1500 $0.0180

Прайс-лист первой строки — 0.1 × $2 + 0.005 × $10. Каждая ячейка группы — эти $0.25, умноженные на коэффициент. Третья строка использует цену записи каталога $2.50, официальную 5-минутную ступень, а не часовые $4. Живая страница — страница цен claude-sonnet-5-5. Полный каталог — Модели и цены.

Когда одна ошибка дорога, каталог описывает claude-premium как маршрут непрерывности. Для повседневного production и более долгих проектов каталог описывает claude-stable как такого рода значение по умолчанию. Повторяемые разработка и тесты используют claude-award. claude-tmp-cheap — маршрут ограниченной по времени акции с коэффициентом 0.06. Группу выбирают по цене ошибки и читают коэффициент вместе с этим описанием, а не только коэффициент.

Как вызывать это на Modelflare

Создайте ключ на одной из четырёх групп таблицы. ID модели отправляйте точно claude-sonnet-5-5. Канонический базовый URL — https://modelflare.dev/v1. Тот же API также опубликован на https://cf.modelflare.dev/v1 и https://origin.modelflare.dev/v1. Корневой домен — канонический сайт.

Messages API — вход, на котором задаётся effort. Запрос ниже оставляет мышление адаптивным и ставит effort в medium. max_tokens должен оставлять место блокам мышления.

export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"

curl -sS https://modelflare.dev/v1/messages \
  -H "x-api-key: $MODELFLARE_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 1024,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {
        "role": "user",
        "content": "Проверьте этот план миграции и перечислите три допущения, которым больше всего нужен тест."
      }
    ]
  }'

Chat Completions тоже указан на этом ID. Этот пример отправляет только текст и не задаёт reasoning_effort.

curl -sS https://modelflare.dev/v1/chat/completions \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "messages": [
      {
        "role": "user",
        "content": "Проверьте этот план миграции и перечислите три допущения, которым больше всего нужен тест."
      }
    ]
  }'

Чтобы выбрать effort, используйте запрос Messages выше. Сейчас шлюз превращает reasoning_effort у Chat Completions в ручной бюджет мышления с budget_tokens, а Sonnet 5.5 ручной бюджет отклоняет. Если effort опущен, значение по умолчанию Claude API — high. Разница двух входов разобрана в Responses API и Chat Completions. Как использование сходится со счётом, разобрано в Отслеживание стоимости AI API.

Переход с Sonnet 5

Страница обновлений перечисляет пять изменений, из-за которых код, уже работающий на Sonnet 5, возвращает 400, и ещё одно изменение, при котором запрос остаётся успешным, а форма ответа меняется.

Запросы, которые возвращают 400

thinking: {"type": "disabled"}
thinking: {"type": "enabled", "budget_tokens": N}
thinking: {"type": "between_tools"} при effort xhigh или max
tool_choice: {"type": "any"}
tool_choice: {"type": "tool", "name": "..."}
temperature, top_p или top_k заданы не по умолчанию
тип инструмента computer_20251124 в Claude API и Google Cloud
инструмент advisor использует Opus 4.8, Opus 4.7 или Sonnet 5 как советника

Чтобы выключить предварительное мышление, отправьте between_tools и держите effort на high или ниже. tool_choice оставьте на auto или none. Чтобы получить вход инструмента, соответствующий схеме, включите strict или перенесите схему в структурированный вывод и напишите в промпте, когда инструмент применяется. На Claude API и Google Cloud использование компьютера переходит на computer_toolset_20260801. Amazon Bedrock по-прежнему принимает computer_20251124. Инструмент advisor принимает Mythos 5.1, Fable 5.1, Mythos 5, Fable 5, Opus 5.5, Opus 5 или сам Sonnet 5.5. Содержимое advisor возвращается зашифрованным, и клиент не может прочитать текст.

У аккаунтов, созданных 31 августа 2026 года, 00:00 UTC, или позже, на Claude API, Amazon Bedrock и Google Cloud есть ещё один 400: повтор блока мышления Sonnet 5.5 после изменения системного промпта, списка инструментов или более раннего сообщения завершается ошибкой. Держите диалог только с дописыванием. Когда инструкции нужно изменить, используйте системное сообщение в середине диалога.

Поведение меняется и при успешном ответе

Если effort опущен, API работает на high. То же слово не покупает тот объём мышления, который был у Sonnet 5. Страница обновлений просит заново прогнать effort, а не копировать старую настройку. Цикл инструментов с ясным объёмом можно начинать с medium, а более длинный или трудный поднимать до high. Диалог, чувствительный к задержке, можно начинать с medium или low.

Текст прогресса длиннее одного-двух предложений между вызовами инструментов возвращается внутри блоков мышления. При display по умолчанию, равном omitted, текст этих блоков пуст, поэтому интерфейс затихает между инструментами, а запрос всё равно успешен. Задайте display, когда продукту нужны эти строки. С between_tools этот текст возвращается.

Блок мышления записывает модель, которая его произвела. Sonnet 5.5 читает блоки мышления Sonnet 5, Opus 4.8, Haiku 4.5 и более ранних моделей. Он не читает блоки Opus 5, Opus 5.5, Fable или Mythos. Никакая другая модель не читает блоки мышления Sonnet 5.5. Блок, который целевая модель прочитать не может, отбрасывается до того, как модель его увидит, и отброшенный блок не тарифицируется. Блок, который произвёл Sonnet 5.5, также остаётся при аккаунте, который его произвёл. Повтор с несвязанного аккаунта отбрасывает блок, а запрос всё равно успешен.

Отказ и откат

Отклонённый запрос возвращает HTTP 200, а stop_reason равен "refusal". Категории, названные на странице обновлений: cyber, bio, frontier_llm, reasoning_extraction и general_harms. Страница запуска пишет, что его возможности в кибербезопасности близки к Opus 5, поэтому это первый Sonnet, который поставляется с этим классом киберзащиты. Задачи кибербезопасности более высокого риска откатываются на Sonnet 5. Биологическая защита совпадает с Sonnet 5. Обычная разработка программ и большая часть работы в науках о жизни лежат вне этих двух узких защит.

Страница обновлений пишет, что бета-откат по умолчанию в Claude API повторяет cyber и frontier_llm на Sonnet 5 и не повторяет bio, reasoning_extraction или general_harms. Это задокументированное поведение Anthropic. Выполняет ли этот маршрут Modelflare тот же откат, отвечает имя модели в ответе. Отказы считайте отдельно от транспортных сбоев. Тарифицируется ли отказ, зависит от его категории. Страница запуска также пишет, что Sonnet 5.5 доступен с нулевым хранением данных.

Проверки перед переносом трафика

  1. Зафиксируйте claude-sonnet-5-5. Проверьте также имя модели в завершённом результате. Откат защиты может ответить как Sonnet 5.
  2. Подтвердите, что группа ключа — одна из четырёх публичных групп таблицы, и выбирайте её по цене ошибки.
  3. Переиграйте один набор без чувствительных данных на low, medium, high, xhigh и max. Запишите успех, задержку, ввод, чтения кэша, записи в кэш, вывод и списание.
  4. Кладите effort в output_config.effort запроса Messages. Не используйте reasoning_effort у Chat Completions, чтобы задать уровень мышления этой модели.
  5. Измените клиенты, которые всё ещё шлют disabled, принудительный выбор инструмента, ручной бюджет мышления или computer_20251124, прежде чем поднимать объём.
  6. Диалоги, которые переигрывают блоки мышления, держите только с дописыванием.
  7. Считайте отказы HTTP 200 отдельно от транспортных сбоев.
  8. Оцените один короткий промпт и один промпт, который должен попасть в кэш, затем прочитайте выставленную сумму. Официальная цена часовой записи и пакетная половина цены следуют записи использования.
  9. Сложную открытую работу, которой нужно устойчивое суждение, оставляйте на claude-opus-5-5. claude-sonnet-5 остаётся доступным.

Источники

Проверено 30 сентября 2026 года. Modelflare независимо бенчмарки не воспроизводил.