GPT-6.1 Sol: спецификация, цена и доступ в Modelflare

Разбор gpt-6.1-sol по источникам: опубликованные спецификации, цены короткого и длинного контекста, как читать сравнения запуска от 29 сентября 2026 года, а также группы и пользовательские цены Modelflare, возвращённые 30 сентября 2026 года.

OpenAI выпустил GPT-6.1 Sol 29 сентября 2026 года. ID модели в API — gpt-6.1-sol. Страница запуска описывает его как обновление gpt-6-sol: на сложном программировании, использовании компьютера и профессиональной работе он близок к gpt-6-astra, при одной пятой стандартных цен ввода и вывода Astra. Чтение кэша — $0.10 за миллион токенов, 5% стандартного ввода и половина чтения кэша gpt-6-sol. Для самой трудной научной работы страница запуска по-прежнему указывает на Astra. gpt-6-sol остаётся доступным.

Эта статья держит три слоя отдельно. Спецификация и цены взяты со страницы запуска и страницы модели OpenAI. Сравнения бенчмарков копируют разницы, стоимости и условия, которые страница запуска действительно указывает. Modelflare их не перезапускал. Группы и пользовательские цены взяты из GET https://modelflare.dev/api/pricing, прочитанного 30 сентября 2026 года. Фраза вендора вроде «около одной пятой стоимости» описывает их собственный тестовый стенд.

Вывод после сверки

Прайс-лист короткого контекста — $2 ввод, $0.10 чтение кэша, $2.50 запись в кэш и $10 вывод за миллион токенов. Выше 272,000 входных токенов ввод и кэш удваиваются, а вывод умножается на 1.5 для всего запроса, то есть $4 / $0.20 / $5 / $15. Строка цены Modelflare за тот же день записывает эту же пару в двух ступенях pricing_rules. request_rules в этой строке пуст, поэтому единичные цены каталога не умножаются ещё раз на Fast, Batch, Flex или региональную надбавку.

Публичные выбираемые группы — openai-award (0.03) и openai-stable (0.08). openai-premium — публичная группа, и эта модель к ней не прикреплена. Строка модели также называет openai-enterprise и непубличный openai-first-topup. Публичный ответ не содержит коэффициента enterprise, поэтому эта статья не печатает пользовательскую цену enterprise.

Опубликованная спецификация

Пункт GPT-6.1 Sol
ID модели gpt-6.1-sol
Выпуск 29 сентября 2026, OpenAI API
Окно контекста 1,050,000 tokens
Максимальный ввод 922,000 tokens
Максимальный вывод 128,000 tokens
Вход → выход Текст и изображения → текст
Граница знаний 30 апреля 2026
reasoning.effort low, medium (по умолчанию), high, xhigh, max
Effort, которые не принимаются none, minimal
Вызов инструментов Responses API
Chat Completions Поддерживается, без инструментов
Перечисленные эндпоинты Chat Completions, Responses, Batch
На странице модели указано как неподдерживаемое Realtime, Assistants, дообучение, embeddings, генерация изображений, видео, речь

Страница модели также пишет, что модель поддерживает резидентность данных в США и ЕС и что Fast недоступен вместе с резидентностью данных в ЕС. У строки цены Modelflare, прочитанной для этой статьи, нет переключателя резидентности. Резидентность читайте со страницы модели и держите её отдельно от параметра шлюза.

Максимальный ввод 922,000 сходится с окном контекста 1,050,000 и максимальным выводом 128,000: 1,050,000 − 128,000 = 922,000. Токены рассуждения занимают контекст и тарифицируются как выходные токены. max_output_tokens ограничивает токены рассуждения, видимый вывод и токены форматирования вместе. Когда этот предел достигнут, статус ответа — incomplete, а причина — max_output_tokens.

Официальные цены

Короткий контекст и длинный контекст

Суммы указаны в долларах США за миллион токенов. Короткая ступень — со страницы модели. Длинная ступень — правило, указанное там: выше 272,000 входных токенов ввод и кэш удваиваются, вывод умножается на 1.5, и весь запрос использует длинную ступень. Столбцы Sol и Astra взяты из pricing_rules этих моделей в ответе с ценами Modelflare за тот же день. Их короткие ступени совпадают с опубликованным прайс-листом.

За 1M tokens 6.1 короткий 6.1 длинный Sol короткий Sol длинный Astra короткий Astra длинный
Ввод $2 $4 $2 $4 $10 $20
Чтение кэша $0.10 $0.20 $0.20 $0.40 $1 $2
Запись в кэш $2.50 $5 $2.50 $5 $12.50 $25
Вывод $10 $15 $10 $15 $50 $75

Целое число 272,000 остаётся на короткой ступени: условие строки цены — input_context_tokens <= 272000. С 272,001 действует длинная ступень, включая первые 272,000 токенов. Чтение кэша у 6.1 — половина Sol. Стандартные ввод и вывод — одна пятая Astra. Чтение кэша — не одна пятая Astra. Чтение кэша Astra на коротком контексте — $1.

Другие официальные ступени

Страница модели указывает ещё три официальных множителя: Fast — это 2× Standard, Batch и Flex на 50% ниже Standard, а региональная обработка добавляет 10% там, где она доступна. Страница запуска также пишет, что Ultrafast предложат в Codex в ближайшие дни, с генерацией токенов до 8× стандартной скорости. В строке цены Modelflare от 30 сентября 2026 года request_rules пуст, has_request_rules равен false, и нет ID модели Ultrafast. Бюджет вызова Modelflare считайте по двум ступеням выше. Дошёл ли официальный множитель до счёта, отвечает запись использования.

Как читать бенчмарки

Страница запуска публикует разницы и стоимости, а не таблицу абсолютных баллов, которую можно выписать. Таблица ниже сохраняет только сравнения, которые страница указывает. Предложения о стоимости описывают стенд OpenAI. Modelflare тесты не перезапускал.

Оценка Сравнение, указанное на странице запуска Условие
DeepSWE v1.1 На уровне Astra; на 6.4 процентного пункта выше лучшего результата Sol Более низкий reasoning effort, примерно одна пятая стоимости
GDP.pdf Выше Opus 5.5 с fallback; приближается к Astra По проверенным настройкам reasoning; меньше половины стоимости Opus, около одной пятой стоимости Astra
AutomationBench На 2.2 процентного пункта выше Opus 5.5; на 4.8 процентного пункта выше Sol при той же настройке medium; около одной трети стоимости Opus
Офлайн-набор OSWorld 2.0 На 7 процентных пунктов выше Sol; в пределах 2.1 процентного пункта от Astra max; partial reward, v2026.08.08; меньше половины стоимости Sol, около одной седьмой стоимости Astra
Terminal-Bench Science 0.1 Более чем удваивает результат Sol; Astra остаётся самым высоким, 68.1% max; средняя стоимость задачи $5.47 у 6.1, $23.21 у Opus 5.5, $23.80 у Astra
Фактическая точность Доля ответов хотя бы с одной фактической ошибкой падает с 11.4% до 7.7% low; в пределах 1.9 процентного пункта от Astra

Выборка фактической точности — обезличенные диалоги, в которых пользователь ранее отметил ошибку. Страница запуска пишет, что эти промпты намеренно трудные и не являются типичным трафиком. Доллары Terminal-Bench Science — опубликованная OpenAI средняя стоимость задачи, а не цена группы Modelflare. 68.1% у Astra по-прежнему высший научный балл, и страница запуска советует оставлять самую трудную научную работу на Astra.

Тесты согласования на той же странице добавляют набор намеренно трудных долей отказов. Когда поисковый инструмент сломан, доля ответов на max effort, которые не сообщают об этом пользователю, — 2.1% у 6.1, 4.9% у Sol, 1.5% у Astra и 28.7% у Luna. Страница запуска пишет, что попыток обойти автоматического проверяющего безопасности не наблюдалось, как у Astra и Sol. Подробность — в дополнении к системной карте GPT-6.1 Sol. Эти доли — не доли отказов на обычном трафике.

Цены и группы Modelflare

30 сентября 2026 года у gpt-6.1-sol input_price равен 2, completion_ratio равен 5, cache_ratio равен 0.05 и create_cache_ratio равен 1.25. billing_mode — tiered_expr. Единичные цены короткой ступени — $2 ввод, $0.10 чтение кэша, $2.50 запись в кэш и $10 вывод. Длинная ступень — $4 / $0.20 / $5 / $15. Типы эндпоинтов — openai, openai-response и openai-response-compact.

Публичные выбираемые группы, которые включают эту модель, — две ниже. Группа выбирается на ключе. Обе группы вызывают один и тот же ID модели.

Таблица цен

Группа Коэффициент Ступень Ввод / 1M Чтение кэша / 1M Запись в кэш / 1M Вывод / 1M
openai-award 0.03 Ввод до 272,000 $0.06 $0.003 $0.075 $0.30
openai-award 0.03 Ввод выше 272,000, весь запрос $0.12 $0.006 $0.15 $0.45
openai-stable 0.08 Ввод до 272,000 $0.16 $0.008 $0.20 $0.80
openai-stable 0.08 Ввод выше 272,000, весь запрос $0.32 $0.016 $0.40 $1.20

Описание каталога у openai-award — маршрутизация с приоритетом цены для чувствительной к бюджету, повторяемой разработки, тестов и гибких нагрузок, с заявленной ежедневной защитой попадания в кэш 65% для подходящих запросов и компенсацией недостачи. Описание openai-stable — личная разработка, более долгие проекты и production, где важна стабильность, с заявленной защитой 75% в день. Оба предложения — текст определения группы. Эта статья отдельно долю попаданий не измеряла.

Строка модели также перечисляет openai-enterprise. В том же публичном ответе нет коэффициента этой группы в group_definitions или group_ratio, поэтому таблица выше её опускает. Непубличный openai-first-topup имеет коэффициент 0.015 и описан как открывающийся, когда одно пополнение достигает $20. Это не публичная выбираемая группа. Если у ключа есть ещё группы отката, запрос, покинувший группу кампании, тарифицируется по группе, которая его обслужила. Публичный openai-premium имеет коэффициент 0.13, и enable_groups этой модели его не включает.

Три примера

Первые две строки попадают в короткую ступень. Третья строка — 280,000 входных токенов, поэтому весь запрос использует длинную ступень. Строка кэша предполагает, что запись использования считает эти входные токены попаданием в кэш.

Запрос Прайс-лист openai-award openai-stable
100,000 некэшированного ввода, 5,000 вывода $0.2500 $0.0075 $0.0200
100,000 чтения кэша, 5,000 вывода $0.0600 $0.0018 $0.0048
280,000 некэшированного ввода, 10,000 вывода $1.2700 $0.0381 $0.1016

Первая строка — 0.1 × $2 + 0.005 × $10 = $0.25. Вторая — 0.1 × $0.10 + 0.005 × $10 = $0.06. Третья — 0.28 × $4 + 0.01 × $15 = $1.27, а ячейки групп умножают на 0.03 или 0.08. Если применить единичные цены короткой ступени к этим 280,000 токенам, на award получится $0.0198, и это не цена этой строки. Живая страница — страница цен gpt-6.1-sol. Полный каталог — Модели и цены.

Повторяемые разработка и тесты используют openai-award. Для повседневного production и более долгих проектов каталог описывает openai-stable как такого рода значение по умолчанию. Два коэффициента — 3% и 8% цен каталога короткой и длинной ступени. Это не 3% и 8% цены, которую уже умножили на Fast, Batch, Flex или региональную надбавку.

Как вызывать это на Modelflare

Создайте ключ на openai-award или openai-stable. Отправляйте ID модели gpt-6.1-sol точно. Канонический базовый URL — https://modelflare.dev/v1. Тот же API также опубликован на https://cf.modelflare.dev/v1 и https://origin.modelflare.dev/v1. Корневой домен — канонический сайт.

Вызов инструментов использует Responses. Effort по умолчанию уже medium. Запрос ниже задаёт его явно.

export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"

curl -sS https://modelflare.dev/v1/responses \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6.1-sol",
    "reasoning": {"effort": "medium"},
    "input": "Проверьте этот план миграции и перечислите три допущения, которым больше всего нужен тест."
  }'

Chat Completions может отправлять текст без инструментов. Имя поля — reasoning_effort.

curl -sS https://modelflare.dev/v1/chat/completions \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6.1-sol",
    "reasoning_effort": "medium",
    "messages": [
      {
        "role": "user",
        "content": "Проверьте этот план миграции и перечислите три допущения, которым больше всего нужен тест."
      }
    ]
  }'

POST /v1/responses/compact указан на этой модели. Это операция сжатия над gpt-6.1-sol, а не второй ID модели. Ввод изображения использует обычный массив содержимого в сообщении пользователя. Разница двух входов разобрана в Responses API и Chat Completions. Как использование сходится со счётом, разобрано в Отслеживание стоимости AI API.

Отличия запроса от GPT-6 Sol

Прайс-лист ввода и вывода короткой ступени совпадает с gpt-6-sol, а чтение кэша переходит с $0.20 на $0.10. Вывод длинной ступени у обеих — $15, а чтение кэша длинной ступени переходит с $0.40 на $0.20. gpt-6-sol остаётся в каталоге. Его публичные группы в этом чтении включают openai-premium, которого у 6.1 нет. При переходе на 6.1 фиксируйте имя модели в завершённом результате. Результат, который попал на другой ID, — не этот переход.

Формы, которые не проходят

reasoning.effort: none
reasoning.effort: minimal
tools в запросе Chat Completions

none и minimal возвращают HTTP 400. При переходе с gpt-6-sol или gpt-6-luna, оба из которых принимают none, сравните заново на low и уберите none из запроса. Инструменты, использование компьютера, поиск по файлам и поиск в вебе идут через Responses. Chat Completions несёт запросы, в которых нет инструментов.

Проверки перед переносом трафика

  1. Зафиксируйте gpt-6.1-sol. Имя модели в завершённом результате тоже должно быть этим ID.
  2. Оцените публичную цену на openai-award или openai-stable и выбирайте группу ключа по цене ошибки.
  3. Переиграйте один набор без чувствительных данных на low, medium, high, xhigh и max. none и minimal возвращают 400.
  4. Кладите инструменты на Responses. Пример Chat Completions инструментов не несёт.
  5. Оцените один промпт на 272,000 входных токенов и один на 272,001. Второй использует единичные цены длинной ступени для всего запроса.
  6. Бюджет считайте по двум ступеням каталога. Fast, Batch, Flex и региональная надбавка со страницы модели следуют сумме, которая реально появляется в записи использования.
  7. Прочитайте число кэшированных токенов в записи использования, прежде чем пользоваться примером кэша выше.
  8. Самую трудную научную работу оставляйте на gpt-6-astra. gpt-6-sol остаётся доступным.

Источники

Проверено 30 сентября 2026 года. Modelflare независимо бенчмарки не воспроизводил.