GPT-6.1 Sol: спецификация, цена и доступ в Modelflare
Разбор gpt-6.1-sol по источникам: опубликованные спецификации, цены короткого и длинного контекста, как читать сравнения запуска от 29 сентября 2026 года, а также группы и пользовательские цены Modelflare, возвращённые 30 сентября 2026 года.
OpenAI выпустил GPT-6.1 Sol 29 сентября 2026 года. ID модели в API — gpt-6.1-sol. Страница запуска описывает его как обновление gpt-6-sol: на сложном программировании, использовании компьютера и профессиональной работе он близок к gpt-6-astra, при одной пятой стандартных цен ввода и вывода Astra. Чтение кэша — $0.10 за миллион токенов, 5% стандартного ввода и половина чтения кэша gpt-6-sol. Для самой трудной научной работы страница запуска по-прежнему указывает на Astra. gpt-6-sol остаётся доступным.
Эта статья держит три слоя отдельно. Спецификация и цены взяты со страницы запуска и страницы модели OpenAI. Сравнения бенчмарков копируют разницы, стоимости и условия, которые страница запуска действительно указывает. Modelflare их не перезапускал. Группы и пользовательские цены взяты из GET https://modelflare.dev/api/pricing, прочитанного 30 сентября 2026 года. Фраза вендора вроде «около одной пятой стоимости» описывает их собственный тестовый стенд.
Вывод после сверки
Прайс-лист короткого контекста — $2 ввод, $0.10 чтение кэша, $2.50 запись в кэш и $10 вывод за миллион токенов. Выше 272,000 входных токенов ввод и кэш удваиваются, а вывод умножается на 1.5 для всего запроса, то есть $4 / $0.20 / $5 / $15. Строка цены Modelflare за тот же день записывает эту же пару в двух ступенях pricing_rules. request_rules в этой строке пуст, поэтому единичные цены каталога не умножаются ещё раз на Fast, Batch, Flex или региональную надбавку.
Публичные выбираемые группы — openai-award (0.03) и openai-stable (0.08). openai-premium — публичная группа, и эта модель к ней не прикреплена. Строка модели также называет openai-enterprise и непубличный openai-first-topup. Публичный ответ не содержит коэффициента enterprise, поэтому эта статья не печатает пользовательскую цену enterprise.
Опубликованная спецификация
| Пункт | GPT-6.1 Sol |
|---|---|
| ID модели | gpt-6.1-sol |
| Выпуск | 29 сентября 2026, OpenAI API |
| Окно контекста | 1,050,000 tokens |
| Максимальный ввод | 922,000 tokens |
| Максимальный вывод | 128,000 tokens |
| Вход → выход | Текст и изображения → текст |
| Граница знаний | 30 апреля 2026 |
reasoning.effort |
low, medium (по умолчанию), high, xhigh, max |
| Effort, которые не принимаются | none, minimal |
| Вызов инструментов | Responses API |
| Chat Completions | Поддерживается, без инструментов |
| Перечисленные эндпоинты | Chat Completions, Responses, Batch |
| На странице модели указано как неподдерживаемое | Realtime, Assistants, дообучение, embeddings, генерация изображений, видео, речь |
Страница модели также пишет, что модель поддерживает резидентность данных в США и ЕС и что Fast недоступен вместе с резидентностью данных в ЕС. У строки цены Modelflare, прочитанной для этой статьи, нет переключателя резидентности. Резидентность читайте со страницы модели и держите её отдельно от параметра шлюза.
Максимальный ввод 922,000 сходится с окном контекста 1,050,000 и максимальным выводом 128,000: 1,050,000 − 128,000 = 922,000. Токены рассуждения занимают контекст и тарифицируются как выходные токены. max_output_tokens ограничивает токены рассуждения, видимый вывод и токены форматирования вместе. Когда этот предел достигнут, статус ответа — incomplete, а причина — max_output_tokens.
Официальные цены
Короткий контекст и длинный контекст
Суммы указаны в долларах США за миллион токенов. Короткая ступень — со страницы модели. Длинная ступень — правило, указанное там: выше 272,000 входных токенов ввод и кэш удваиваются, вывод умножается на 1.5, и весь запрос использует длинную ступень. Столбцы Sol и Astra взяты из pricing_rules этих моделей в ответе с ценами Modelflare за тот же день. Их короткие ступени совпадают с опубликованным прайс-листом.
| За 1M tokens | 6.1 короткий | 6.1 длинный | Sol короткий | Sol длинный | Astra короткий | Astra длинный |
|---|---|---|---|---|---|---|
| Ввод | $2 | $4 | $2 | $4 | $10 | $20 |
| Чтение кэша | $0.10 | $0.20 | $0.20 | $0.40 | $1 | $2 |
| Запись в кэш | $2.50 | $5 | $2.50 | $5 | $12.50 | $25 |
| Вывод | $10 | $15 | $10 | $15 | $50 | $75 |
Целое число 272,000 остаётся на короткой ступени: условие строки цены — input_context_tokens <= 272000. С 272,001 действует длинная ступень, включая первые 272,000 токенов. Чтение кэша у 6.1 — половина Sol. Стандартные ввод и вывод — одна пятая Astra. Чтение кэша — не одна пятая Astra. Чтение кэша Astra на коротком контексте — $1.
Другие официальные ступени
Страница модели указывает ещё три официальных множителя: Fast — это 2× Standard, Batch и Flex на 50% ниже Standard, а региональная обработка добавляет 10% там, где она доступна. Страница запуска также пишет, что Ultrafast предложат в Codex в ближайшие дни, с генерацией токенов до 8× стандартной скорости. В строке цены Modelflare от 30 сентября 2026 года request_rules пуст, has_request_rules равен false, и нет ID модели Ultrafast. Бюджет вызова Modelflare считайте по двум ступеням выше. Дошёл ли официальный множитель до счёта, отвечает запись использования.
Как читать бенчмарки
Страница запуска публикует разницы и стоимости, а не таблицу абсолютных баллов, которую можно выписать. Таблица ниже сохраняет только сравнения, которые страница указывает. Предложения о стоимости описывают стенд OpenAI. Modelflare тесты не перезапускал.
| Оценка | Сравнение, указанное на странице запуска | Условие |
|---|---|---|
| DeepSWE v1.1 | На уровне Astra; на 6.4 процентного пункта выше лучшего результата Sol | Более низкий reasoning effort, примерно одна пятая стоимости |
| GDP.pdf | Выше Opus 5.5 с fallback; приближается к Astra | По проверенным настройкам reasoning; меньше половины стоимости Opus, около одной пятой стоимости Astra |
| AutomationBench | На 2.2 процентного пункта выше Opus 5.5; на 4.8 процентного пункта выше Sol при той же настройке | medium; около одной трети стоимости Opus |
| Офлайн-набор OSWorld 2.0 | На 7 процентных пунктов выше Sol; в пределах 2.1 процентного пункта от Astra | max; partial reward, v2026.08.08; меньше половины стоимости Sol, около одной седьмой стоимости Astra |
| Terminal-Bench Science 0.1 | Более чем удваивает результат Sol; Astra остаётся самым высоким, 68.1% | max; средняя стоимость задачи $5.47 у 6.1, $23.21 у Opus 5.5, $23.80 у Astra |
| Фактическая точность | Доля ответов хотя бы с одной фактической ошибкой падает с 11.4% до 7.7% | low; в пределах 1.9 процентного пункта от Astra |
Выборка фактической точности — обезличенные диалоги, в которых пользователь ранее отметил ошибку. Страница запуска пишет, что эти промпты намеренно трудные и не являются типичным трафиком. Доллары Terminal-Bench Science — опубликованная OpenAI средняя стоимость задачи, а не цена группы Modelflare. 68.1% у Astra по-прежнему высший научный балл, и страница запуска советует оставлять самую трудную научную работу на Astra.
Тесты согласования на той же странице добавляют набор намеренно трудных долей отказов. Когда поисковый инструмент сломан, доля ответов на max effort, которые не сообщают об этом пользователю, — 2.1% у 6.1, 4.9% у Sol, 1.5% у Astra и 28.7% у Luna. Страница запуска пишет, что попыток обойти автоматического проверяющего безопасности не наблюдалось, как у Astra и Sol. Подробность — в дополнении к системной карте GPT-6.1 Sol. Эти доли — не доли отказов на обычном трафике.
Цены и группы Modelflare
30 сентября 2026 года у gpt-6.1-sol input_price равен 2, completion_ratio равен 5, cache_ratio равен 0.05 и create_cache_ratio равен 1.25. billing_mode — tiered_expr. Единичные цены короткой ступени — $2 ввод, $0.10 чтение кэша, $2.50 запись в кэш и $10 вывод. Длинная ступень — $4 / $0.20 / $5 / $15. Типы эндпоинтов — openai, openai-response и openai-response-compact.
Публичные выбираемые группы, которые включают эту модель, — две ниже. Группа выбирается на ключе. Обе группы вызывают один и тот же ID модели.
Таблица цен
| Группа | Коэффициент | Ступень | Ввод / 1M | Чтение кэша / 1M | Запись в кэш / 1M | Вывод / 1M |
|---|---|---|---|---|---|---|
openai-award |
0.03 | Ввод до 272,000 | $0.06 | $0.003 | $0.075 | $0.30 |
openai-award |
0.03 | Ввод выше 272,000, весь запрос | $0.12 | $0.006 | $0.15 | $0.45 |
openai-stable |
0.08 | Ввод до 272,000 | $0.16 | $0.008 | $0.20 | $0.80 |
openai-stable |
0.08 | Ввод выше 272,000, весь запрос | $0.32 | $0.016 | $0.40 | $1.20 |
Описание каталога у openai-award — маршрутизация с приоритетом цены для чувствительной к бюджету, повторяемой разработки, тестов и гибких нагрузок, с заявленной ежедневной защитой попадания в кэш 65% для подходящих запросов и компенсацией недостачи. Описание openai-stable — личная разработка, более долгие проекты и production, где важна стабильность, с заявленной защитой 75% в день. Оба предложения — текст определения группы. Эта статья отдельно долю попаданий не измеряла.
Строка модели также перечисляет openai-enterprise. В том же публичном ответе нет коэффициента этой группы в group_definitions или group_ratio, поэтому таблица выше её опускает. Непубличный openai-first-topup имеет коэффициент 0.015 и описан как открывающийся, когда одно пополнение достигает $20. Это не публичная выбираемая группа. Если у ключа есть ещё группы отката, запрос, покинувший группу кампании, тарифицируется по группе, которая его обслужила. Публичный openai-premium имеет коэффициент 0.13, и enable_groups этой модели его не включает.
Три примера
Первые две строки попадают в короткую ступень. Третья строка — 280,000 входных токенов, поэтому весь запрос использует длинную ступень. Строка кэша предполагает, что запись использования считает эти входные токены попаданием в кэш.
| Запрос | Прайс-лист | openai-award |
openai-stable |
|---|---|---|---|
| 100,000 некэшированного ввода, 5,000 вывода | $0.2500 | $0.0075 | $0.0200 |
| 100,000 чтения кэша, 5,000 вывода | $0.0600 | $0.0018 | $0.0048 |
| 280,000 некэшированного ввода, 10,000 вывода | $1.2700 | $0.0381 | $0.1016 |
Первая строка — 0.1 × $2 + 0.005 × $10 = $0.25. Вторая — 0.1 × $0.10 + 0.005 × $10 = $0.06. Третья — 0.28 × $4 + 0.01 × $15 = $1.27, а ячейки групп умножают на 0.03 или 0.08. Если применить единичные цены короткой ступени к этим 280,000 токенам, на award получится $0.0198, и это не цена этой строки. Живая страница — страница цен gpt-6.1-sol. Полный каталог — Модели и цены.
Повторяемые разработка и тесты используют openai-award. Для повседневного production и более долгих проектов каталог описывает openai-stable как такого рода значение по умолчанию. Два коэффициента — 3% и 8% цен каталога короткой и длинной ступени. Это не 3% и 8% цены, которую уже умножили на Fast, Batch, Flex или региональную надбавку.
Как вызывать это на Modelflare
Создайте ключ на openai-award или openai-stable. Отправляйте ID модели gpt-6.1-sol точно. Канонический базовый URL — https://modelflare.dev/v1. Тот же API также опубликован на https://cf.modelflare.dev/v1 и https://origin.modelflare.dev/v1. Корневой домен — канонический сайт.
Вызов инструментов использует Responses. Effort по умолчанию уже medium. Запрос ниже задаёт его явно.
export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"
curl -sS https://modelflare.dev/v1/responses \
-H "Authorization: Bearer $MODELFLARE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"reasoning": {"effort": "medium"},
"input": "Проверьте этот план миграции и перечислите три допущения, которым больше всего нужен тест."
}'
Chat Completions может отправлять текст без инструментов. Имя поля — reasoning_effort.
curl -sS https://modelflare.dev/v1/chat/completions \
-H "Authorization: Bearer $MODELFLARE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"reasoning_effort": "medium",
"messages": [
{
"role": "user",
"content": "Проверьте этот план миграции и перечислите три допущения, которым больше всего нужен тест."
}
]
}'
POST /v1/responses/compact указан на этой модели. Это операция сжатия над gpt-6.1-sol, а не второй ID модели. Ввод изображения использует обычный массив содержимого в сообщении пользователя. Разница двух входов разобрана в Responses API и Chat Completions. Как использование сходится со счётом, разобрано в Отслеживание стоимости AI API.
Отличия запроса от GPT-6 Sol
Прайс-лист ввода и вывода короткой ступени совпадает с gpt-6-sol, а чтение кэша переходит с $0.20 на $0.10. Вывод длинной ступени у обеих — $15, а чтение кэша длинной ступени переходит с $0.40 на $0.20. gpt-6-sol остаётся в каталоге. Его публичные группы в этом чтении включают openai-premium, которого у 6.1 нет. При переходе на 6.1 фиксируйте имя модели в завершённом результате. Результат, который попал на другой ID, — не этот переход.
Формы, которые не проходят
reasoning.effort: none
reasoning.effort: minimal
tools в запросе Chat Completions
none и minimal возвращают HTTP 400. При переходе с gpt-6-sol или gpt-6-luna, оба из которых принимают none, сравните заново на low и уберите none из запроса. Инструменты, использование компьютера, поиск по файлам и поиск в вебе идут через Responses. Chat Completions несёт запросы, в которых нет инструментов.
Проверки перед переносом трафика
- Зафиксируйте
gpt-6.1-sol. Имя модели в завершённом результате тоже должно быть этим ID. - Оцените публичную цену на
openai-awardилиopenai-stableи выбирайте группу ключа по цене ошибки. - Переиграйте один набор без чувствительных данных на
low,medium,high,xhighиmax.noneиminimalвозвращают 400. - Кладите инструменты на Responses. Пример Chat Completions инструментов не несёт.
- Оцените один промпт на 272,000 входных токенов и один на 272,001. Второй использует единичные цены длинной ступени для всего запроса.
- Бюджет считайте по двум ступеням каталога. Fast, Batch, Flex и региональная надбавка со страницы модели следуют сумме, которая реально появляется в записи использования.
- Прочитайте число кэшированных токенов в записи использования, прежде чем пользоваться примером кэша выше.
- Самую трудную научную работу оставляйте на
gpt-6-astra.gpt-6-solостаётся доступным.
Источники
Проверено 30 сентября 2026 года. Modelflare независимо бенчмарки не воспроизводил.
- Страница запуска: https://openai.com/index/introducing-gpt-6-1-sol/
- Страница модели: https://developers.openai.com/api/docs/models/gpt-6.1-sol
- Раздел 6.1 руководства GPT-6: https://developers.openai.com/api/docs/guides/latest-model
- Дополнение к системной карте: https://deploymentsafety.openai.com/gpt-6-1-sol
- API цен Modelflare: https://modelflare.dev/api/pricing
- Страница цен: https://modelflare.dev/pricing/gpt-6.1-sol