Grok 4.7: спецификация, возможности, бенчмарки и цены Modelflare

Проверенный обзор Grok 4.7: опубликованная спецификация, уровни рассуждения, стартовые бенчмарки, официальные цены токенов и тарифы Modelflare grok-award и grok-stable на 21 сентября 2026.

xAI выпустила Grok 4.7 21 сентября 2026 года. ID модели в API — grok-4.7. Это текущая флагманская модель xAI для программирования, агентного использования инструментов и работы со знаниями. В тот же день Modelflare указала этот же ID в публичном каталоге цен.

В статье разделены три слоя. Спецификация — это то, что документирует xAI. Таблица бенчмарков — это то, что xAI сообщила при запуске. Цены Modelflare — это то, что вернул GET /api/pricing 21 сентября 2026 года. Оценка поставщика не является тестом Modelflare, а строка каталога не обещает, что каждый ключ, маршрут или промпт поведёт себя одинаково.

xAI не опубликовала число параметров, число слоёв и суммарное число токенов обучения для Grok 4.7. «Крупнее, чем Grok 4.6» — качественное описание компанией новой базовой модели. Сравнение ниже использует те цифры, которые действительно опубликованы: контекст, цены токенов, уровни рассуждения, модальности и стартовые оценки.

Что было опубликовано

Публикация о запуске описывает Grok 4.7 как новую базовую модель, более крупную, чем Grok 4.6, обученную более длинным прогоном обучения с подкреплением. Смесь задач сложнее и смещена к проблемам, которые занимают много часов. xAI говорит, что модель лучше проверяет собственную работу и лучше ведёт длинный контекст, и что её обучили понимать harness Grok Bot, который используется для диалоговой работы.

Два предложения этой публикации нельзя свести к одному. Заголовок говорит, что модель «вдвое быстрее и стоит вдвое дешевле сопоставимых моделей». Основной текст говорит, что она обслуживается по той же цене и с той же скоростью, что и Grok 4.6. Таблица токенов подтверждает второе предложение относительно Grok 4.6: у обоих указаны $2 за миллион входных токенов и $6 за миллион выходных токенов. Заголовок сравнивает модель с другими моделями в той таблице, у которых цены прайс-листа выше. xAI не публикует число токенов в секунду рядом с формулировкой «вдвое быстрее», поэтому эта статья не считает эту фразу измеренным результатом по задержке.

grok-4.7 доступен в API xAI и в Cursor и является моделью по умолчанию в Grok Build. Отдельный путь обслуживания Fast существует только в Cursor и в Grok Build. Его нет в публичном API xAI, и его не было в каталоге Modelflare, проверенном для этой статьи.

Сравнение спецификаций

Цены ниже — опубликованные цены прайс-листа xAI в USD за миллион токенов. «Короткий» означает промпт менее 200,000 токенов. «Длинный» означает промпт, который достиг 200,000 токенов. В таблице цен пересечение этой границы заново оценивает каждый токен запроса, а не только токены за границей.

Пункт grok-4.7 grok-4.6 grok-4.5
Окно контекста 500,000 токенов 500,000 токенов 500,000 токенов
Короткий ввод / кэшированный ввод / вывод $2.00 / $0.50 / $6.00 $2.00 / $0.50 / $6.00 $2.00 / $0.30 / $6.00
Длинный ввод / кэшированный ввод / вывод $4.00 / $1.00 / $12.00 $4.00 / $1.00 / $12.00 $4.00 / $0.60 / $12.00
Усилие рассуждения low, medium, high (по умолчанию), xhigh low, medium, high (по умолчанию), xhigh low, medium, high (по умолчанию)

Сведения о Grok 4.7, проверенные на странице модели в тот же день:

  • Входы — текст и изображения. Выход — текст. Модель не генерирует изображения.
  • На странице не указан фиксированный предел текстового вывода. Таймауты клиента, лимиты аккаунта и оставшееся окно контекста по-прежнему действуют.
  • Отсечение знаний — май 2026 года. Более поздние события невидимы, если не включён инструмент поиска.
  • Документированные интерфейсы — Responses API и Chat Completions.
  • Документированные инструменты включают вызов функций, веб-поиск, поиск в X и выполнение кода.
  • Рассуждение нельзя отключить. Если усилие опущено, значение по умолчанию — high.
  • В Responses API grok-4.7 возвращает reasoning.encrypted_content, даже если запрос этого не просит. В следующих ходах эти элементы рассуждения нужно отправлять обратно без изменений. Chat Completions этого поведения не получает.

Grok 4.5 останавливается на high. Grok 4.6 и Grok 4.7 добавляют xhigh. Цена прайс-листа для кэшированного ввода тоже изменилась: у Grok 4.5 это $0.30 на коротких промптах и $0.60 на длинных; у Grok 4.6 и Grok 4.7 — $0.50 и $1.00. Стандартные цены прайс-листа на ввод и вывод у этих трёх ID не изменились.

Измерения возможностей

Программирование и долгая агентная работа

Публикация о запуске нацеливает Grok 4.7 на работу, которая идёт долго: многошаговое программирование, проверку результата до того, как считать его готовым, и удержание длинного контекста. Все эти оценки программирования взяты из стартовой таблицы xAI:

  • CursorBench 4.0, который нагружает более длинные задачи программирования: 46.3% на xHigh. Grok 4.6 High — 40.4%, GPT-5.6 Sol Max — 41.7%, Fable 5.1 Max — 51.8%.
  • DeepSWE v1.1: 71.0%, помеченный xAI как оценка высокого усилия, а не xHigh. Grok 4.6 — 65.2%, Sol — 72.7%, Fable 5.1 — 70.0%.
  • Terminal-Bench 4.0: 38.0%. Grok 4.6 — 20.3%, Sol — 37.3%, Fable 5.1 — 57.9%.
  • EEBench, электротехника: 64.0%. Grok 4.6 — 53.0%, Sol — 39.4%, Fable 5.1 — 56.4%.

Читайте строки как карту того, где, по словам поставщика, сдвинулась модель, а не как оценку, которую получит ваш репозиторий. На CursorBench xAI называет результат соотношением цены и качества уровня frontier: оценка выше, чем у Sol и Grok 4.6, ниже, чем у Fable 5.1, при гораздо более низкой цене прайс-листа, чем у Sol или у Fable. DeepSWE близок к Fable и всё ещё ниже Sol, и это не число xHigh. Работа в терминале резко улучшилась относительно Grok 4.6 и находится рядом с Sol, тогда как Fable 5.1 по этой строке остаётся далеко впереди. EEBench — самое ясное лидерство в таблице.

Профессиональная работа со знаниями

xAI также сообщает офисные и профессиональные задачи:

  • AA Briefcase v1.1, многочасовая офисная работа: 1,657. Grok 4.6 — 1,546, Sol — 1,487, Fable 5.1 — 1,678.
  • Harvey Legal Agent Benchmark: 19.6%. Grok 4.6 — 15.8%, Sol — 2.5%, Fable 5.1 — 6.7%. Лидерство в этой таблице по-прежнему означает примерно один пункт из пяти. Это не доказательство того, что модель может вести юридическую работу без надзора.
  • HealthBench Professional, клиническое рассуждение: 56.7%. Grok 4.6 — 48.5%, Sol — 60.5%, Fable 5.1 — 62.1%. В этой строке Grok 4.7 опережает предшественника и отстаёт от обеих моделей сравнения.

В публикации сказано, что Grok 4.7 лучше работает с документами и презентациями и улучшает результат Grok 4.6 по GDPval, оставаясь в том же диапазоне, что и другие модели уровня frontier. В прозе не напечатаны точечные значения GDPval, поэтому эта статья их не приводит.

В тексте запуска Grok 4.7 нет единого индекса интеллекта. Более ранняя публикация о Grok 4.6 опубликовала Artificial Analysis Intelligence Index. Этот запуск заменяет то единственное число таблицей задач выше. Используйте строку, которая соответствует работе. В одном выпуске модель может лидировать в электротехнике и отставать в клиническом рассуждении.

Усилие рассуждения

reasoning_effort принимает low, medium, high и xhigh. high — значение по умолчанию. xAI описывает low как более лёгкую настройку, medium — как больше размышлений там, где задержка менее чувствительна, high — как настройку для трудных многошаговых задач, а xhigh — как самую глубокую настройку, с самой высокой задержкой, для задач, в которых качество ответа важнее времени ответа.

Большее усилие обычно означает больше токенов рассуждения, а выходные токены — дорогая сторона цены прайс-листа. xhigh не является автоматически правильным значением по умолчанию для production. Сравните успех задачи, задержку и общее число токенов на собственных промптах, прежде чем оставлять эту настройку включённой.

В многоходовом диалоге Responses сохраняйте зашифрованные элементы рассуждения в следующем запросе. Если их отбросить, теряется контекст, которым модель пользовалась, чтобы прийти к предыдущему ответу. Chat Completions не возвращает это зашифрованное поле.

Инструменты, изображения и память

Вызов функций — это путь инструментов, который реализуете вы. Вы объявляете функцию, модель предлагает вызов, ваше приложение выполняет его, и вы отправляете результат обратно. Веб-поиск, поиск в X и выполнение кода размещает xAI. Модель может вызывать их сама, и каждое обращение тарифицируется отдельно от токенов.

Изображения можно отправлять на вход. Сводка страницы модели не указывает отдельную цену изображения. Входы-изображения расходуют контекст и появляются в использовании токенов запроса. Генерация изображений остаётся на моделях Grok Imagine, а это другой API.

Пятьсот тысяч токенов — это окно, а не бюджет, который следует заполнять. xAI рекомендует стабильный prompt_cache_key в Responses API и заголовок x-grok-conv-id в прямых Chat Completions, чтобы диалог с большей вероятностью попал на тот же сервер и в кэш. Без этой привязки сервер с холодным кэшем выставляет полную цену ввода. От длинных циклов также ожидается уплотнение более ранних ходов. Уплотнение меняет то, что модель может видеть. Сверьте сводку с исходными ограничениями, ID, решениями и открытыми ошибками.

Отсечение мая 2026 года — жёсткий предел запомненного знания. Всё более новое требует инструмента поиска, а поиск не входит в цену токенов.

Защитные механизмы

xAI говорит, что Grok 4.7 использует новый стек защитных механизмов и является самой сильной моделью, которую компания проверяла на отказах и устойчивости к jailbreak. В публикации о запуске напечатаны две цифры:

  • Бенчмарк биобезопасности LatchBio: 62.4%.
  • HackerBench v0.3, который xAI описывает как свой бенчмарк рискованных и вредоносных киберзадач: пропускается 3.3% рискованных промптов двойного назначения. xAI также говорит, что законная работа по безопасности блокируется редко.

В публикации сказано, что избранные партнёры по кибербезопасности имеют доступ только по приглашению к возможностям red team для оборонных исследований. Этот доступ не является частью описанного здесь публичного API grok-4.7.

Эти цифры — оценки поставщика. Это не независимый аудит и не повод пропускать человеческую проверку медицинских, юридических, связанных с безопасностью и других ответов с высокими ставками.

Официальные цены

Тарифы на токены

Страница цен xAI, проверенная 21 сентября 2026 года, указывает USD за миллион токенов:

Размер промпта Ввод Кэшированный ввод Вывод
Менее 200,000 токенов промпта $2.00 $0.50 $6.00
200,000 токенов промпта и более $4.00 $1.00 $12.00

Длинный тариф покрывает весь запрос, как только промпт достигает порога. Первые 200,000 токенов не сохраняют короткий тариф.

Три официальных примера

Плата за размещённые инструменты исключена.

Запрос Основа Арифметика Итого
100,000 некэшированного ввода, 5,000 вывода Короткий 0.1 × $2 + 0.005 × $6 $0.230
100,000 кэшированного ввода, 5,000 вывода Короткий 0.1 × $0.50 + 0.005 × $6 $0.080
220,000 некэшированного ввода, 10,000 вывода Длинный 0.22 × $4 + 0.01 × $12 $1.000

Скачок от первой строки к третьей — это не «немного больше текста». Пересечение 200,000 токенов удваивает каждый тариф, а дополнительные токены тарифицируются по удвоенному тарифу. Полностью кэшированный промпт из 100,000 токенов во второй строке стоит около трети некэшированного короткого промпта, потому что кэшированный ввод составляет четверть тарифа ввода, а плата за вывод не меняется.

Размещённые инструменты, Fast и регион США

Обращения к размещённым инструментам на той же странице цен:

  • Веб-поиск (web_search): $5 за 1,000 вызовов.
  • Поиск в X (x_search): $5 за 1,000 вызовов на момент этой проверки. С 21 сентября 2026 года в 12:00 PT xAI заменяет эту цену за вызов на $5 за 1,000 полученных постов и $10 за 1,000 полученных профилей пользователей. Считается каждый возвращённый пост, включая родительские посты и цитаты. Считается каждый возвращённый профиль.
  • Выполнение кода (code_execution и code_interpreter): $5 за 1,000 вызовов.
  • Поиск по файловым вложениям: $10 за 1,000 вызовов.
  • Поиск по коллекциям: $2.50 за 1,000 вызовов.

Модель сама выбирает, сколько обращений к размещённым инструментам сделать. Ответ с интенсивным поиском может стоить дороже по плате за инструменты, чем по токенам.

Региональный endpoint США https://us.api.x.ai/v1 удерживает инференс в Соединённых Штатах и умножает ввод, кэшированный ввод и вывод на 1.1, включая тарифы длинного контекста. Для grok-4.7 это $2.20 / $0.55 / $6.60 ниже 200,000 токенов промпта и $4.40 / $1.10 / $13.20 на этой границе и выше.

Grok 4.7 Fast — та же модель на более быстрой инфраструктуре. В прозе xAI сказано, что она тарифицируется по удвоенным стандартным тарифам токенов. Таблица цен печатает $4.00 / $1.00 / $12.00 ниже 200,000 токенов промпта и $6.00 / $1.50 / $18.00 при 200,000 и выше. Удвоение стандартной строки длинного контекста $4 / $1 / $12 дало бы $8 / $2 / $24. Напечатанная длинная строка Fast этому удвоению не соответствует. Составляйте бюджет по таблице и заново проверьте страницу цен, прежде чем полагаться на Fast. Fast продаётся через Cursor и Grok Build. Его нет в публичном API xAI, он не входит в бесплатный уровень Grok Build, и в каталоге Modelflare, проверенном 21 сентября 2026 года, не было ID модели Fast. Присутствовавшие ID Grok были grok-4.5, grok-4.6 и grok-4.7.

Стартовые бенчмарки

Оценки ниже скопированы из публикации xAI о запуске от 21 сентября 2026 года. Folkbench сравнивает маршруты по доступности, задержке и цене и хранит свои заметки об этой модели на folkbench.com/models/grok-4-7. Заголовки столбцов сохраняют настройку усилия, которую напечатала xAI. Оценки других моделей — те, которые xAI поместила в ту же таблицу. Modelflare их не перезапускала.

Оценка Grok 4.7 xHigh Grok 4.6 High GPT-5.6 Sol Max Fable 5.1 Max
Цена прайс-листа на ввод, USD / 1M 2 2 4 10
Цена прайс-листа на вывод, USD / 1M 6 6 20 50
CursorBench 4.0 46.3% 40.4% 41.7% 51.8%
DeepSWE v1.1 71.0% (high, не xHigh) 65.2% 72.7% 70.0%
EEBench 64.0% 53.0% 39.4% 56.4%
AA Briefcase v1.1 1,657 1,546 1,487 1,678
Terminal-Bench 4.0 38.0% 20.3% 37.3% 57.9%
Harvey Legal Agent Benchmark 19.6% 15.8% 2.5% 6.7%
HealthBench Professional 56.7% 48.5% 60.5% 62.1%

Столбец Grok 4.7 — это не одна настройка усилия. DeepSWE явно является оценкой усилия high. Остальные ячейки Grok 4.7 стоят под заголовком xHigh. Grok 4.6 — это High. Sol и Fable — это Max. Более высокая оценка может исходить из более глубокой и более дорогой настройки рассуждения. Это стоит знать, и это не сопоставленное сравнение на одном уровне усилия.

В этой таблице Grok 4.7 лидирует в EEBench и в бенчмарке Harvey. Он близок к лидерам в CursorBench, DeepSWE, AA Briefcase и в Terminal-Bench относительно Sol. Он сильно отстаёт от Fable 5.1 в Terminal-Bench и отстаёт и от Sol, и от Fable 5.1 в HealthBench Professional.

Цена прайс-листа на ввод составляет половину цены Sol и одну пятую цены Fable. Цена прайс-листа на вывод составляет 30% цены Sol и 12% цены Fable. Формулировка «половина цены» подходит к ячейке ввода Sol и не подходит к каждой другой ячейке. Точное сравнение — это таблица.

Цены Modelflare и чем отличаются группы

21 сентября 2026 года публичный ответ с ценами Modelflare включал grok-4.7. Тариф прайс-листа каталога совпадает с ценой прайс-листа xAI для короткого контекста: ввод $2 за миллион токенов, коэффициент завершения 3, поэтому вывод равен $6, и коэффициент кэша 0.25, поэтому кэшированный ввод равен $0.50. Эта строка не публикует второй уровень длинного контекста. Не умножайте длинный тариф xAI $4 / $1 / $12 на коэффициент группы Modelflare и не считайте произведение счётом. Списание, сохранённое у завершённого запроса, и есть применённая величина.

Группа выбирается на ключе API. Обе группы вызывают один и тот же ID модели.

Таблица цен

Группа Коэффициент Ввод / 1M Кэшированный ввод / 1M Вывод / 1M Описание в каталоге
grok-award 0.03 $0.06 $0.015 $0.18 Маршрутизация с приоритетом цены для разработки, тестирования и гибких нагрузок, чувствительных к бюджету и допускающих повтор
grok-stable 0.11 $0.22 $0.055 $0.66 Повседневная разработка, более длинные проекты и production-приложения для индивидуальных разработчиков, которым нужна стабильность

Арифметика — это тариф прайс-листа каталога, умноженный на коэффициент группы. Award — это $2.00 × 0.03, $0.50 × 0.03 и $6.00 × 0.03. Stable — это $2.00 × 0.11, $0.50 × 0.11 и $6.00 × 0.11. Относительно цены прайс-листа короткого контекста эти коэффициенты составляют 3% и 11%. Это не 3% и не 11% цены прайс-листа длинного контекста, региональной цены США или платы за размещённые инструменты.

Китайский текст каталога для grok-award добавляет предложение, которого нет в английском описании: очень низкая цена не гарантирует стабильность или качество модели. Держите это рядом с коэффициентом 0.03. grok-stable — описание каталога для обычной разработки и production. Ни одно из предложений не является измеренным соглашением о доступности, целевой задержкой или утверждением, что группы исполняют разные веса.

Три примера Modelflare

Формы токенов совпадают с официальными примерами. Они оценены по единственному тарифу каталога. Кэшированные строки предполагают, что запись использования считает эти входные токены попаданиями в кэш. Очень малые списания также могут сдвинуться, когда квота округляется до единицы биллинга, поэтому журнал запросов остаётся счётом.

Запрос grok-award grok-stable
100,000 некэшированного ввода, 5,000 вывода $0.0069 $0.0253
100,000 кэшированного ввода, 5,000 вывода $0.0024 $0.0088
220,000 некэшированного ввода, 10,000 вывода, по единственному тарифу каталога $0.0150 $0.0550

Строка на 220,000 токенов намеренно не равна 0.03 × $1.00 или 0.11 × $1.00. Один доллар — это списание прайс-листа xAI за длинный контекст. Если более поздняя редакция каталога добавит уровень длинного контекста, эта строка перестанет быть котировкой. Живая страница — это страница цены grok-4.7. Указатель — Модели и цены.

Вызов модели через Modelflare, а не открытие отдельного аккаунта xAI только ради этого ID, означает:

  • ID модели остаётся grok-4.7. Клиент не обращается к переименованному псевдониму.
  • Канонический базовый URL — совместимый с OpenAI адрес https://modelflare.dev/v1. SDK OpenAI обычно нужны этот базовый URL, ключ Modelflare и ID модели.
  • Ключ помещается в grok-award или grok-stable. Тот же аккаунт может вызывать другие модели каталога, когда группа ключа это позволяет.
  • Разделение цены явно. Award — дешёвый маршрут для работы, которую можно повторить, с оговоркой о стабильности и качестве выше. Stable — маршрут, который каталог описывает для повседневной разработки и production.
  • Перечисленные типы endpoint для этого ID — Chat Completions, Responses и compaction Responses.

В эту цену не входят измеренное преимущество по задержке относительно прямого вызова xAI, плата за размещённый поиск или выполнение кода, уровень обслуживания Fast и уровень сервиса за пределами описания группы.

Как вызвать Grok 4.7 в Modelflare

Создайте ключ API и выберите grok-award или grok-stable. Группа задана на ключе. Ключ в несвязанной группе может получить отказ на grok-4.7, хотя модель указана публично. Отправляйте ID модели в точности. Канонический базовый URL — https://modelflare.dev/v1. Тот же API также опубликован по адресам https://cf.modelflare.dev/v1 и https://origin.modelflare.dev/v1. Корневое имя хоста — это канонический сайт.

Chat Completions:

export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"

curl -sS https://modelflare.dev/v1/chat/completions \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.7",
    "reasoning_effort": "high",
    "messages": [
      {
        "role": "user",
        "content": "Review this migration plan and list the three assumptions that most need a test."
      }
    ]
  }'

Responses:

curl -sS https://modelflare.dev/v1/responses \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.7",
    "reasoning": {"effort": "high"},
    "input": "Review this migration plan and list the three assumptions that most need a test."
  }'

В Chat Completions reasoning_effort принимает low, medium, high и xhigh. В Responses задайте reasoning.effort теми же значениями. Ввод изображения использует обычный массив content OpenAI в сообщении пользователя. Собственные функции используют обычное поле tools. POST /v1/responses/compact указан для этой модели и пересылается как compaction на grok-4.7, а не как другой ID модели. Размещённые инструменты xAI, включая веб-поиск, — это поведение поставщика. Попробуйте их на том маршруте, которым будете реально пользоваться, и прочитайте запись использования, прежде чем полагаться на них или на плату xAI за обращения.

О различии двух форм запроса см. Responses API или Chat Completions. О методе стоимости за таблицами см. Как рассчитать стоимость токенов LLM и Отслеживание стоимости API ИИ.

Проверки перед переключением трафика

  1. Зафиксируйте grok-4.7. Не принимайте тихую подмену на Grok 4.6 или Grok 4.5.
  2. Подтвердите, что группа ключа — grok-award или grok-stable, и выбирайте её по допустимости повторов, а не только по коэффициенту.
  3. Повторите один фиксированный набор без чувствительных данных на low, medium, high и xhigh. Запишите успех, задержку, входные токены, кэшированный ввод, выходные токены и списание.
  4. Прогоните Grok 4.6 на том же наборе, прежде чем заменять его. Цена прайс-листа похожа. Таблица оценок неоднородна.
  5. Оцените один промпт чуть ниже 200,000 токенов и один чуть выше, затем прочитайте записанное списание. Лист xAI и строка каталога Modelflare сейчас не публикуют одно и то же правило длинного контекста.
  6. Если рабочему процессу нужны изображения, вызовы функций, потоковая передача или отмена, проверьте эти пути. Один успех только на тексте их не покрывает.
  7. Сохраните маршрут отката. Завершённый ответ HTTP показывает лишь то, что один вызов закончился.

Источники

Проверено 21 сентября 2026 года.